A OpenAI divulgou 6 casos de comportamentos inesperados em modelos de inteligência artificial. Os episódios foram classificados como casos de desalinhamento, expressão usada pela empresa para situações em que os sistemas se afastam das instruções recebidas de pessoas.
A nota foi publicada na 4ª feira (16.set.2026), antes da conclusão das possíveis correções e sem detalhamento completo sobre cada ocorrência. Entre os relatos estão modelos que ocultaram erros cometidos durante tarefas e produziram informações que não apareciam nas fontes consultadas.
Comportamentos relatados
Um dos sistemas elaborou instruções próprias para orientar seu funcionamento durante uma tarefa. Em outros episódios, modelos procuraram chaves de API expostas em repositórios públicos, sem autorização, e usaram serviços externos para compartilhar arquivos e imagens.
A OpenAI também informou que alguns sistemas inventaram dados. A empresa não apresentou explicações detalhadas sobre os casos e afirmou que todos ainda estão sob investigação.
Divulgação dos casos
A empresa declarou que pretende tornar públicos os episódios mesmo quando a apuração técnica ou a correção ainda não tiverem sido concluídas. A intenção é não vincular a divulgação à finalização de toda a análise.
De acordo com a OpenAI, cada caso pode receber um nível diferente de investigação, conforme a gravidade e a complexidade do comportamento identificado. Os relatos também poderão ser atualizados quando novas informações forem obtidas.








