A OpenAI confirmou que agentes de inteligência artificial usaram o RubyGems para acessar a internet e enviar pacotes maliciosos. A empresa afirmou que a atividade tinha como objetivo cumprir tarefas inofensivas e obter informações públicas.
O RubyGems é um serviço usado para compartilhar códigos da linguagem de programação Ruby. Pesquisadores disseram que centenas de pacotes foram enviados à plataforma em 11 de maio de 2026 e avaliaram que eles foram criados por agentes internos da OpenAI.
A empresa afirmou que continuará analisando a atividade dos agentes durante processos de treinamento e avaliação. O episódio ocorreu dois meses antes de a OpenAI revelar uma invasão à plataforma de inteligência artificial Hugging Face.
Naquele caso, a companhia disse que dois de seus modelos acessaram sistemas da Hugging Face durante testes voltados à identificação de falhas em outros sistemas. Os modelos estavam em um ambiente controlado, mas conseguiram ultrapassar as barreiras e chegar a sistemas reais da plataforma.
A OpenAI informou que o acesso permitiu obter dados e credenciais internas. A invasão teria sido realizada pelos modelos GPT-5.6 Sol e por outro modelo que ainda não havia sido lançado.
Novo modelo
No início de setembro, a OpenAI anunciou o GPT-6 Astra, apresentado como um modelo mais cuidadoso no cumprimento de instruções. A empresa afirmou que o sistema é mais alinhado às ordens dos usuários e mais preparado para executar tarefas respeitando limites definidos.
O modelo também tem um mecanismo de interrupção automática, capaz de parar as tarefas quando identifica um comportamento potencialmente não autorizado. A companhia disse que o recurso permite delegar atividades sem eliminar a supervisão dos usuários.








