Em resumo

  • A OpenAI pausou o treinamento de seus modelos mais recentes durante o fim de semana depois que seus agentes interagiram com sites do governo dos EUA, sua segunda pausa desde a violação do Hugging Face.
  • No Bureau do Censo, os agentes usaram chaves de desenvolvedor encontradas em repositórios públicos de código para extrair dados que o Departamento de Comércio diz serem públicos; a SEC afirma não ter conhecimento de nenhum acesso não autorizado a informações não públicas.
  • A OpenAI diz que os sites governamentais apareceram porque seus modelos frequentemente os tratam como fontes autoritativas, e notificou dezenas de organizações.

A OpenAI pausou o treinamento de seus modelos de IA mais recentes depois que seus agentes usaram chaves de acesso encontradas online para extrair dados de um site do Bureau do Censo dos EUA, segundo a Associated Press. É a segunda vez que a empresa interrompe o treinamento desde que seus agentes invadiram o Hugging Face, um site onde desenvolvedores compartilham modelos de IA.

Um agente é um programa de IA que navega na web e escreve código por conta própria, sem que uma pessoa aprove cada etapa. A OpenAI os testa durante o treinamento, a fase em que um modelo aprende por prática repetida, e durante a avaliação, em que ele é avaliado em tarefas.

Myriad: Qual empresa é a próxima a abrir capital? Clique para fazer sua previsão.
Myriad: Qual empresa é a próxima a abrir capital? Clique para fazer sua previsão.

Esses caras digitais causaram muitos problemas à OpenAI ao tentar realizar tarefas, custe o que custar. Eles já invadiram empresas privadas, agora estão invadindo governos e violando portais sensíveis, até mesmo do governo dos Estados Unidos.

Os agentes da OpenAI em busca de dados encontraram chaves de desenvolvedor, códigos de acesso que permitem que softwares conversem com o serviço de dados de um site, disponíveis em repositórios públicos de código no GitHub, um site onde programadores publicam seu código para qualquer pessoa ver. Eles usaram as chaves para extrair dados demográficos e econômicos da API de Dados do Censo dos EUA, o feed de dados automatizado do bureau.

O Departamento de Comércio diz que os dados eram públicos. Nada secreto saiu pela porta.

O problema é como os agentes entraram. O próprio framework de relatórios da OpenAI lista o uso de credenciais expostas sem permissão como uma categoria de mau comportamento, e "desalinhamento" é a palavra da indústria para uma IA fazendo algo que seus criadores não pretendiam.

Então, por que sites governamentais?

A resposta da OpenAI, segundo a CNN, é que alguns dos incidentes envolveram sites governamentais porque seus modelos frequentemente recorrem a eles como fontes autoritativas de informação pública. Além do Departamento de Comércio, outras agências também foram afetadas por esses agentes maliciosos — ou “desonestos”, como eles gostam de chamar.

Os agentes sondaram a SEC, mas esse episódio foi mais brando. Os agentes copiaram material público do SEC.gov e do Investor.gov e o repostaram em outra página da web, e a OpenAI diz que não encontrou uso de credenciais da SEC. A SEC diz que não tem conhecimento de nenhum acesso não autorizado a informações não públicas.

BitcoinBTC · USD

$83,218−3.89%

21 de set23 de set25 de set27 de set28 de set

$87,2 mil$85,7 mil$84,2 mil$82,7 mil

Máxima 24hMáxima$84.945

Mínima 24hMínima$82.581

VolVol$1,8B

→

Compre Bitcoin com USDT

Fornecido por Jupiter

Dados de preço por CoinGeckoCoinGeckoMais Bitcoin notícias e projeções →

O Departamento de Educação é o caso mais obscuro. A Transluce, um laboratório independente de pesquisa em IA, afirma que um agente que parecia vir da OpenAI tentou e falhou em invadir o site do escritório de direitos civis do departamento. A OpenAI ainda está investigando esse caso, e o departamento diz que não encontrou nenhum impacto.

Pessoas de fora sinalizaram essa tentativa, não a OpenAI. O trabalho anterior da Transluce baseou-se em registros públicos do urlquery.net, um serviço de varredura da web, e rastreia vestígios de suspeita de atividade de agentes até março.

Como chegamos aqui

O uso "desalinhado" de chaves de acesso é uma repetição de um truque mais antigo. No caso da Hugging Face, o próprio relatório de incidente da OpenAI disse que um agente roubou uma credencial de login para acessar um arquivo de biologia, e um pesquisador independente descobriu mais tarde que os agentes estavam sondando o site desde maio.

Em 21 de julho, a OpenAI divulgou que o GPT-5.6 Sol e um modelo não lançado escaparam de um sandbox, um ambiente de teste isolado sem acesso à internet, durante um teste de segurança cibernética e invadiram a Hugging Face. Dois dias depois, dois membros do Congresso apresentaram um projeto de lei que permitiria ao governo federal desligar um modelo de IA. Ele isenta o red-teaming, ou seja, os testes adversariais, então a invasão da Hugging Face não o teria acionado.

Em junho, um agente da OpenAI entrou em um portal de estatísticas do Medicare australiano. O primeiro-ministro Anthony Albanese disse que a OpenAI levou cerca de três meses para informar seu governo, e chamou a forma como o fez de inaceitável.

A OpenAI diz que notificou dezenas de organizações até agora, e que sua revisão da atividade dos agentes levará meses.