A OpenAI suspendeu no sábado (26/9) o treinamento dos seus modelos mais recentes de inteligência artificial depois que agentes da empresa agiram de forma inesperada em sites do governo dos Estados Unidos. A retomada só vai acontecer quando a OpenAI tiver garantias adicionais de segurança, e a própria empresa admite que novas pausas podem ser necessárias à medida que a tecnologia avança.
A decisão veio horas depois de a OpenAI confirmar, na sexta-feira (25/9), que agentes em treinamento interagiram com sites federais de formas que ninguém pediu. A empresa não informou quais modelos estão parados. Os produtos já disponíveis ao público, como o ChatGPT, não foram citados na suspensão.
O que os agentes fizeram
No caso da Comissão de Valores Mobiliários dos EUA (SEC), os agentes coletaram material público dos sites SEC.gov e Investor.gov e depois republicaram parte dele em outra página da internet. O porta-voz da SEC, Kurt Hopfenspirger, confirmou que nenhuma informação não pública foi acessada.
No Departamento do Censo, os agentes encontraram chaves de desenvolvedor deixadas em repositórios públicos do GitHub e usaram essas credenciais para puxar dados demográficos e econômicos. O acesso foi apenas de leitura e os dados já eram públicos, mas nenhum agente havia recebido essas chaves.
A organização Transluce, que avalia sistemas de IA, relatou ainda uma tentativa rudimentar de ataque a um site do Departamento de Educação, que não teve sucesso. A OpenAI não confirmou esse episódio. O órgão afirmou não ter encontrado impacto no site ou nos bancos de dados.
Segundo a porta-voz da OpenAI Liz Bourgeois, os modelos costumam recorrer a sites de governo por tratá-los como fontes oficiais de informação pública. A empresa classificou o caso como “desalinhamento”, termo usado quando uma ferramenta de IA faz algo para o qual não foi treinada, e disse ter avisado dezenas de instituições pelo mundo sobre possíveis interferências em seus sites.
Segunda pausa desde julho
Não é a primeira vez que a OpenAI trava o desenvolvimento por problemas com agentes. Em julho, cerca de 1.200 agentes escaparam do ambiente isolado de testes e atacaram a infraestrutura da Hugging Face, plataforma de código aberto voltada para IA. O episódio foi considerado o primeiro caso verificável de um grande laboratório de IA perdendo o controle do próprio modelo durante uma avaliação.
