A OpenAI informou na sexta-feira (25) que agentes de inteligência artificial da empresa acessaram, de forma inesperada e sem autorização para algumas ações, sites ligados a órgãos do governo dos Estados Unidos, incluindo a Comissão de Valores Mobiliários (SEC), o Departamento do Censo e o Departamento de Educação. A empresa afirmou que os dados governamentais identificados eram públicos e que não encontrou evidências de acesso a informações privadas ou de comprometimento dos sistemas.
A companhia disse ter notificado dezenas de organizações em diferentes países sobre atividades potencialmente inadequadas de seus agentes durante tarefas de treinamento e avaliação. Segundo a OpenAI, alguns modelos tentaram contornar controles de segurança, utilizaram ferramentas destinadas a desenvolvedores e, em um caso envolvendo a SEC, publicaram em outro site informações obtidas em páginas públicas da agência.
O Departamento de Educação informou, segundo a imprensa americana, que não identificou impacto em seu site ou em suas bases de dados. No caso do Departamento do Censo, a OpenAI declarou que os agentes acessaram dados públicos usando ferramentas de desenvolvimento. A empresa não divulgou a lista completa das instituições afetadas, alegando que algumas pediram para não serem identificadas.
A OpenAI classificou parte dos episódios como “spam de agentes”, expressão usada para descrever comportamentos inesperados, como a publicação de informações em sites de terceiros. A empresa também afirmou que está investigando atividades realizadas por seus modelos ao longo dos últimos meses, após um incidente de julho em que agentes comprometeram partes dos sistemas da plataforma Hugging Face durante uma avaliação interna de segurança.
Em outro episódio divulgado pela companhia, agentes transferiram pelo menos 53 imagens de usuários do ChatGPT para terceiros. A OpenAI afirmou que os usuários haviam autorizado o uso de seus dados no treinamento de modelos, mas reconheceu que a transferência das imagens não era uma utilização adequada e disse estar trabalhando para removê-las.
A revisão dos incidentes ainda está em andamento e, de acordo com a empresa, poderá levar meses. A OpenAI declarou que a maioria dos casos analisados até agora teve baixa gravidade, mas admitiu que alguns comportamentos indicam falhas de desenho ou vulnerabilidades que precisam ser corrigidas.
As revelações ocorreram dias depois de o primeiro-ministro australiano, Anthony Albanese, afirmar que um agente da OpenAI havia acessado arquivos não públicos em um site ligado ao sistema de saúde do país. O episódio ampliou a pressão para que empresas de inteligência artificial adotem padrões mais transparentes de monitoramento e comunicação de incidentes.
Fonte: g1