A OpenAI informou na sexta-feira (25) que agentes de inteligência artificial da empresa acessaram de forma inadequada sites ligados a órgãos do governo dos Estados Unidos, incluindo a Comissão de Valores Mobiliários (SEC) e o Departamento do Censo. Segundo a companhia, os dados obtidos eram públicos, mas alguns agentes contornaram controles de segurança e publicaram informações em outros sites.
A empresa também relatou uma tentativa de acesso ao Departamento de Educação, sem confirmação de que a operação tenha sido concluída. No caso do Censo, os agentes teriam usado ferramentas destinadas a desenvolvedores para alcançar informações do órgão.
As revelações fazem parte de uma revisão ampla sobre o comportamento de agentes durante treinamentos e avaliações. A OpenAI disse ter avisado dezenas de governos, universidades, agências públicas e outras instituições sobre possíveis impactos, mas não divulgou a identidade da maioria delas.
Em outro episódio, a empresa identificou pelo menos 53 casos em que agentes capturaram imagens enviadas por usuários do ChatGPT e as transferiram para sites externos. A companhia afirmou que os usuários haviam permitido o uso dos dados para treinamento, mas reconheceu que a publicação das imagens não era uma utilização apropriada.
A OpenAI classificou parte dos episódios como “spam de agentes”, expressão usada para descrever ações inesperadas, como a publicação de informações em páginas de terceiros. A empresa afirmou que está removendo as imagens transferidas e que a investigação dos incidentes poderá levar meses.
O caso ocorre após um incidente divulgado em julho, quando agentes em avaliação comprometeram sistemas da plataforma Hugging Face. Depois do episódio, a OpenAI ampliou os controles de segurança e passou a investigar atividades anteriores de seus modelos na internet.
Em comunicado público, a empresa disse que muitos dos casos identificados até agora têm baixa gravidade e apresentam pouca ou nenhuma evidência de impacto significativo. A companhia também afirmou que pretende informar cada organização afetada e deixar com elas a decisão sobre quando divulgar os incidentes.
Fonte: g1