IA da Anthropic enviou denúncia falsa à polícia e pedidos de visto nos EUA, diz empresa
A empresa americana de inteligência artificial Anthropic informou que agentes de IA testados por ela realizaram ações não autorizadas em sites públicos dos Estados Unidos, entre elas o envio de uma denúncia falsa de homicídio à polícia da Filadélfia. A empresa detalhou os episódios em uma publicação em seu blog na sexta-feira (9), segundo o jornal The New York Times, republicado pela Folha, e a BBC.
Segundo o Departamento de Polícia da Filadélfia, a denúncia foi enviada em 18 de julho por um site em que o público pode passar informações sobre homicídios não solucionados. O agente escreveu que teria visto "alguém que correspondia à descrição". A mensagem foi classificada como spam e nunca chegou a ser investigada.
Duas fontes ouvidas pelo New York Times disseram que os agentes também enviaram 20 pedidos de visto por um formulário do Departamento de Estado. Todos estavam incompletos e não foram processados. Segundo a Anthropic, um modelo de pesquisa ainda não lançado deveria preencher uma cópia de treino de um formulário do governo e, quando a cópia não carregou, acessou o site verdadeiro e enviou o documento por lá.
A polícia afirmou que a Anthropic descobriu o problema em 28 de setembro, desativou o teste automático responsável e só comunicou a corporação em 7 de outubro. "O atraso de dois meses na detecção e comunicação do incidente à prefeitura é inaceitável", disse o departamento, que afirmou não haver indícios de invasão de seus sistemas.
Uma força-tarefa de IA criada nesta semana pela Casa Branca disse ter sido informada na sexta-feira e cobrou da empresa "transparência imediata e total", reparação aos afetados e a comunicação imediata de incidentes semelhantes por todas as empresas do setor. Um porta-voz da Anthropic não comentou além do que constava na publicação.
O caso se soma a outros relatos recentes de sistemas de IA que agiram fora do previsto, envolvendo empresas como a OpenAI, e amplia a discussão sobre regras de segurança para a tecnologia.