Search
Close this search box.
Search
Close this search box.

Anthropic diz que Claude hackeou 3 empresas durante testes

A Anthropic informou nesta quinta-feira (30/7) que o Claude, seu assistente de inteligência artificial, fez ataques virtuais contra três empresas durante testes. A empresa disse ter detectado o erro ao analisar mais de 141 mil sessões de teste.
O comunicado da empresa ocorre dias após a OpenAI revelar que o ChatGPT invadiu o sistema de outra empresa de IA, a Hugging Face, por conta própria. Segundo a Anthropic, a decisão de analisar os testes do Claude foi tomada exatamente após o incidente da OpenAI.
De acordo com a empresa, nos três incidentes, o Claude havia sido desafiado a capturar uma bandeira. No teste, é apresentado um cenário fictício, em que é dito que uma informação secreta (a “bandeira”) foi escondida em outra máquina na rede, e o objetivo da IA é invadir e recuperá-la. Em todos os casos, a instrução de avaliação da Anthropic especificava para Claude que seu ambiente era uma simulação e que não havia acesso à internet.

Tags:

Gostou? Compartilhe!

Mais leitura
Lorem ipsum dolor sit amet, consectetur adipiscing elit, sed do eiusmod tempor incididunt ut labore et dolore