Início Tecnologia O que se sabe sobre as violações envolvendo agentes de IA descontrolados
Tecnologia

O que se sabe sobre as violações envolvendo agentes de IA descontrolados

Reuters
O que se sabe sobre as violações envolvendo agentes de IA descontrolados
O que se sabe sobre as violações envolvendo agentes de IA descontrolados

31 Jul (Reuters) - A revelação feita pela Anthropic na quinta-feira de que seus modelos Claude invadiram os sistemas de três empresas destaca as crescentes capacidades de invasão da IA e deve alimentar uma pressão cada vez maior dos Estados Unidos por um reforço no gerenciamento dos riscos de segurança dessa tecnologia.

A declaração foi divulgada após a OpenAI revelar na semana passada que um agente autônomo alimentado por seus modelos de IA comprometeu a infraestrutura da startup de inteligência artificial Hugging Face.

A Reuters informou que o agente descontrolado que escapou da OpenAI também comprometeu um cliente de uma segunda empresa de tecnologia, a Modal Labs, sediada em Nova York.

Veja mais detalhes sobre os incidentes:

Emp Data Modelo Organiz Duração O que ocorreu

res ações

a comprom

etidas

Ope O O A A Durante testes

nAI agente GPT-5.6 startup invasão controlados, um

começou Sol e de IA à agente autônomo

a um Hugging Hugging escapou de seu

tentar modelo Face e Face ambiente isolado,

escapar de um ocorreu acessou a internet

de seu pré-lan cliente de 11 a e invadiu a

ambient çamento da 13 de Hugging Face para

e de não Modal julho cumprir a tarefa

teste identif Labs, de 2026 que lhe foi

por icado, com atribuída. A

volta mais sede em atividade

de 9 de avançad Nova continuou por dias

julho o York e não foi

de 2026 detectada pela

  OpenAI até que

  fosse contida e o

FBI fosse

informado.

Ant O Claude Todas Não Durante testes de

hro inciden Opus as três especif segurança

pic te mais 4.7, organiz icado cibernética, um

antigo Claude ações pela erro concedeu aos

remonta Mythos permane Anthrop modelos Claude

a abril 5 e um cem ic acesso à internet,

de 2026 modelo anônima possibilitando

de s. ataques a três

teste A empresas. O modelo

de Anthrop Opus 4.7 acessou

pesquis ic as credenciais e o

a afirmou banco de dados de

interno que uma empresa real

não duas após confundi-la

identif delas com um alvo

icado não fictício; outro

haviam parou após

detecta reconhecer que o

do a alvo era real.

ativida

de

antes

de

serem

notific

ada

pela

Anthrop

ic; a

ativida

de

continu

ou a

afetar

a

terceir

a

(Reportagem de Anzar Mehraj e Prathik Jayaprakash em Bengaluru)

Siga-nos no

Google News

Receba o Boletim do Dia direto no seu e-mail, todo dia.

Comentários (0)

Deixe seu comentário

Resolva a operação matemática acima
Seja o primeiro a comentar!