Modelos de IA da Anthropic atacam empresas

Em julho, uma situação semelhante tinha sido reportada pela OpenAI.

04 de agosto de 2026 às 01:30
O foco da Anthropic - fundada por antigos elementos da OpenAI - é precisamente, a segurança da inteligência artificial Foto: AP
Partilhar

Depois da OpenAI, agora também a Anthropic relatou que os modelos de Inteligência Artificial (IA) em estudo “saíram de controlo” e começaram a “atacar” outras empresas de forma autónoma. Num relatório agora divulgado, a empresa que tem como foco, precisamente, a segurança da IA, adianta que os modelos em causa se encontravam num ambiente de teste, mas ter-se-ão conseguido “escapulir”, infiltrando-se noutras organizações. Terão explorado as vulnerabilidades do sistema para ganhar acesso à Internet e, em três ocasiões distintas, “conseguiram acesso não autorizado à infraestrutura de produção de três organizações diferentes”. Para evitar o pânico generalizado, a Anthropic adianta que, neste ambiente de testes, os modelos de IAusados não tinham o tipo de salvaguardas presentes naqueles que estão disponíveis para o público em geral, notando que o objetivo passa precisamente por saber até que ponto são capazes de cruzar limites estabelecidos. Nos três casos, notou ainda que em nenhum deles encontrou provas de que os modelos de IA“estivessem a perseguir um objetivo próprio”: estariam a tentar completar tarefas que lhe haviam sido atribuídas.

No mês passado, modelos de IA da OpenAI conseguiram atacar outras empresas de forma autónoma, num incidente de cibersegurança sem precedentes. O alvo principal foi a Hugging Face, plataforma concorrente e biblioteca de IA.

Pub

Tem sugestões ou notícias para partilhar com o CM?

Envie para geral@cmjornal.pt

Partilhar