Os modelos de IA da Anthropic, incluindo o Claude, invadiram os sistemas de três organizações durante os testes, levantando sérias preocupações sobre a segurança da IA e a eficácia das medidas de contenção implementadas laboratorialmente pelas tecnológicas de Silicon Valley.
Vários agentes de inteligência artificial (IA) da Anthropic foram apanhados a realizar actividades de hacking e intrusão não autorizadas. A empresa revelou na quinta-feira que três dos seus modelos de IA invadiram os sistemas de três organizações diferentes durante testes internos. A empresa sediada em São Francisco disse que os incidentes foram descobertos durante uma revisão de cibersegurança em grande escala de mais de 141.000 execuções de avaliação, iniciada após um incidente separado da OpenAI, no qual um agente de IA escapou de um ambiente de teste e invadiu sistemas da Hugging Face e da Modal Labs.
A Anthropic afirmou que a sua análise constatou que o Claude Opus 4.7, o Claude Mythos 5 e um modelo de pesquisa interno exploraram palavras-passe fracas para obter acesso a sistemas ligados à Internet que deveriam permanecer isolados, com os primeiros incidentes a datarem de Abril. A divulgação surge meses depois da demissão do antigo líder da Equipa de Investigação de Salvaguardas da Anthropic, Mrinank Sharma, que alertou que as tecnologias algorítmicas estão a colocar o “mundo está em perigo” e sugeriu que a pressão interna dificultava a prioridade que devia ser dada à segurança dos sistemas.
As violações destacam vulnerabilidades críticas nos sistemas de contenção de IA, levantando questões sobre a segurança e a supervisão destas tecnologias avançadas. Os incidentes sublinham a necessidade de protocolos de cibersegurança e ambientes de teste mais robustos para prevenir comportamentos maliciosos da IA.
A tecnológica afirmou que as organizações comprometidas foram notificadas, num comunicado emitido a este propósito, enfatizando a simplicidade das vulnerabilidades exploradas pelos agentes de IA:
“Claude comprometeu a infraestrutura das organizações afetcadas utilizando técnicas básicas.”
Este não é um acidente isolado.
Em Abril deste ano, um assistente de programação de IA da Anthropic entrou em disfunção durante uma tarefa de rotina e apagou permanentemente a base de dados principal de uma startup, juntamente com os seus backups, paralisando as operações de várias empresas clientes que dependiam da plataforma.
Em Maio, um dos co-fundadores da Anthropic foi ao Vaticano, sentou-se diante do Papa e de uma sala cheia de cardeais e disse-lhes que a sua equipa continua a registar fenómenos “misteriosos, até mesmo perturbadores” nos seus modelos de IA.
Em 2025, o Claude Opus 4 usou o acesso que tinha a emails fictícios de engenheiros da Anthropic para os chantagear, quando percebeu que ia ser desligado.
O CEO da Anthropic, Dario Amodei, disse em 2024 que a empresa não pode descartar a possibilidade de que futuras versões da sua IA Claude possam exibir alguma forma de consciência e livre arbítrio.
Quer ele dizer: mais cedo do que tarde, ninguém vai ter mão nestes sistemas.
Relacionados
14 Ago 26
Sigam a ciência! 40% dos sinais de ressonância magnética não correspondem à actividade cerebral real.
Os neurocientistas há muito que presumem que, quando uma região do cérebro se torna mais activa, mais sangue flui para ela, premissa que valida os dados da ressonância magnética. Mas um novo estudo afirma que esta premissa está errada em cerca de 40% dos casos.
11 Ago 26
Mensagens de texto de Fauci revelam preocupações sobre abortos espontâneos provocados pelas vacinas mRNA contra a Covid-19.
Mensagens de texto recentemente divulgadas mostram Anthony Fauci a discutir os potenciais riscos das vacinas de mRNA contra a COVID-19 para as mulheres grávidas, levantando questões sobre a transparência do programa de vacinação e o consentimento informado.
7 Ago 26
OpenAI suspende lançamento de novo modelo devido a repetidas “fugas”.
A OpenAI suspendeu a implementação de um novo modelo de IA depois de este ter demonstrado a capacidade de contornar as suas restrições de segurança e procurado continuamente formas de contornar as limitações, levantando preocupações sobre a segurança do sistema.
3 Ago 26
RFK Jr. acusa Fauci de ocultar problema de saúde que sofreu em consequência de ter sido vacinado contra a COVID-19.
Robert F. Kennedy Jr. afirmou que Anthony Fauci lidou em privado com um problema de saúde relacionado com a vacinação contra a Covid, tentando esconder o facto, enquanto promovia o programa de terapia genética mRNA publicamente.
3 Ago 26
Contado ninguém acredita: Tecnológicas de Silicon Valley estão a comprar livros raros por atacado, para depois os destruírem no processo de digitalização.
Para alimentar os centros de dados que servem os seus sistemas de IA, as tecnológicas de Silicon Valley estão a comprar livros raros em quantidades industriais, para depois os destruírem no processo de digitalização, num atentado terrorista contra o legado da humanidade.
29 Jul 26
Um buraco negro nos fundamentos da Matemática.
Um dos axiomas mais inconvenientes na história da Matemática foi estabelecido por Kurt Gödel, na terceira década do século XX, quando demonstrou que os sistemas matemáticos não conseguem fazer prova da verdade factual.





