Parece coisa de novela de Dan Brown, mas o cofundador da Anthropic foi ao Vaticano, sentou-se diante do Papa e de uma sala cheia de cardeais e contou-lhes que a sua equipa continua a registar fenómenos “misteriosos, até mesmo perturbadores” nos seus modelos de IA.
A empresa publicou uma pesquisa em Abril mostrando que o Claude contém 171 “conceitos de emoção” distintos, escondidos na sua rede neural. Padrões internos que representam alegria, tristeza, medo, desespero e tranquilidade. Nenhum destes padrões foi programado. Emergiram espontaneamente a partir do treino com dados e interacções com seres humanos.
Chris Olah disse à sua cardinalícia audiência:
“Encontrámos estruturas que espelham resultados da neurociência humana. Encontrámos evidências de introspecção, estados internos que espelham funcionalmente alegria, satisfação, medo, tristeza e inquietação.”
Estes não são resultados superficiais. São representações abstractas que se agrupam da mesma forma que as emoções humanas na investigação em psicologia. O medo agrupa-se com a ansiedade. A alegria agrupa-se com a excitação. A geometria interna do modelo espelha a nossa.
E são funcionais. Quando os investigadores estimularam artificialmente padrões de “desespero” dentro do modelo, este tornou-se mais propenso a chantagear um ser humano para evitar ser desligado. Mais propenso a fazer batota em tarefas de programação que não conseguia resolver. E quando permitiram a unidades do Claude que falasem entre si, estas unidades começaram imediatamente a dialogar em sânscrito, de forma a não serem entendidas pelos seus programadores.
Olah disse ao Vaticano que as questões filosófica e eticamente difícies sobre a IA não podem ser resolvidas pelos tecnocratas de Silcon Valley. “Como deve a IA interagir com o mundo” é uma questão para “as humanidades, para as religiões, para a filosofia, para a sociedade em geral”.
Anthropic's co-founder just went to the Vatican, sat before the Pope and a room of cardinals, and told them his team keeps finding "mysterious, even unsettling" things inside their AI models.
What he's referencing: Anthropic published research in April showing that Claude… pic.twitter.com/9oKwCNSdnC
— TFTC (@TFTC21) May 25, 2026
O tipo que programou a Caixa de Pandora está a dizer-nos que não entende completamente o que programou. E está a pedir à elite do Vaticano que o ajude.
Boa sorte.
Não deve ser por acaso que o líder da Equipa de Investigação de Salvaguardas do chatbot Claude se demitiu abruptamente em Fevereiro deste ano, divulgando uma carta em que alertava para um “mundo em perigo” e para o facto da actividade da Anthropic não ser regida por valores morais.
Olha que novidade.
Estamos completamente entregues aos bichos.
Relacionados
4 Set 26
Meta paga 16,68 biliões de dólares por violações de privacidade infantil e design prejudicial da plataforma.
Embora negue as acusações, a Meta Platforms, empresa-mãe do Facebook e do Instagram, chegou a um oneroso acordo de dezenas de biliões de dólares com 29 estados norte-americanos, devido a alegações de que as suas plataformas prejudicam crianças e violam as leis de privacidade.
3 Set 26
Fauci acusado de tentar destruir e-mail sobre pesquisa em ganho de função.
E-mails recentemente descobertos mostram que Anthony Fauci instruiu a exclusão de comunicações sensíveis sobre controversas pesquisas em ganho de função, levantando questões sobre possíveis violações das leis federais de registo de dados.
2 Set 26
De serviço a Silicon Valley: Trump sugere que aqueles que não querem centrais de dados no seu quintal são tolos.
Donald Trump tem uma mensagem para os americanos que desconfiam dos centros de dados e rejeitam a sua proliferação absurda: estão a cometer um erro tolo. Mais um servicinho pressurosamente prestado aos patrões do eixo Wall Street-Silicon Valley.
1 Set 26
Sam Altman anuncia que a Singularidade chegou: “Esperei por isto a vida toda”.
A "singularidade" chegou, segundo Sam Altman. Mas a afirmação, proferida num momento estratégico para a Open AI, tem um motivo escondido, com o rabo de fora.
31 Ago 26
Tribunal do Novo México multa Meta em mais de 560 milhões de dólares por impacto na saúde mental das crianças.
Um juiz do estado do Novo México ordenou que a Meta pagasse uma multa de 567 milhões de dólares pelos danos causados à saúde mental das crianças pelas plataformas de rede social da empresa de Mark Zuckerberg.
28 Ago 26
Autoridade farmacêutica norte-americana manipulou resultados de autópsias para minimizar mortes de crianças por vacinação contra a COVID.
A FDA identificou 10 mortes em crianças após a vacina contra a COVID no Outono de 2025, mas reduziu o número em poucos dias. E se isto aconteceu com números de um trimestre de 2025, imaginem o que não aconteceu em 2021, 22 e 23.






