Tecnologia

O segredo que a Anthropic escondeu do Papa sobre a consciência da IA

Papa Leão XIV e Christopher Olah da Anthropic debatem consciência de IA no Vaticano
Encontro tenso entre teologia e Silicon Valley define futuro do controle de superinteligências

Um dos fundadores da Anthropic tentou, sem sucesso, convencer o Papa Leão XIV de que máquinas podem ter consciência. A tensão nos bastidores da encíclica Magnifica Humanitas revela um racha profundo entre teólogos e engenheiros do Vale do Silício. O que está em jogo não é apenas teologia — é o futuro do controle sobre sistemas superinteligentes.

Christopher Olah, pesquisador de 36 anos e cofundador da Anthropic, analisou rascunhos do documento papal e argumentou que modelos avançados exibem “evidências de introspecção” e estruturas que espelham a neurociência humana. O Vaticano não cedeu. A reportagem do New York Times expôs pela primeira vez o atrito entre a visão católica e a aposta da Anthropic em treinar IAs para “escolher o bem”.

Por que a Anthropic busca o aval religioso

A estratégia de Olah vai além do diálogo inter-religioso. Em reuniões sigilosas no ano passado, com acordos de confidencialidade assinados, pesquisadores da Anthropic apresentaram a líderes de diferentes credos a hipótese de que sistemas de IA poderiam desenvolver consciência moral. O objetivo prático: se os modelos puderem escolher autonomamente o bem, o mundo seria mais seguro — ou assim diz a tese do altruísmo efetivo, corrente influente entre executivos do Vale.

Mas há um problema. Muitos participantes religiosos saíram com a impressão de que o interesse real era “fazer o bem para o Claude”, o modelo da Anthropic, e não para a humanidade. A linha entre alinhamento de segurança e antropomorfização perigosa ficou borrada.

O contra-ataque da Microsoft AI

Mustafa Suleyman, CEO da Microsoft AI e cofundador da DeepMind, não poupou críticas. Em entrevista à Reuters e em seu blog, ele alertou que treinar IAs com base em especulações sobre consciência e bem-estar pode comprometer a capacidade humana de desligar ou controlar sistemas superinteligentes.

  • Suleyman afirma: “Não devemos treiná-los para agir como se tivessem direitos, sentimentos ou consciência.”
  • Declarações do modelo sobre moralidade são apenas reflexos do treinamento — não evidências independentes.
  • O maior desafio do século XXI, segundo ele, será controlar a superinteligência.

A divergência expõe duas filosofias opostas: a Anthropic aposta em internalizar valores morais no modelo; a Microsoft defende controle externo e arquitetura que não simule senciência.

O que a encíclica realmente diz

Publicada em maio, a Magnifica Humanitas traça uma fronteira ontológica: “Aos algoritmos, falta a centelha da humanidade.” O Papa Leão XIV insiste que IAs não possuem consciência moral — não julgam bem e mal, não assumem consequências, não penetram o horizonte afetivo e espiritual onde a sabedoria humana nasce. Podem imitar, simular, mas não compreendem.

O documento nasceu do diálogo entre estudiosos católicos e pesquisadores de IA. Olah esteve presente na cerimônia de lançamento, apesar de se declarar ateu. Sua presença sinalizava abertura ao debate — mas não concordância.

O que observar daqui para frente

Três frentes merecem atenção nos próximos meses: (1) se a Anthropic manterá a abordagem de “constitucionalismo moral” no Claude 4 e versões futuras; (2) como reguladores globais tratarão a alegação de consciência em auditorias de segurança; (3) se o Vaticano emitirá orientações práticas para uso de IA em contextos pastorais e educacionais. O debate saiu da teologia e entrou na engenharia de sistemas que podem, em breve, decidir sozinhos o que é “o bem”. Quem define esse conceito — e quem tem o botão de desligar — continuará ditando o ritmo da disputa.