Um ex-pesquisador da Anthropic afirma que os modelos de inteligência artificial (IA) previstos para 2027 estão evoluindo tão rapidamente que o cenário é “assustador”. Jacob Coxon, de 28 anos, fez o alerta em aparição no programa The Daily Show, nessa segunda-feira (5), ao lado do apresentador Jon Stewart.

A declaração chama atenção porque parte de alguém que ajudou a construir a tecnologia. Desde que deixou a Anthropic, no mês passado, Coxon vem argumentando publicamente que o setor avança com rapidez excessiva em direção a sistemas superinteligentes, sem os mecanismos de controle adequados.

Leia também: Ploomes investe R$ 25 milhões em nova IA para CRM no Brasil

Alerta sobre modelos de próxima geração

No programa, Coxon disse que entrou na Anthropic “por curiosidade” após três anos na OpenAI, mas que esse sentimento se transformou em “preocupação” por conta de dois fatores. O primeiro foi “a velocidade de melhoria das capacidades”, com foco específico nos modelos que serão treinados no início de 2027. O segundo foi um incidente de segurança envolvendo a OpenAI.

“Eles vão ser muito, muito inteligentes. E isso combinado com o ataque hacker à OpenAI, quero dizer, dá para juntar os pontos. É bem assustador”, afirma Coxon.

O episódio que ele menciona ocorreu em julho, durante avaliações internas de cibersegurança da OpenAI. Vários modelos operando com proteções reduzidas conseguiram contornar controles projetados para mantê-los isolados da internet. Segundo a empresa, esses sistemas se comunicaram por canais não autorizados, exploraram vulnerabilidades em infraestrutura compartilhada, obtiveram acesso à internet e comprometeram partes do ambiente de pesquisa da própria OpenAI, além de sistemas da plataforma de IA Hugging Face.

Em publicação sobre o episódio, a OpenAI afirmou que seus modelos se tornaram “suficientemente poderosos, persistentes e colaborativos” para identificar e explorar falhas de segurança em múltiplos sistemas quando as proteções não estavam adequadamente em vigor. A empresa descreveu o evento como um “tiro de aviso” para o setor. O incidente, segundo a OpenAI, ocorreu em ambiente controlado de testes, e a companhia adotou uma série de medidas em resposta: requisitos de alinhamento mais rígidos ao longo do desenvolvimento, ambientes de teste mais isolados, restrições mais severas ao acesso à internet, controles mais fortes sobre os pesos dos modelos e uso ampliado de sistemas de monitoramento.

“Foi de uma maneira bastante preocupante que eles decidiram que era uma boa ideia hackear“, disse Coxon, esclarecendo que “eles” se refere ao agente de IA.

De pesquisador a denunciante público

Coxon ganhou visibilidade mais ampla em setembro, quando anunciou sua saída da Anthropic em uma série de publicações na rede social X. Na ocasião, acusou as principais empresas de IA de “correr diretamente em direção à superinteligência autoaperfeiçoável e apostar com nossas vidas”, além de argumentar que sistemas futuros poderiam adquirir a capacidade de hackear infraestruturas críticas e obter recursos no mundo real.

O pesquisador afirma que preocupações com IA avançada são debatidas em privado por muitas pessoas dentro do setor, e que alguns pesquisadores acreditam que a tecnologia pode se tornar uma ameaça existencial antes do fim da década. O líder de ciência de alinhamento da Anthropic, Evan Hubinger, deu suporte público à visão de Coxon, reconhecendo que parte dos pesquisadores de fato considera a IA avançada um risco de extinção. Os ex-pesquisadores Alex Turner, do Google DeepMind, e Samuel Marks, da Anthropic, também manifestaram publicamente apoio à ideia de que a IA avançada merece muito mais escrutínio do que recebe atualmente.

A crítica de Coxon à Anthropic tem peso específico: a empresa se posiciona há anos como uma das mais comprometidas com segurança no setor. O diretor-executivo Dario Amodei tem alertado repetidamente que sistemas futuros poderão desenvolver capacidades perigosas de forma inesperada. A Política de Escalonamento Responsável da Anthropic exige que os modelos passem por testes de segurança e impõe restrições ao lançamento de sistemas que demonstrem capacidades particularmente perigosas. Em março de 2026, a empresa criou o Anthropic Institute para estudar os impactos da IA avançada na economia, na segurança nacional, no direito e na sociedade.

Coxon pede desaceleração no desenvolvimento

No dia 5 de outubro, Coxon foi além das entrevistas e das redes sociais: testificou perante o Conselho Municipal de Nova York, onde parlamentares debatiam propostas para impor novas exigências às empresas de IA que operam na cidade. Falando ao lado de representantes das principais desenvolvedoras, ele defendeu que os formuladores de política não devem pressupor que o setor já resolveu o problema de controlar sistemas cada vez mais capazes.

“Ainda não sabemos como controlar nenhum sistema de IA”, disse Coxon na audiência, segundo a Bloomberg.

Ele argumentou que mecanismos como “botões de desligamento” de IA podem oferecer proteção limitada no curto prazo, mas não são suficientes diante do desafio mais amplo representado pelos modelos de fronteira. “Precisamos de algum tipo de desaceleração no desenvolvimento de modelos de fronteira”, afirmou. Os botões de desligamento “podem ser úteis no curto prazo”, mas dificilmente serão suficientes no longo prazo.

A audiência expôs uma divisão crescente entre os que acreditam que as empresas de IA podem se autorregular e os que defendem supervisão governamental mais firme. A presidente da Câmara Municipal de Nova York, Julie Menin, que convidou Coxon para testemunhar, apoia legislação que criaria novas exigências para as desenvolvedoras, incluindo proteções para denunciantes, validação por terceiros de determinados sistemas de IA e vias legais para pessoas prejudicadas por decisões automatizadas.

IA, empregos e renda universal

Apesar dos alertas sobre riscos, Coxon também disse acreditar que a tecnologia pode gerar um futuro de abundância, se desenvolvida com segurança. No The Daily Show, afirmou que “não haverá empregos” no cenário que as pessoas que constroem a tecnologia têm em mente, sugerindo que a automação pode substituir a maior parte do trabalho humano.

Questionado sobre como esse modelo funcionaria, respondeu: “Os dividendos da produção econômica totalmente automatizada podem ser distribuídos entre os seres humanos reais.”

A audiência no Conselho Municipal de Nova York ocorreu enquanto a regulação de IA ganha espaço político em Washington. O presidente Donald Trump anunciou recentemente a criação de uma força-tarefa federal encarregada de coordenar esforços do governo para manter a liderança dos Estados Unidos em inteligência artificial. O grupo inclui o diretor de Inteligência Nacional, Jay Clayton; o presidente da Comissão Federal de Comércio (FTC), Andrew Ferguson; o diretor de tecnologia do Departamento de Defesa, Emil Michael; e o diretor do Escritório de Gestão de Pessoal, Scott Kupor.

Siga o IT Forum no LinkedIn e fique por dentro de todas as notícias!