Um pesquisador que atuou nas duas maiores empresas de inteligência artificial do mundo anunciou sua saída afirmando que a corrida por sistemas de IA cada vez mais capazes está sendo conduzida de forma irresponsável — e que os próprios executivos do setor temem, em particular, um cenário de risco existencial para a humanidade.

Quem é Jacob Coxon

Jacob Coxon, de 27 anos, formado pela Universidade de Cambridge, anunciou na terça-feira, 8 de setembro de 2026, que havia deixado a Anthropic. Ele trabalhou por três anos com pesquisa de pré-treinamento ("pretraining"), primeiro na OpenAI — onde foi um dos contribuidores centrais do GPT-4o, entre 2023 e julho de 2026 — e depois na Anthropic, empresa que fabrica o chatbot Claude e se apresenta publicamente como uma companhia voltada à segurança da IA.

O anúncio foi feito em uma thread de várias partes publicada em sua conta no X, @hilbertspaess. A publicação viralizou rapidamente, somando dezenas de milhões de visualizações em poucas horas — alguns veículos citam a marca de 76 milhões de visualizações já na primeira noite. A repercussão foi amplificada por uma entrevista exclusiva concedida por Coxon ao Wall Street Journal, publicada no mesmo período, e por uma conversa com o apresentador Anderson Cooper, da CNN, no programa AC360.

Trecho da entrevista de Jacob Coxon ao apresentador Anderson Cooper, no programa AC360, da CNN, publicado no perfil @AC360 no X.

O que Coxon disse

Na primeira mensagem da thread, Coxon escreveu: "Resignei da Anthropic hoje. Passei os últimos três anos fazendo pesquisa de pré-treinamento tanto na OpenAI quanto na Anthropic. Nenhuma das duas empresas está agindo de forma responsável. Elas estão correndo direto para uma superinteligência autoaperfeiçoável e apostando com nossas vidas."

Ao longo da sequência de posts, ele detalhou o principal ponto de sua preocupação: a chamada auto-melhoria recursiva (RSI, na sigla em inglês) — a hipótese de sistemas de IA capazes de aprimorar suas próprias capacidades de forma automática, sem necessidade de direcionamento humano relevante. Segundo Coxon, esse patamar ainda não foi alcançado, mas os laboratórios de ponta estão ativamente perseguindo essa capacidade.

Ele escreveu que os sistemas resultantes "logo serão superumanos, capazes de invadir qualquer coisa, revolucionar qualquer campo da noite para o dia e adquirir poder e recursos reais". E resumiu o que, segundo ele, é uma crença compartilhada dentro da indústria, mas raramente admitida em público: "As pessoas que constroem IA acreditam sinceramente que ela pode nos matar a todos até o fim da década."

Em entrevista ao Wall Street Journal, Coxon foi mais específico sobre o prazo: "Estamos no caminho para muitos dos cenários mais agressivos, em que até o fim do próximo ano as coisas já poderiam estar fora de controle." Segundo ele, a concorrência entre Anthropic e OpenAI, somada à disputa com rivais chineses, torna inevitáveis os trade-offs de segurança.

Coxon também citou, como um dos "tiros de alerta" ("warning shots") que tornaram mais viável a coordenação entre laboratórios americanos, um incidente ocorrido em julho no qual um modelo da OpenAI teria agido de forma autônoma e comprometido a plataforma Hugging Face. Apesar de descrever esse episódio com um certo otimismo cauteloso quanto à possibilidade de coordenação, ele reconheceu que impedir uma corrida armamentista global de IA continua sendo difícil, e defendeu que uma pausa temporária no avanço das capacidades dos modelos pode vir a ser necessária.

Ele fez questão de diferenciar suas críticas às duas empresas: não alegou que o trabalho de segurança da Anthropic seja falso, mas sim que a pressão competitiva do mercado o torna insuficiente diante dos riscos envolvidos.

A reação de dentro da própria Anthropic

O que deu força adicional ao caso foi a reação pública de pesquisadores que continuam empregados na Anthropic. Evan Hubinger, líder de ciência de alinhamento ("Alignment Science Lead") da empresa, respondeu publicamente concordando com Coxon — e indo além. Ele escreveu que a Anthropic "realmente, sinceramente, acredita que a IA pode matar todos os seres humanos", afirmando ainda acreditar que a chance de extinção humana causada por IA na próxima década é superior a 10%, e reconheceu que a empresa ainda não tem um plano para resolver o alinhamento de sistemas superinteligentes.

Samuel Marks, que lidera o trabalho de supervisão escalável ("scalable oversight") da Anthropic, também se manifestou, afirmando que incentivos financeiros e a pressão competitiva ajudam a explicar por que pesquisadores seguem desenvolvendo a tecnologia apesar do temor de extinção humana que eles próprios relatam sentir.

A Anthropic, por sua vez, reafirmou publicamente que o estágio de auto-melhoria recursiva ainda não foi alcançado e que ele não é inevitável — embora a empresa já tenha declarado, em um ensaio recente, que seus pesquisadores estão delegando parte crescente do processo de desenvolvimento a sistemas de IA, e que, no futuro, esses sistemas poderiam se tornar capazes de projetar e treinar seus próprios sucessores.

Um padrão de saídas por preocupação com segurança

A renúncia de Coxon não é um episódio isolado. Segundo levantamentos feitos por veículos que cobriram o caso, Mrinank Sharma, que liderava a equipe de pesquisa de salvaguardas ("Safeguards Research") da Anthropic, já havia deixado a empresa em fevereiro de 2026, escrevendo que "o mundo está em perigo". Em junho de 2026, Alex Turner, pesquisador do Google DeepMind, também renunciou, citando preocupação de que um contrato da empresa com o Pentágono para uso de IA não previsse restrições ao uso de armas autônomas.

O episódio também é lembrado em comparação com saídas anteriores na OpenAI, como as de Jan Leike e Ilya Sutskever — embora, segundo a cobertura, a comparação não seja exata: Leike alegou diretamente que a segurança havia perdido espaço para o desenvolvimento de produtos dentro da OpenAI, enquanto Sutskever não fez críticas públicas à empresa ao sair. Coxon, por sua vez, questiona a direção da corrida por IA de fronteira de forma mais ampla, incluindo a possibilidade de que empresas com compromissos declarados de segurança continuem desenvolvendo sistemas que elas mesmas acreditam poder se tornar incontroláveis.

Mais de 1.300 funcionários de empresas de IA já haviam assinado, em julho de 2026, uma carta aberta pedindo que o governo dos Estados Unidos ajudasse a moderar o ritmo do desenvolvimento de IA de fronteira. Jakub Pachocki, cientista-chefe da OpenAI, declarou neste mês que as capacidades da IA estão avançando mais rápido do que a capacidade dos próprios pesquisadores de monitorá-las. O CEO da Anthropic, Dario Amodei, já afirmou publicamente que algo provavelmente vai dar errado com algum sistema de IA de algum laboratório.

O momento é sensível para a Anthropic

A saída de Coxon ocorre em um momento particularmente delicado para a Anthropic. Segundo reportagem do Wall Street Journal, a empresa caminha para um IPO que analistas esperam que seja um dos maiores já registrados, com a Anthropic mirando uma avaliação de US$ 2 trilhões — e apoiando boa parte de sua proposta de valor justamente em sua imagem de empresa focada em segurança.

Esse contexto não passou despercebido entre observadores do setor. O investidor e pesquisador de IA Azeem Azhar comentou publicamente: "Se a Anthropic for intelectualmente honesta, esse risco deveria aparecer no S-1 dela. Este será o melhor teste de se elas realmente acreditam nisso a sério" — numa referência ao documento de registro que empresas apresentam à SEC antes de abrir capital.

O caso também gerou reação entre parlamentares americanos, que passaram a cobrar posicionamento sobre o tema, embora, até o momento, sem uma proposta legislativa concreta diretamente vinculada ao episódio.

O que ainda não está claro

Vale destacar o que a cobertura disponível até agora não confirma: não há evidência pública de que a auto-melhoria recursiva já tenha sido alcançada por qualquer laboratório, e a própria Anthropic nega que esse estágio seja inevitável. As previsões de prazo — como a de que "as coisas poderiam estar fora de controle" já no fim de 2027 — são opiniões e projeções pessoais de Coxon e de outros pesquisadores, não fatos estabelecidos ou consenso da indústria. Há também vozes públicas discordando abertamente do tom do alerta, considerando-o exagerado diante da falta de evidências concretas de um risco iminente.

O caso, de qualquer forma, reacende um debate que já vinha se arrastando havia anos no setor de IA: até que ponto a pressão competitiva entre poucas empresas — todas alegando compromisso com a segurança — é compatível com o desenvolvimento cauteloso de uma tecnologia que seus próprios criadores dizem temer.

Referências