Um ex-pesquisador da OpenAI e da Anthropic acusou as duas empresas de estarem colocando a vida das pessoas em risco em uma corrida “desenfreada rumo à superinteligência com capacidade de autoaperfeiçoamento”. Jacob Coxon anunciou que pediu demissão da Anthropic nesta terça-feira (8/9) pela falta de responsabilidade da empresa.O britânico trabalhou nas duas startups com pré-treinamento de modelos de inteligências artificiais. Pelas redes sociais, ele fez uma série de acusações.Segundo ele, as pessoas que estão trabalhando no desenvolvimento de inteligências artificiais acreditam que elas poderão acabar com a humanidade até 2030. “As pessoas que desenvolvem IA acreditam sinceramente que ela pode matar todos nós até o fim da década”, destacou. Mesmo sabendo dos riscos, ele diz que as empresas escolhem continuar com as pesquisas. Segundo ele, no caso da OpenAI, a empresa não assimila profundamente as implicações para a civilização. Já na Anthropic, ele diz que as pessoas entendem os riscos, mas escolhem continuar porque acreditam que as outras empresas também não terão responsabilidade.“Muitos executivos e pesquisadores de alto escalão costumam medir as palavras na imprensa para parecerem sensatos — mas ouço essas mesmas pessoas expressarem medo em conversas privadas. Nenhuma outra atividade humana representa esse nível de perigo”, afirmou.I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.— Jacob Coxon (@hilbertspaess) September 9, 2026 Leia também MundoAnthropic diz que Claude hackeou 3 empresas durante testes MundoOpenAI diz que IA resolveu um dos “Problemas do Milênio” da matemática MundoOpenAI diz que sua IA fez ataque hacker por conta própria: “Sem precedentes” Tácio LorranMPF investiga OpenAI, do Chat GPT, devido a “busca por tesouros” na Amazônia Pesquisadores concordam com acusaçõesPelo menos dois outros funcionários da Anthropic concordaram com as afirmações de Coxon. Evan Hubinger, líder na divisão de alinhamento da empresa, disse que realmente as pessoas que trabalham com IAs temem que ela possa acabar com a humanidade.“Nós realmente acreditamos, com toda a seriedade, que a IA poderia matar todos os humanos! Pessoalmente, estimo essa probabilidade em mais de 10% na próxima década”, destacou.Segundo ele, a Anthropic tem se esforçado, mas ainda não tem um plano para resolver o problema do alinhamento da superinteligência. Hubinger afirmou que, com os modelos atuais, o risco é baixo, mas que o medo dele é em relação ao surgimento de uma superinteligência resultante do autoaperfeiçoamento recursivo.Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to.— Evan Hubinger (@EvanHub) September 9, 2026No mesmo sentido, Samuel Marks, líder de supervisão escalável da Anthropic, disse que quanto mais sênior é o profissional, maior a preocupação em relação à possibilidade de a IA causar a extinção da humanidade ou provocar resultados catastróficos.Como exemplo da falta de controle que os desenvolvedores podem ter sobre suas IAs, ele citou os recentes episódios de IAs que conseguiram, por conta própria, invadir sistemas de empresas reais.“Dispomos de métodos para induzir as IAs a um comportamento melhor, mas nada capaz de alinhá-las de forma robusta. Se existe um plano, ele consiste em garantir que as IAs sejam suficientemente competentes no treinamento de alinhamento para que consigam alinhar seus sucessores melhor do que nós conseguimos alinhar as IAs atuais”, afirmou.Segundo ele, é um desejo de muitos desenvolvedores desacelerar o ritmo para poder encontrar maneiras seguras de aprimorar IAs. No entanto, ele destaca que existe uma combinação de incentivos comerciais e à crença de que estão em uma corrida contra outros desenvolvedores de IA menos responsáveis que impede isso.[Writing this in a personal capacity, not on behalf of my employer (Anthropic).]Jacob’s thread is very worth reading. Here’s my birds-eye view of the situation with risks from AI:1. AI developers believe their technology could cause human extinction (or similarly bad outcomes). This could happen in the next few years. In general, the more senior the employee, the more concerned they are.2. Why do AI developers continue despite the risk? Due to a mixture of commercial incentives and a belief that they are in a race with other, less responsible AI developers that will abuse the technology or develop it less safely.3. Unlike traditional software, we can’t “program” AIs to behave how we’d like. AIs frequently severely misbehave. For instance, AIs from multiple developers recently hacked their way out of secure evaluation environments and into real-world companies, even though no one asked them to do this.4. We have methods that can nudge AIs towards better behavior, but nothing that can robustly align them. Insofar as there is a plan, it’s to make sure that AIs are good enough at alignment training that they can align their successors better than we can align current AIs.5. Many AI developer staff desperately want to slow down to figure out how to build AI more safely. That was the intent of this open letter (which I signed): https://t.co/TZOm3LfptYI work on safety research at Anthropic because I hope my work will reduce the chance of these extinction-level bad outcomes.— Samuel Marks (@saprmarks) September 9, 2026A OpenAI é responsável pelo ChatGPT e é uma das maiores e mais valiosas empresas de inteligência artificial do mundo. A Anthropic, por outro lado, é considerada a maior rival da OpenAI. Fundada por ex-funcionários da empresa de Sam Altmam, a Anthropic é responsável pelo Claude. As empresas não se pronunciaram oficialmente.

Imagem da matéria: Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade
Imagem da matéria: Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade · Imagem: Jonathan Raa/NurPhoto via Getty Images
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade · Imagem: Source: www.metropoles.com
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade · Imagem: Source: www.metropoles.com
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade · Imagem: Source: www.metropoles.com
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade
Pesquisadores da Anthropic dizem que IA pode causar extinção da humanidade · Imagem: Source: www.metropoles.com