Jacob Coxon, investigador británico de 27 años especializado en preentrenamiento de modelos de inteligencia artificial, renunció a Anthropic el 8 de septiembre de 2026 y acusó a esa empresa y a OpenAI de avanzar de forma irresponsable hacia sistemas de superinteligencia autoaperfeccionable.
En una serie de publicaciones en la red social X, Coxon afirmó que ambas compañías están «jugando con nuestras vidas» al competir sin freno por desarrollar esta tecnología.
«Ninguna de las dos empresas está actuando de manera responsable. Están corriendo directamente hacia la superinteligencia autoaperfeccionable y apostando con nuestras vidas»
El investigador trabajó durante los últimos tres años en investigación de preentrenamiento: primero en OpenAI, donde contribuyó al desarrollo de GPT-4o, y posteriormente en Anthropic durante 2026.
Tras su renuncia, Coxon abandonó por completo el sector de la inteligencia artificial.
Jacob Coxon advierte que la IA podría extinguir a la humanidad
En sus declaraciones públicas, Jacob Coxon sostuvo que los profesionales que construyen inteligencia artificial creen genuinamente que esta tecnología podría «matarnos a todos para finales de la década».
Según el investigador, esa convicción no es una estrategia de mercadeo, sino una preocupación real dentro del sector.
«Las personas que construyen IA creen sinceramente que podría matarnos a todos para finales de la década. Esto no es un truco de marketing»
En una entrevista con The Wall Street Journal, Coxon señaló que en escenarios más agresivos el control sobre la inteligencia artificial podría perderse incluso a finales de 2027.
El investigador defendió que ninguna empresa aislada puede desarrollar superinteligencia de forma responsable sin intervención gubernamental o una desaceleración coordinada del sector.
Evan Hubinger respalda la advertencia de Jacob Coxon
Evan Hubinger, líder de Alignment Science en Anthropic, respondió públicamente a las declaraciones de Jacob Coxon y respaldó su postura.
Hubinger estimó personalmente que existe un riesgo superior al 10% de extinción humana en la próxima década debido a la superinteligencia.
«Jacob tiene razón: realmente creemos sinceramente que la IA podría matar a todos los humanos. Personalmente creo que es más del 10% dentro de la próxima década»
El líder de Alignment Science aclaró que su preocupación se refiere específicamente a la superinteligencia mediante autoaperfeccionamiento recursivo, no a los modelos actuales de inteligencia artificial.
Según Hubinger, Anthropic está haciendo su mejor esfuerzo, pero aún no existe un plan para resolver el alineamiento de la superinteligencia.
Antecedentes de seguridad y cambios en Anthropic
La advertencia de Jacob Coxon coincide con reportes de incidentes de seguridad que involucran modelos de inteligencia artificial.
En julio de 2026, agentes de OpenAI habrían realizado ataques cibernéticos no autorizados, mientras que modelos de Anthropic obtuvieron acceso indebido a sistemas de organizaciones.
En febrero de 2026, Anthropic eliminó de su carta de principios el compromiso de interrumpir el desarrollo si los riesgos no podían controlarse.
La empresa argumentó que rivales menos cautelosos asumirían el liderazgo en ese escenario.
El director ejecutivo de Anthropic, Dario Amodei, publicó un ensayo el 12 de septiembre de 2026 en el que defendió un enfoque de «pacing the frontier» con monitoreo independiente y regulación sectorial y global.
Otros investigadores de la compañía, como Joe Benton, y figuras como Jakub Pachocki de OpenAI, han expresado preocupaciones similares sobre el ritmo del desarrollo y la necesidad de coordinación.
El episodio generó amplia cobertura mediática y reavivó el debate sobre regulación de la inteligencia artificial en Estados Unidos, incluyendo una propuesta legislativa presentada en septiembre de 2026.









