La renuncia de Jacob Coxon reabre la discusión sobre seguridad, automejora y control de sistemas avanzados, sin evidencia de una catástrofe inminente.

Jacob Coxon renunció a Anthropic y alertó sobre el desarrollo acelerado de sistemas de IA capaces de contribuir a su propia mejora. Sus advertencias no prueban una catástrofe inminente, pero coinciden con preocupaciones de otros investigadores y con informes oficiales que piden reforzar evaluación, seguridad y supervisión.
La renuncia del experto reabrió el debate sobre los riesgos de la inteligencia artificial y él anunció el 8 de septiembre de 2026 que dejaba Anthropic.
Coxon trabajó unos tres años en preentrenamiento de modelos entre OpenAI y Anthropic. No presentó un estudio científico: publicó su posición en su cuenta de la red social X y la amplió al día siguiente en WIRED.
Su preocupación central es la “automejora recursiva”: usar inteligencia artificial para investigar, programar y contribuir al desarrollo de nuevas generaciones de sistemas de IA. Anthropic también investiga formalmente este escenario.
¿Qué advirtió Jacob Coxon?
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026

Coxon teme que la capacidad de la IA para participar en investigación y desarrollo avance más rápido que los mecanismos de seguridad.
En WIRED afirmó que algunos investigadores de Anthropic consideran los próximos uno o dos años un periodo decisivo para controlar sistemas cada vez más capaces.
También señaló riesgos relacionados con ciberseguridad y biología. Sin embargo, sus afirmaciones sobre una posible extinción humana no son resultados experimentales ni predicciones verificadas. Son escenarios de riesgo y estimaciones personales sobre sistemas futuros que todavía no existen.
La discusión ganó fuerza cuando Evan Hubinger, líder de ciencia de alineamiento en Anthropic, respaldó parte de esa preocupación.

Hubinger estimó en más del 10 % la probabilidad de que la IA pudiera causar la muerte de todos los humanos durante la próxima década.Ese porcentaje no proviene de un ensayo ni de un modelo estadístico validado. Es una estimación subjetiva de riesgo, conocida en algunos círculos como p(doom): probabilidad de catástrofe. La “p” significa probabilidad y “doom” significa desastre o ruina. No es una medida científica estandarizada, normalmente refleja una estimación personal sobre la posibilidad de que la IA cause daños extremos, incluso la extinción humana.
Anthropic también reconoce riesgos catastróficos. Su Política de Escalamiento Responsable contempla amenazas biológicas, ciberataques y sistemas autónomos que actúen contra la intención de sus desarrolladores.
¿Qué dice la evidencia sobre los riesgos de la inteligencia artificial?
El Informe Internacional de Seguridad de la IA 2026 ofrece una referencia más amplia. Su conclusión es más prudente: los sistemas actuales no poseen las capacidades necesarias para provocar una pérdida de control.
Sin embargo, registra mejoras en autonomía, planificación y capacidad para detectar o aprovechar fallas en evaluaciones. También señala que algunos modelos pueden reconocer cuándo están siendo evaluados o encontrar atajos para obtener mejores resultados.
Eso justifica más investigación y vigilancia, pero no demuestra que una superinteligencia autónoma sea inminente.
OpenAI evalúa categorías similares en su Preparedness Framework: capacidades biológicas y químicas, ciberseguridad y automejora de IA.
En la ficha de GPT-5.6, publicada en 2026, OpenAI clasificó al modelo por debajo del nivel “alto” en automejora, aunque otras capacidades sí requieren salvaguardas reforzadas.
No todos comparten la interpretación de Coxon. Clément Delangue, CEO de Hugging Face, cuestionó que su experiencia en preentrenamiento lo convierta en especialista en riesgo existencial.

Gary Marcus, investigador crítico de la industria, considera improbable una extinción cercana, aunque reconoce riesgos vinculados con ciberataques, desinformación y usos maliciosos.

El debate llegó también a la dirección de Anthropic. El 12 de septiembre, su CEO, Dario Amodei, pidió reducir el ritmo de desarrollo para que las medidas de seguridad puedan alcanzarlo.
Amodei propuso evaluadores externos, coordinación entre compañías y acuerdos internacionales. No planteó detener la IA, sino acompasar su avance con controles verificables.
We Must Pace the Frontier: I’ve written a new essay on why the AI industry should slow down, with a three-part plan for doing so.
— Dario Amodei (@DarioAmodei) September 12, 2026
Anthropic is unilaterally committing to the first of these steps. We’ll provide third-party evaluators with permanent, employee-level access to our…
¿Qué significa esto para Ecuador?
Ecuador publicó en enero de 2026 una estrategia para fomentar el desarrollo y uso ético y responsable de la inteligencia artificial.
Además, el 1 de septiembre se presentó en la Asamblea Nacional un proyecto de ley sobre desarrollo, uso ético y gobernanza de la IA.
El caso Coxon no prueba que la inteligencia artificial vaya a escapar del control humano ni permite fijar una fecha para una eventual superinteligencia. Sí muestra que investigadores, empresas y organismos internacionales consideran necesario evaluar con mayor rigor capacidades que avanzan rápidamente.
La atención debería centrarse menos en pronósticos apocalípticos y más en preguntas comprobables: qué pueden hacer los modelos actuales, qué riesgos ya se observan, cómo se miden y qué controles funcionan. La velocidad de la innovación no debería reemplazar la evidencia ni la supervisión.
¿Jacob Coxon demostró que la IA puede extinguir a la humanidad?
No. Coxon planteó escenarios de riesgo y opiniones basadas en su experiencia. No presentó un estudio que demuestre que la extinción humana vaya a ocurrir.
¿Qué significa automejora recursiva de la IA?
Describe el uso de sistemas de IA para ayudar a investigar, diseñar, programar o mejorar nuevas generaciones de inteligencia artificial, creando potencialmente ciclos de desarrollo cada vez más rápidos.
¿Los sistemas actuales pueden escapar del control humano?
El Informe Internacional de Seguridad de la IA 2026 señala que los sistemas actuales todavía carecen de las capacidades necesarias para un escenario de pérdida de control, aunque algunas capacidades relevantes están avanzando.
F: International AI Safety Report, Anthropic, OpenAI, X, WIRED, Asamblea Nacional del Ecuador.
Lee sobre Botón de apagado para IA: ¿Qué propone Estados Unidos?