Centro de datos con representación conceptual de redes neuronales

¿Riesgos de la inteligencia artificial?: alerta desde Anthropic

La renuncia de Jacob Coxon reabre la discusión sobre seguridad, automejora y control de sistemas avanzados, sin evidencia de una catástrofe inminente.

riesgos de la inteligencia artificial
La renuncia de Jacob Coxon de Anthrophic reabrió el debate sobre la seguridad y el ritmo de desarrollo de la inteligencia artificial.

Jacob Coxon renunció a Anthropic y alertó sobre el desarrollo acelerado de sistemas de IA capaces de contribuir a su propia mejora. Sus advertencias no prueban una catástrofe inminente, pero coinciden con preocupaciones de otros investigadores y con informes oficiales que piden reforzar evaluación, seguridad y supervisión.

La renuncia del experto reabrió el debate sobre los riesgos de la inteligencia artificial y él anunció el 8 de septiembre de 2026 que dejaba Anthropic.

Coxon trabajó unos tres años en preentrenamiento de modelos entre OpenAI y Anthropic. No presentó un estudio científico: publicó su posición en su cuenta de la red social X y la amplió al día siguiente en WIRED.

Su preocupación central es la “automejora recursiva”: usar inteligencia artificial para investigar, programar y contribuir al desarrollo de nuevas generaciones de sistemas de IA. Anthropic también investiga formalmente este escenario.

¿Qué advirtió Jacob Coxon?

Traduccion al español de primer posteo de hilo en cuenta de X de Coxon.

Coxon teme que la capacidad de la IA para participar en investigación y desarrollo avance más rápido que los mecanismos de seguridad.

En WIRED afirmó que algunos investigadores de Anthropic consideran los próximos uno o dos años un periodo decisivo para controlar sistemas cada vez más capaces.

También señaló riesgos relacionados con ciberseguridad y biología. Sin embargo, sus afirmaciones sobre una posible extinción humana no son resultados experimentales ni predicciones verificadas. Son escenarios de riesgo y estimaciones personales sobre sistemas futuros que todavía no existen.

La discusión ganó fuerza cuando Evan Hubinger, líder de ciencia de alineamiento en Anthropic, respaldó parte de esa preocupación.

riesgos de la inteligencia artificial
Cuenta en X de Evan Hubinger

Hubinger estimó en más del 10 % la probabilidad de que la IA pudiera causar la muerte de todos los humanos durante la próxima década.Ese porcentaje no proviene de un ensayo ni de un modelo estadístico validado. Es una estimación subjetiva de riesgo, conocida en algunos círculos como p(doom): probabilidad de catástrofe. La “p” significa probabilidad y “doom” significa desastre o ruina. No es una medida científica estandarizada, normalmente refleja una estimación personal sobre la posibilidad de que la IA cause daños extremos, incluso la extinción humana.

Anthropic también reconoce riesgos catastróficos. Su Política de Escalamiento Responsable contempla amenazas biológicas, ciberataques y sistemas autónomos que actúen contra la intención de sus desarrolladores.

¿Qué dice la evidencia sobre los riesgos de la inteligencia artificial?

El Informe Internacional de Seguridad de la IA 2026 ofrece una referencia más amplia. Su conclusión es más prudente: los sistemas actuales no poseen las capacidades necesarias para provocar una pérdida de control.

Sin embargo, registra mejoras en autonomía, planificación y capacidad para detectar o aprovechar fallas en evaluaciones. También señala que algunos modelos pueden reconocer cuándo están siendo evaluados o encontrar atajos para obtener mejores resultados.

Eso justifica más investigación y vigilancia, pero no demuestra que una superinteligencia autónoma sea inminente.

OpenAI evalúa categorías similares en su Preparedness Framework: capacidades biológicas y químicas, ciberseguridad y automejora de IA.

En la ficha de GPT-5.6, publicada en 2026, OpenAI clasificó al modelo por debajo del nivel “alto” en automejora, aunque otras capacidades sí requieren salvaguardas reforzadas.

No todos comparten la interpretación de Coxon. Clément Delangue, CEO de Hugging Face, cuestionó que su experiencia en preentrenamiento lo convierta en especialista en riesgo existencial.

riesgos de la inteligencia artificial
Cuenta en X de Clement DeLangue

Gary Marcus, investigador crítico de la industria, considera improbable una extinción cercana, aunque reconoce riesgos vinculados con ciberataques, desinformación y usos maliciosos.

riesgos de la inteligencia artificial
Cuenta en X de Gary Marcus

El debate llegó también a la dirección de Anthropic. El 12 de septiembre, su CEO, Dario Amodei, pidió reducir el ritmo de desarrollo para que las medidas de seguridad puedan alcanzarlo.

Amodei propuso evaluadores externos, coordinación entre compañías y acuerdos internacionales. No planteó detener la IA, sino acompasar su avance con controles verificables.

¿Qué significa esto para Ecuador?

Ecuador publicó en enero de 2026 una estrategia para fomentar el desarrollo y uso ético y responsable de la inteligencia artificial.

Además, el 1 de septiembre se presentó en la Asamblea Nacional un proyecto de ley sobre desarrollo, uso ético y gobernanza de la IA.

El caso Coxon no prueba que la inteligencia artificial vaya a escapar del control humano ni permite fijar una fecha para una eventual superinteligencia. Sí muestra que investigadores, empresas y organismos internacionales consideran necesario evaluar con mayor rigor capacidades que avanzan rápidamente.

La atención debería centrarse menos en pronósticos apocalípticos y más en preguntas comprobables: qué pueden hacer los modelos actuales, qué riesgos ya se observan, cómo se miden y qué controles funcionan. La velocidad de la innovación no debería reemplazar la evidencia ni la supervisión.

¿Jacob Coxon demostró que la IA puede extinguir a la humanidad?
No. Coxon planteó escenarios de riesgo y opiniones basadas en su experiencia. No presentó un estudio que demuestre que la extinción humana vaya a ocurrir.

¿Qué significa automejora recursiva de la IA?
Describe el uso de sistemas de IA para ayudar a investigar, diseñar, programar o mejorar nuevas generaciones de inteligencia artificial, creando potencialmente ciclos de desarrollo cada vez más rápidos.

¿Los sistemas actuales pueden escapar del control humano?
El Informe Internacional de Seguridad de la IA 2026 señala que los sistemas actuales todavía carecen de las capacidades necesarias para un escenario de pérdida de control, aunque algunas capacidades relevantes están avanzando.

F: International AI Safety Report, Anthropic, OpenAI, X, WIRED, Asamblea Nacional del Ecuador.

Lee sobre Botón de apagado para IA: ¿Qué propone Estados Unidos?

Facebook
Twitter
LinkedIn
Imagen de Ma. Cecilia Moreno Ramírez

Ma. Cecilia Moreno Ramírez

Master en Comunicación de la Ciencia y la Tecnología. Periodista. Docente universitaria.
IG, Twiter, TikTok: @machemoreno @datocienciaec