El martes 8 de septiembre de 2026, el investigador de 27 años Jacob Coxon renunció a Anthropic publicando una dura advertencia sobre el desarrollo de la inteligencia artificial, la cual fue respaldada de forma pública por Evan Hubinger, líder de alineación de la misma empresa.
- La denuncia de Jacob Coxon: Tras dedicar tres años a la investigación de preentrenamiento de modelos en OpenAI y Anthropic, Coxon anunció su retiro definitivo de la industria. En su declaración, acusó a ambas corporaciones de actuar irresponsablemente al competir en una carrera acelerada hacia una "superinteligencia capaz de mejorarse a sí misma". Coxon advirtió que los propios desarrolladores de esta tecnología temen en privado que la IA pueda acabar con la humanidad antes de que termine la década.
- La validación de Evan Hubinger: Hubinger, quien lidera el equipo científico encargado de que la IA obedezca los intereses humanos en Anthropic, respondió a Coxon confirmando sus preocupaciones. Declaró públicamente que el riesgo de que la IA aniquile a la humanidad en los próximos diez años es superior al 10%. Además, admitió con franqueza que, aunque Anthropic está haciendo su mejor esfuerzo, la empresa actualmente no tiene un plan para resolver la alineación de una superinteligencia, ni están en vías claras de conseguirlo.
- El contraste entre OpenAI y Anthropic: Coxon explicó el dilema corporativo que perpetúa esta situación. Según su experiencia, mientras que en OpenAI el personal no ha interiorizado profundamente las consecuencias a nivel civilizatorio, en Anthropic sí comprenden la gravedad del riesgo. Sin embargo, los líderes de Anthropic continúan avanzando porque creen que sus competidores no actuarán con responsabilidad, sintiéndose obligados a intentar ganar la carrera tecnológica a pesar del peligro que representa.
![]() | ||
Esta imagen representa el peligro existencial de una superinteligencia descontrolada y las advertencias de expertos clave de OpenAI y Anthropic. La visualización captura la urgencia de la "carrera descontrolada" y el desafío crítico de la "alineación no resuelta" que hemos discutido, mostrando la tensión entre el avance tecnológico y la seguridad humana. Imagen generado con asistencia de Gemini AI
¿Qué es la alineación en IA?
El problema de la alineación en inteligencia artificial es el desafío de
garantizar que un sistema persiga exactamente las intenciones, valores y el
bienestar humano, en lugar de interpretar sus instrucciones de forma literal,
defectuosa o desalineada.
No se trata de evitar que una IA se vuelva "malvada", sino de evitar que una
entidad hipercompetente optimice un objetivo asignado sin comprender o
respetar las limitaciones éticas implícitas.






