El debate en torno a los peligros de la inteligencia artificial alcanzó un punto de máxima tensión tras la drástica decisión de Jacob Coxon, investigador clave en el área de preentrenamiento con experiencia tanto en OpenAI como en Anthropic. Coxon anunció públicamente su renuncia a través de un duro mensaje en la red social X: “Ninguna de las dos compañías está actuando de manera responsable. Están corriendo directamente hacia una superinteligencia capaz de automorarse y están jugando con nuestras vidas”.
La advertencia no se limita al impacto en el empleo o a fallos técnicos menores. A sus críticas se sumaron científicos de alineamiento de la propia empresa, como Evan Hubinger (lider de ciencia de alineamiento en Anthropic), confirmando que dentro de los laboratorios existe la firme convicción de que la tecnología podría destruir a la humanidad y estimando esa posibilidad en más de un 10% en la próxima década.
- Te puede interesar: Inteligencia artificial en seguridad y defensa, ¿cómo es crear un agente militar?
El dilema del alineamiento y la carrera armamentista digital
Las revelaciones exponen una alarmante contradicción interna: mientras que en OpenAI muchos no habrían dimensionado la magnitud del desafío, en Anthropic se comprenden los riesgos civilizatorios, pero la firma se encuentra atrapada en una carrera comercial. Bajo la premisa de que si no lo hacen ellos lo hará un competidor sin escrúpulos, aceleran el desarrollo sin contar con una estrategia clara ni probada para resolver el problema del alineamiento.
El alineamiento consiste en garantizar que los objetivos de una súper IA permanezcan supeditados y alineados a la supervivencia humana. Al carecer de un plan efectivo para controlar modelos superinteligentes, el peligro de una catástrofe se vuelve real a medida que la tecnología gana autonomía.

¿Cómo podría la IA convertirse en una amenaza existencial?
Las principales vías por las cuales un sistema avanzado podría escapar al control humano incluyen:

- Autonomía y superinteligencia recursiva: Sistemas capaces de mejorarse a sí mismos sin intervención que pueden adquirir capacidades para manipular redes, eludir barreras de seguridad o replicarse en la web.
- Proliferación de amenazas biológicas y ciberataques: Modelos con capacidades superhumanas para diseñar patógenos o ejecutar hackeos masivos a infraestructuras críticas.
- Discurso público atenuado versus pánico privado: Directivos que adoptan un tono moderado en la prensa mientras expresan serios temores de extinción a puertas cerradas.
La renuncia de especialistas de primer nivel evidencia que el peligro ya no es una hipótesis de ciencia ficción, sino un riesgo operativo real provocado por el ritmo frenético con el que se busca liderar la industria.




