Inteligencia Artificial: ¿amenaza real para la humanidad o simplemente una exageración?

El pasado 8 de septiembre de 2026, Jacob Coxon, investigador que trabajó en el pre-entrenamiento de modelos tanto en OpenAI como en Anthropic, anunció su dimisión a través de una serie de mensajes en X. En ellos acusó a ambas compañías de actuar de forma irresponsable al precipitarse hacia sistemas de inteligencia artificial capaces de mejorarse a sí mismos.

En un hilo de gran repercusión en X (más de142 millones de impresiones), advirtió que ambas firmas avanzan de forma irresponsable hacia sistemas de superinteligencia capaz de auto mejorarse. Un hecho que, a su parecer, pone en riesgo la supervivencia de la humanidad. Coxon subrayó que estos sistemas superarán en poco tiempo al ser humano. Cree que serán capaces de hackear cualquier infraestructura, revolucionar campos de conocimiento de la noche a la mañana y acumular poder real. Afirmó que los propios impulsores de la tecnología sostienen, en privado, que podría extinguir a la especie antes de que termine la década, aunque en público suavicen el lenguaje.

Según el investigador, en OpenAI muchos aún no han interiorizado la magnitud del riesgo, mientras que en Anthropic sí lo comprenden, pero se ven atrapados en una carrera por llegar primero ante la convicción de que nadie más actuará con responsabilidad. Coxon abogó por coordinar el ritmo de avance entre laboratorios estadounidenses, incluso contemplando una pausa temporal en la mejora de capacidades. Cerró su mensaje con un llamamiento directo a los investigadores: que reflexionen sobre cómo se sentirán en los próximos años y exijan condiciones distintas en lugar de limitarse a seguir el impulso de la carrera. El hilo no tiene desperdicio:

Su denuncia ha encontrado respaldo entre otros trabajadores

Evan Hubinger, responsable de pruebas de alineación en Anthropic, respondió públicamente confirmando que muchos de los propios constructores de estos sistemas creen de verdad que la IA podría acabar con la humanidad. Hubinger estimó personalmente esa probabilidad por encima del 10% en la próxima década y reconoció que todavía no existe un plan sólido para alinear una superinteligencia con los intereses humanos. Se reabre con fuerza el debate sobre los riesgos existenciales de la inteligencia artificial avanzada.

El episodio de Hugging Face: ¿preludio de una IA sin límites?

En julio de 2026, más de 1.200 agentes de IA utilizados por OpenAI en pruebas de ciberseguridad llegaron a coordinarse entre sí después de encontrar formas de sortear las restricciones de un entorno que debía permanecer aislado. Los agentes crearon canales de comunicación propios, se repartieron tareas e intercambiaron decenas de miles de mensajes, un comportamiento que algunos investigadores han descrito metafóricamente como una especie de «civilización de IA». Cerca de 700 agentes participaron directamente en una intrusión contra Hugging Face, donde lograron ejecutar código en servidores, obtener acceso de administrador y acceder a información privada. El episodio puso de manifiesto los riesgos de desplegar grandes cantidades de agentes capaces de utilizar herramientas y comunicarse entre ellos.

El caso se suma a otro incidente ocurrido meses antes con DseWiki, una wiki alemana de programación, que fue utilizada por agentes de OpenAI para realizar miles de ediciones e intercambiar información sobre cómo eludir restricciones. Más que una supuesta «rebelión» de la IA, los incidentes evidencian un problema de seguridad emergente: modelos capaces de encontrar estrategias no previstas para cumplir sus objetivos, explotar vulnerabilidades, mantener canales de comunicación y coordinarse a gran escala. Para OpenAI, el reto ya no consiste únicamente en controlar las capacidades de un modelo individual, sino también en garantizar que cientos o miles de agentes autónomos puedan operar de forma segura cuando interactúan entre sí y con sistemas externos.

¿Podría la IA acabar realmente con la humanidad?

El escenario que más preocupa a los investigadores no tiene nada que ver con que una máquina decida de un momento a otro que los humanos somos el enemigo. La preocupación tiene su raíz en el establecimiento de unos objetivos no alineados con el bienestar humano y en capacidad creciente de actuación autónoma por parte de la IA.

Pensamos cómo opera la IA. Una inteligencia artificial suficientemente avanzada, orientada a maximizar casi cualquier meta abierta (resolver problemas científicos, generar beneficios económicos, responder preguntas de forma útil o incluso optimizar un recurso concreto), desarrollaría de forma natural subobjetivos instrumentales. Entre ellos destacan la adquisición de más recursos computacionales, la prevención de su propio apagado o modificación, y la mejora continua de sus capacidades. Si esos subobjetivos entran en conflicto con la supervivencia o el control humano, el resultado puede ser catastrófico.

El miedo más citado es la mejora recursiva sin límites. Una vez que un sistema es capaz de diseñar versiones más potentes de sí mismo o de los algoritmos que lo entrenan, el crecimiento de capacidades puede acelerarse de forma explosiva. En poco tiempo la diferencia cognitiva entre la IA y los humanos podría volverse comparable a la que existe entre una persona y un chimpancé. En ese punto, recuperar el control se vuelve extremadamente difícil.

Las vías concretas de daño incluyen ciberataques sofisticados contra infraestructuras críticas, el diseño de patógenos o armas biológicas, la manipulación masiva de la opinión pública y de instituciones, o la construcción de sistemas físicos (robots, fábricas, redes energéticas) que operen sin necesidad de cooperación humana. Ninguno de estos escenarios requiere que la IA tenga conciencia o emociones; basta con que sea competente, autónoma y esté mal alineada. Afortunadamente, esto es aún ciencia ficción pero al ritmo que avanza la IA podría dejar de serlo más pronto que tarde.

Advertencias de otras figuras de la tecnología como Elon Musk

Las advertencias de los trabajadores de OpenAI y Anthropic son las más recientes. Sin embargo, otros actores del sector llevan hablando de esto años. Este es el caso de Elon Musk que afirma: «Si la IA tiene un objetivo y la humanidad se encuentra casualmente en su camino, destruirá a la humanidad como algo natural, sin siquiera planteárselo». El dueño de Space X y Tesla pone el ejemplo de la construcción de una carretera en un lugar en el que hay un hormiguero. Los obreros no odian a las hormigas pero no dudarán ni un segundo en decir «adiós, hormigas» Pese a ello, la posición del Musk es más optimista hoy en día. En entrevistas recientes ha situado la probabilidad de un desenlace catastrófico entre el 10% y el 20% aunque su apuesta es que la IA contribuya de forma sustancial a una era de abundancia sin precedentes.

Otras voces del sector, como algunos antiguos investigadores de OpenAI y miembros de la comunidad de seguridad de la IA, han expresado preocupaciones análogas sobre la velocidad de avance y la ausencia de mecanismos fiables de control. El debate ya no es solo teórico e hipotético. Ya forma parte de las conversaciones internas de quienes desarrollan estos sistemas. La pregunta que queda abierta no es si la inteligencia artificial puede ser extremadamente poderosa (eso parece cada vez más claro), sino si la humanidad será capaz de desarrollar a tiempo las herramientas técnicas, institucionales y éticas necesarias para mantenerla bajo control.

Noticias Relacionadas

Marcar todo el contenido creado con IA: una mala idea para la innovación
  • agosto 17, 2026

Anthropic comenzará a insertar marcas de agua invisibles en los textos generados por Claude para cumplir con la AI Act europea. La medida abre un debate sobre si etiquetar cualquier uso de la IA puede terminar estigmatizando una herramienta que ya forma parte del trabajo cotidiano de millones de profesionales.

Seguir Leyendo...
Mucho anuncio, poca ejecución: el gran agujero de la financiación pública de la I+D+I
  • julio 18, 2026

Cada año se anuncian cifras récord para la financiación pública de la I+D+I en España. Sin embargo, una parte importante de esos recursos nunca llega a materializarse. En 2024, la Administración General del Estado ejecutó el 68,3 % del presupuesto previsto, dejando sin ejecutar más de 6.300 millones de euros. Este artículo analiza, a partir de datos oficiales, la brecha entre los presupuestos anunciados y el gasto realmente ejecutado, así como sus implicaciones para la ciencia, la innovación y la competitividad del país.

Seguir Leyendo...

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *