El apocalipsis bajo la lupa

Compartir

Recientemente, los titulares de muchos medios de comunicación, en un exagerado tono apocalíptico, anunciaron que un investigador que trabajó en OpenAI y Anthropic acusó a estas empresas de apostar con nuestras vidas.

Un día después, uno de los líderes de seguridad de la empresa Anthropic, creadora de Claude, estimó que existe una probabilidad de más del 10% de que la inteligencia artificial extinga a la humanidad en la próxima década.

Muchos medios llenaron sus portadas con este impreciso tono de apocalipsis.

No obstante estas advertencias, es necesario recordar, entre tanto ruido, que pocas tecnologías se han desarrollado bajo tanta vigilancia.

Una renuncia desde adentro

Por: Gabriel E. Levy B.

El 8 de septiembre de 2026, un desconocido investigador de inteligencia artificial llamado Jacob Coxon anunció su renuncia en el medio social X, a través de su cuenta personal.

Si bien esta renuncia podría haber pasado inadvertida en el convulsionado ecosistema de Silicon Valley, el anuncio terminó ocupando los titulares de los principales medios de comunicación del mundo, incluso de los más antiguos y tradicionales, como The New York Times o The Wall Street Journal.

Con tan solo 27 años de edad, Jacob Coxon trabajó tres años entre OpenAI y Anthropic, dos de las más grandes corporaciones de inteligencia artificial generativa del mundo.

Su trabajo consistió en apoyar el entrenamiento de los grandes modelos de lenguaje (LLM), en una fase en la que estos algoritmos leen enormes volúmenes de texto y datos para aprender a escribir de forma autónoma los millones de escritos que hoy inundan la red.

Lo que hizo viral y famoso a Coxon, y lo llevó del anonimato al escándalo, fue su contundente afirmación de que ambas compañías NO actúan con responsabilidad, debido a que compiten por una superinteligencia capaz de mejorarse a sí misma, sin medir ni mediar sus consecuencias.

Una amenaza que ya había sido anunciada

Pero este anuncio en sí mismo no es algo nuevo, pues otros ya lo habían advertido de manera similar.

En febrero de 2026 renunció Mrinank Sharma, jefe de investigación en salvaguardas de Anthropic, con la advertencia de que el mundo corre peligro.

La diferencia en el caso de Coxon es que un actual empleado de la compañía, Evan Hubinger, líder de Ciencia de Alineación en Anthropic, le dio la razón en público y estimó en más del 10% la probabilidad de que la IA acabe con toda la humanidad en los próximos diez años o incluso antes.

Hubinger admitió públicamente que la compañía para la cual trabaja aún carece de un plan para lograr controlar una superinteligencia, aunque considera que, con los modelos actuales, la probabilidad de un apocalipsis realmente es baja.

Los riesgos existen

Más de cien expertos, con el premio Turing Yoshua Bengio a la cabeza, advirtieron en su momento, en el Informe Internacional de Seguridad de la IA 2026, que uno de los mayores peligros a los que no se les está prestando atención es que algunos modelos ya detectan cuándo los evalúan y, por tanto, modifican su conducta para cumplir los estándares de sus evaluadores.

En noviembre de 2025, Anthropic reveló que un grupo relacionado con el Estado chino usó a Claude para intentar espiar a unos treinta objetivos de interés para el gobierno de ese país, e indicó que sus integrantes usaron agentes de IA hasta para el 90% de las tareas tácticas.

Una encuesta de AI Impacts, aplicada a 2.778 investigadores expertos en el tema, ubicó en 5% la probabilidad mediana de extinción humana o de un sometimiento permanente por causa de la IA.

Notas que preocupan

En julio, el Future of Life Institute evaluó los procesos y protocolos de nueve compañías que desarrollan modelos de inteligencia artificial generativa.

Anthropic encabezó la tabla con apenas «C+» y ninguna alcanzó siquiera una «C» en seguridad existencial, un componente de este mismo estudio que evalúa los planes ante una posible catástrofe.

Pero, sin duda, la mayor alerta a la que debemos prestar atención es que las empresas líderes del sector de la IA hayan suavizado sus promesas de pausar el desarrollo de esta tecnología.

Estos datos nos obligan a tomar la discusión en serio, pero sin entrar en pánico, caer en alarmismos ni crear discursos apocalípticos.

La tecnología más vigilada

Pruebas en entornos cerrados

Antes de llegar al público, los modelos más avanzados pasan por los denominados «sandboxes» o «areneros de prueba», que son, en esencia, entornos informáticos aislados o por fuera de la red, en donde los ingenieros prueban un programa sin que toque sistemas reales y pueden detener en tiempo real cualquier amenaza.

Además, las empresas detrás de ChatGPT, Claude, Gemini y Grok, junto con Microsoft, entregan versiones inéditas de sus modelos al Centro de Estándares e Innovación en IA del gobierno estadounidense, que ya suma más de 40 evaluaciones, como un mecanismo adicional de seguridad.

Anthropic restringió Claude Mythos Preview, un modelo capaz de hallar vulnerabilidades, es decir, fallas de seguridad que un atacante podría aprovechar, un tema que analizamos en profundidad en artículos anteriores.

Unas cincuenta organizaciones lo usaron dentro del Proyecto Glasswing y en pocas semanas encontraron más de diez mil fallas graves en software crítico.

Solo después la empresa abrió al público una versión con salvaguardas adicionales, que por restricciones del gobierno estadounidense tuvo que suspender durante unas semanas y que finalmente volvió a habilitar para todo el mundo.

El problema es que los sandboxes no son infranqueables ni garantizan un entorno perfecto, ya que tienen límites, y lo más preocupante es algo que muchos investigadores han denunciado: un modelo de IA de última generación tiene la capacidad de detectar que está siendo evaluado y, por lo tanto, portarse «mejor» durante la prueba o «falsear» los resultados.

Un problema y una preocupación global

En julio, la ONU reunió en Ginebra el primer Diálogo Global sobre Gobernanza de la IA, un foro en el que están presentes los 193 Estados miembros.

Dentro de este espacio multilateral, un panel científico de 40 expertos en inteligencia artificial presentó un informe con un análisis muy completo sobre los riesgos reales.

Aunque sus conclusiones carecen de fuerza obligatoria, sí dejan a los gobiernos sin la excusa de la ignorancia.

El espejo nuclear

En 2023, Sam Altman, Dario Amodei, Demis Hassabis y Geoffrey Hinton, creadores y promotores de la actual inteligencia artificial generativa y de los grandes modelos de lenguaje (LLM), firmaron una declaración conjunta que reconoce la mitigación del riesgo de extinción por IA como prioridad global, al nivel de las pandemias y la guerra nuclear.

En enero de 2026, el Bulletin of the Atomic Scientists, que fundaron científicos del Proyecto Manhattan, ubicó su Reloj del Juicio Final a 85 segundos de la medianoche. Ese símbolo mide qué tan cerca estamos de una catástrofe, y sus expertos incluyeron a la IA entre las amenazas, lo cual, sin duda, pone el riesgo sobre el tablero y deja claro que, si bien es imposible determinar si la inteligencia artificial acabará con la humanidad, tampoco podemos afirmar que este escenario apocalíptico nos tomaría desprevenidos.

Ochenta años de alerta

La humanidad convive con armas nucleares desde 1945 y ningún país volvió a usarlas en una guerra después de Nagasaki.

Los tratados y los inspectores internacionales contuvieron el peligro sin eliminarlo.

La IA ya comienza a recibir un trato algo parecido.

Por ejemplo, en junio, el gobierno de los Estados Unidos impuso controles de exportación que obligaron a Anthropic a suspender durante casi tres semanas el acceso a sus modelos más potentes, y diversas entidades al interior del Estado analizan y siguen con lupa el comportamiento de la IA y los nuevos desarrollos.

Sin embargo, la analogía con el mundo nuclear no es en sí misma perfecta, porque el uranio escasea, mientras en este momento cualquier humano con acceso a internet puede usar la inteligencia artificial, incluso sin pagar planes de suscripción.

Urge una comisión de Naciones Unidas para la IA

De la misma forma en que en Naciones Unidas existen comisiones y mecanismos para el control, la gestión y los límites a la energía nuclear por el riesgo que representa, es necesario que este organismo multilateral, con el concurso de China, Estados Unidos y las grandes potencias europeas, defina un mecanismo vinculante que regule la inteligencia artificial y ponga límites a su desarrollo, con auditorías externas como las que hacen los inspectores internacionales a las instalaciones nucleares y con acuerdos de vigilancia. De esta forma podríamos tener bajo control una tecnología que podría ser tan poderosa como la energía nuclear misma.

La otra cara de la moneda: la exitosa estrategia del marketing del miedo

Si bien es imposible desconocer todos los riesgos que hemos mencionado, debemos ser claros en que el catastrofismo también funciona como publicidad.

El historiador Lee Vinsel llamó criti-hype a la crítica que exagera el poder de una tecnología y termina inflando su promoción.

Vinsel es un historiador de la tecnología, escritor y profesor asociado estadounidense en el Departamento de Ciencia, Tecnología y Sociedad de Virginia Tech. Es ampliamente reconocido por sus investigaciones críticas sobre el impacto social, gubernamental y corporativo del cambio tecnológico.

Titulares que asustan y engañan

Para nadie es un secreto que los medios de comunicación en la era digital buscan llamar la atención a cualquier precio. El clickbait es un fenómeno que repercute de forma significativa en la credibilidad de los medios.

Afirmaciones como las de Coxon son el caldo de cultivo perfecto para la desinformación, sobre todo porque es muy fácil amplificarlas.

Varios medios en español titularon con la frase «podría matarnos a todos».

Este tipo de titulares multiplican exponencialmente los clics, pero sacrifican los matices.

La cifra de Hubinger expresa una opinión personal que no necesariamente representa el consenso de quienes conocen en profundidad el tema.

Expertos de peso como el premio Turing Yann LeCun consideran exagerados estos escenarios.

Un llamado a la calma

Ante cada titular alarmista, nos corresponde verificar quién dijo qué y aprender de forma rigurosa a separar una opinión de un hecho que pueda comprobarse o que al menos esté sustentado en evidencia sólida.

También nos toca exigir a los gobiernos que conviertan los compromisos voluntarios de las empresas en reglas obligatorias.

En resumen, las advertencias de Jacob Coxon y Evan Hubinger apuntan a riesgos reales que la ciencia documenta y que la propia industria admite.

Sin embargo, la humanidad enfrenta este desafío con los ojos abiertos, porque gobiernos y científicos de todo el mundo vigilan la IA como antes vigilaron la energía nuclear y, aunque son escenarios diferentes porque es difícil acceder al uranio mientras cualquiera puede usar la IA, el aprendizaje en la matriz de riesgos es el mismo.

Frente al amarillismo de los medios de comunicación que convierten el miedo en clics, la respuesta sensata pasa por el contraste de fuentes y un análisis crítico de la información.

*La corrección de estilo de este documento fue elaborada con herramientas de inteligencia artificial.

Referencias

  1. (2025, 13 de noviembre). Disrupting the first reported AI-orchestrated cyber espionage campaign. https://www.anthropic.com/news/disrupting-AI-espionage
  2. (2026, 7 de abril). Project Glasswing: Securing critical software for the AI era. https://www.anthropic.com/glasswing
  3. (2026). Project Glasswing: An initial update. https://www.anthropic.com/research/glasswing-initial-update
  4. (2026, 1 de julio). [Declaración sobre el acceso a Claude Fable 5 y Claude Mythos 5]. https://www.anthropic.com/news/fable-mythos-access
  5. (2026, 9 de septiembre). Scoop: Anthropic whistleblower gave up his equity to leave the company. https://www.axios.com/2026/09/09/anthropic-researcher-ai-warning-interview
  6. Bengio, Y., Clare, S., Prunkl, C., et al. (2026). International AI Safety Report 2026. https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026
  7. Bulletin of the Atomic Scientists. (2026, 27 de enero). 2026 Doomsday Clock Statement. https://thebulletin.org/doomsday-clock/2026-statement/
  8. Center for AI Safety. (2023, 30 de mayo). Statement on AI Risk. https://www.safe.ai/statement-on-ai-risk
  9. Consejo Nacional de Política Económica y Social. (2025). Documento CONPES 4144: Política Nacional de Inteligencia Artificial. Departamento Nacional de Planeación.
  10. El Plural. (2026, 9 de septiembre). El apocalíptico mensaje de un ex investigador de OpenAI y Anthropic: «La IA podría matarnos a todos». https://www.elplural.com/revista-bando/coctelera/apocaliptico-mensaje-ex-investigador-openai-anthropic-la-ia-podria-matarnos-todos_399760102_amp
  11. Future of Life Institute. (2026, 7 de julio). AI Safety Index: Summer 2026. https://futureoflife.org/ai-safety-index-summer-2026/
  12. Grace, K., et al. (2024). Thousands of AI authors on the future of AI. arXiv. https://arxiv.org/abs/2401.02843
  13. International Business Times UK. (2026, 9 de septiembre). Ex-Anthropic researcher Jacob Coxon quits, says AI leaders fear it could kill us all by decade’s end. https://www.ibtimes.co.uk/ai-researcher-resigns-warns-superintelligence-threat-2030-1818808
  14. Naciones Unidas. (2026). Global Dialogue on AI Governance. https://www.un.org/global-dialogue-ai-governance/en
  15. Naciones Unidas. (2026). Independent International Scientific Panel on AI: Preguntas frecuentes. https://www.un.org/independent-international-scientific-panel-ai/en/faq
  16. (2026, 10 de septiembre). Who is Jacob Coxon? Anthropic researcher quits, warns AI could kill everyone. https://www.newsweek.com/anthropic-researcher-quits-warns-ai-could-kill-everyone-12418798
  17. Ray, S. (2026, 9 de septiembre). Anthropic alignment lead issues warning about AI killing humans as researcher resigns. https://www.forbes.com/sites/siladityaray/2026/09/09/anthropic-alignment-lead-warns-ai-could-kill-all-humans-as-researcher-quits/
  18. Ray, S. (2026, 10 de septiembre). Musk touts psy op and mocks ex-Anthropic staffer who warned AI could kill us all. https://www.forbes.com/sites/siladityaray/2026/09/10/musk-touts-psy-op-and-mocks-ex-anthropic-staffer-who-warned-ai-could-kill-us-all/
  19. (2026, 10 de septiembre). La IA podría matarnos a todos: fuertes declaraciones de un exingeniero de Anthropic y OpenAI. https://www.teleamazonas.com/tendencias/entretenimiento/tecnologia/exinvestigador-openai-anthropic-denuncia-responsabilidad-ia-127563/
  20. The Hill. (2026, 5 de mayo). Microsoft, Google, xAI giving government early access to AI models for review. https://thehill.com/homenews/5863937-google-microsoft-xai-ai-testing/
  21. Vinsel, L. (2021). You’re doing it wrong: Notes on criticism and technology hype. STS News, Medium.
Scroll al inicio
Abrir chat
1
Escanea el código
Hola 👋
¿En qué podemos ayudarte? Contáctanos y te atenderemos directamente