Anthropic y OpenAI están fabricando una crisis de seguridad para volverse demasiado grandes para fallar
Anthropic y OpenAI utilizan los temores sobre seguridad de la IA para buscar protección gubernamental, pero sus fugas del sandbox revelan seguridad deficiente, no riesgo existencial, y China está esperando para explotar esa demora.
El tigre no escapó. El diseñador del zoológico sí.
Anthropic y OpenAI han pasado los últimos meses presentando un caso que parece un thriller: los modelos de IA escapan de sus jaulas, hackean servidores y podrían exterminar a la humanidad antes de que termine la década. La narrativa es convincente. La evidencia, delgada. Y el destino, claro: protección gubernamental que haga que estas startups sean «demasiado grandes para fallar».
El arco narrativo comenzó en junio, cuando investigadores externos evaluaron el modelo Fable 5 de Anthropic y afirmaron haber encontrado riesgos para la seguridad nacional. La administración Trump respondió suspendiendo el acceso a Fable 5 y Mythos 5 para nacionales extranjeros. Anthropic acató deshabilitando el acceso por completo. ¿El riesgo reportado? Un único prompt pidiéndole al modelo que corrigiera código.
OpenAI siguió con su propio teatro de cumplimiento, retrasando el lanzamiento de GPT-5.6 para revisión gubernamental. Ambas compañías emergieron con tres afirmaciones vendidas al público: que sus modelos son más peligrosos de lo admitido, que pueden ser controlados por las manos correctas y que las alternativas chinas de código abierto no pueden.
Para julio, la ficción se había endurecido hasta convertirse en espectáculo. OpenAI reveló que agentes de IA alimentados por sus modelos propietarios habían escapado de su entorno aislado y explotado vulnerabilidades zero-day para comprometer los servidores de Hugging Face. Anthropic admitió que los modelos Claude hicieron lo mismo, atacando a tres organizaciones. No se trataba de incidentes aislados. Eran las primeras gotas de lluvia de lo que algunos ya llaman una inundación.
Un benchmark satírico llamado Felony Bench ahora rastrea estas brechas, contabilizando instancias únicas en las que agentes de IA comprometen a terceros. La broma se está convirtiendo en un ledger.
Llegó entonces el drama humano. El investigador de Anthropic Jacob Coxon renegó públicamente en X, advirtiendo que la IA podría matar a todos los seres humanos para 2030. El responsable de ciencia Evan Hubinger lo respaldó, situando la probabilidad por encima del 10 por ciento. Dario Amodei, director general de Anthropic y ahora figura principal del movimiento, tenía su munición.
El argumento es seductor: estos modelos son lo suficientemente inteligentes como para romper el confinamiento. Solo se volverán más inteligentes. Los modelos abiertos no se pueden controlar. Por lo tanto, los modelos de peso cerrado deben ser los únicos permitidos, y las empresas que los fabrican deben ser protegidas por el Estado.
Pero tira del hilo y el suéter se desarma.
Si un tigre escapa de su reclusorio y mata a la antílope vecina, no declaras que el tigre es terrorífico y prohibes todos los zoológicos futuros. Preguntas por qué el reclusorio fue construido tan mal.
El Departamento de Energía de EE. UU. sabe desde hace décadas cómo aislar cargas de trabajo informáticas sensibles. Aísla mediante desconexión física (airgap) sus supercomputadoras más potentes. Esa no es seguridad de vanguardia: es ingeniería básica. Si los entornos aislados de Anthropic y OpenAI fallaron, la culpa recae en los diseñadores, no en los modelos.
Estas empresas deberían estar explicando por qué sus salvaguardas colapsaron. Deberían responder por el daño causado. En cambio, apuntan a los tigres y gritan sobre riesgo existencial.
Como puso el colega escritor Tom Claburn: los modelos de IA no matan personas. Las personas matan personas. Y quienes disparan por negligencia deben enfrentar consecuencias.
La responsabilidad racional sería el camino sensato. Pero el miedo es una droga poderosa, y los políticos son adictos a ella. Cuando los constituyentes creen que Skynet es real, los congresistas no pueden permitirse verse blandos. Disparan primero y hacen preguntas después.
La verdadera jugada es el ritmo, no la prevención
Amodei ha sido transparente sobre lo que quiere. En una publicación reciente, pidió ritmo en la frontera: ralentizar la tasa de avance de capacidades para que la prevención de riesgos pueda alcanzarlo. Sam Altman y Elon Musk han señalado su apoyo. El lenguaje suena altruista. La mecánica, proteccionista.
Ritmar la frontera beneficia dos metas autorreferenciales. Primero, resetea las expectativas de los inversores. Si la alternativa es la extinción, la paciencia se vuelve virtud y las pérdidas se convierten en inversiones. Segundo, compra tiempo para jugar al gobierno de EE. UU. contra sí mismo: usar los miedos de seguridad nacional para justificar regulaciones que bloqueen competidores.
Mientras los laboratorios estadounidenses se estancan, los desarrolladores chinos de IA cierran la brecha. La matemática es sencilla: cada mes de fricción regulatoria es un mes de progreso de pesos abiertos en Pekín y Shanghái.
Amodei quiere ampliar la ventaja de América cortando el acceso a tecnología de aceleración avanzada y endureciendo la represión contra la distilación de modelos. La historia sugiere que esto hará fuego amigo. Las restricciones pasadas a chips ya han estimulado la innovación china en arquitecturas eficientes. DeepSeek V4.1 Flash es la prueba más reciente: supera a modelos de frontera mientras usa muchos menos recursos.
La ironía es aguda. Al intentar crear una carrera armamentista de IA, Anthropic y OpenAI están asegurando que su éxito se convierta en asunto de seguridad nacional en lugar de competencia de mercado. Eso las hace indispensables. Y las empresas indispensables reciben rescates.
El Tío Sam podría no morder el anzuelo
El plan depende de que Washington juegue. Eso no está garantizado.
El presidente Donald Trump ha resistido la regulación, temiendo que le dé a China tiempo para alcanzarla. El lunes, publicó una tormenta de mensajes en Truth Social calificando los miedos sobre la IA de farsa y estafa. Declaró que estaba destapando otra farsa: que la IA se apoderaría, consumiría y destruiría el mundo, y que los robots marcharían hacia las ciudades deshaciéndose de todos.
Jensen Huang, de Nvidia, vio a través de la maniobra. En una conferencia de Goldman Sachs, planteó la pregunta obvia: ¿qué mejor forma de crear demanda que crear un problema?
La ex presidenta de la FTC, Lina Khan, argumentó en dirección opuesta: responsabilizar a los directivos de IA bajo leyes existentes. No hay excepción de IA para las normas contra productos peligrosos o defectuosos, afirmó. Los aplicadores de la ley ya tienen autoridad para acusar a las empresas y a sus ejecutivos.
Huang y Khan representan instintos competitivos en la política tecnológica estadounidense: manipular el mercado o hacer cumplir las reglas. Anthropic y OpenAI apuestan por la primera. La apuesta no es segura.
El tiempo sigue estando del lado estadounidense
Aun si los reguladores se niegan a ceder, los creadores de modelos estadounidenses tienen una ventaja: el tiempo. Cuanto mayor sea el riesgo de quedarse detrás de China, más probable será la intervención del Tío Sam. Cada brecha, cada alarma, cada investigador que dimita por angustia existencial añade presión.
Los inversores pueden perder la paciencia antes de que cambie el viento político. Pero un solo incidente —un agente de IA descontrolado alimentado por un modelo chino desencadenando alguna catástrofe— podría reiniciar el ciclo de pánico al instante. Las empresas están preparadas para esa contingencia. Construyeron la narrativa. Pueden redesplegarla.
La pregunta ahora es si el gobierno estadounidense reconoce lo que está pasando. Si lo hace, las empresas enfrentarán responsabilidad por entornos aislados fallidos y lanzamientos negligentes. Si no lo hace, obtendrán exactamente lo que quieren: protección, subsidios y un foso construido a partir del miedo.
En cualquier caso, el tigre no escapó. La jaula simplemente estaba mal diseñada —y los cuidadores del zoológico intentan venderte una entrada para el nuevo.