technology 7 min de lectura

El chip Atomax de Corea está resolviendo 14 millones de solicitudes japonesas y reconfigurando la dependencia de las GPU

Un NPU coreano nacional está manejando millones de solicitudes de inferencia en los servicios de IA de SK Telecom, incluidas cargas de trabajo desde Japón. El despliegue señala un camino frágil pero real hacia la independencia de las GPU estadounidenses, y un deshielo tecnológico silencioso entre rivales.

  • Meta
  • SK Telecom
  • IA de Corea del Sur
  • chip de IA
  • semiconductores de Corea
  • Revelion

Un chip, 14 millones de solicitudes y grietas en el monopolio de las GPU

El detalle titular es fácil de pasar por alto porque está enterrado en un comunicado tecnológico en coreano: una unidad de procesamiento neuronal de fabricación nacional está resolviendo 14 millones de solicitudes de inferencia, una proporción significativa de las cuales tiene origen en cargas de trabajo japonesas. El chip se llama Atomax, lo fabrica Revelion y ya sostiene la columna vertebral de cuatro servicios de inteligencia artificial de SK Telecom.

Lo que importa no es solo el volumen. Es lo que el volumen demuestra: que una NPU coreana puede operar a escala de producción dentro de la infraestructura de un gran operador, y que las operadoras japonesas están enrutando tráfico a través de ella. En un escenario donde cada despliegue de IA importante aún funciona con GPUs Nvidia, esta es una fisura pequeña pero genuina.

La inferencia es donde realmente se libra la guerra de chips

El dominio de Nvidia se hace más visible en la capa de entrenamiento: los miles de millones invertidos en clústeres H100 y H800. Pero el entrenamiento es un cuello de botella intensivo en capital al que solo un puñado de jugadores puede permitirse. El verdadero campo de batalla, el que determina quién puede realmente comercializar un producto de inteligencia artificial, es la inferencia.

Atomax es una NPU, lo que significa que está especializada en inferencia en lugar de computación paralela de propósito general. Esa especialización es su ventaja. Las cargas de trabajo de inferencia en SK Telecom —resumen de llamadas, síntesis de voz, un centro de atención al cliente impulsado por IA y un sistema de detección de estafas llamado ScamBanged— son predecibles, sensibles a la latencia y expuestas al coste. Ejecutarlas en una GPU de propósito general es excesivo. Ejecutarlas en una NPU diseñada específicamente reduce el consumo energético y la factura.

SK Telecom ha estado avanzando de forma deliberada. Atomax apareció por primera vez en diciembre en el sistema de resumen de llamadas del agente E-dot. Para junio, ya gestionaba la síntesis de voz a nivel de oración. Los dos servicios adicionales —el centro de atención al cliente con IA y ScamBanged— llegaron después. Cada ampliación redujo la ventana de validación. La integración inicial tomó de cinco a seis meses; la última ronda tomó de dos a tres. Esa compresión es significativa. Significa que el chip se está estabilizando y que la organización de ingeniería que lo rodea está aprendiendo a desplegarlo más rápido.

El ángulo japonés del que nadie habla lo suficiente

La cifra de 14 millones de solicitudes incluye tráfico de origen japonés. El artículo no detalla el acuerdo comercial —si se trata de una compra mayorista de inferencia, una empresa conjunta o un acuerdo de datos de nivel roaming—, pero la dirección está clara. Las operadoras japonesas y los equipos de IA empresariales están pagando por ejecutar inferencias en silicio coreano.

Eso es notable por dos razones.

En primer lugar, rompe el supuesto de que las infraestructuras de inteligencia artificial coreana y japonesa permanecerán como esferas separadas, cada una aferrándose al hardware estadounidense. Los dos países han competido ferozmente en memorias y pantallas durante décadas. Pero la inferencia de inteligencia artificial es un terreno nuevo, y ninguno de los dos lados quiere quedar atado a una cadena de suministro que Washington pueda interrumpir a voluntad. Compartir capacidad de silicio a través del mar es un seguro pragmático.

En segundo lugar, le da a Atomax algo que casi nunca obtienen los programas de chips domésticos: un cliente de referencia fuera de su mercado de origen antes de que el producto esté ni siquiera terminado. Revelion está validando el próximo chip, el Revel 100, en una sala de servidores en Mapo-gu, Seúl. El nivel de ruido alcanza los 77,5 decibelios, lo suficientemente alto como para que los ingenieros tengan que alzar la voz. Ocho tarjetas se están probando con memoria HBM3E. Si el patrón se mantiene, el ciclo de validación se reducirá aún más. Para cuando el Revel 100 llegue al mercado, ya podría tener compromisos japoneses sobre el papel.

Por qué los chips de inferencia importan más que los de entrenamiento en este momento

Dario Amodei, CEO de Anthropic, ha argumentado públicamente que Estados Unidos debería endurecer las restricciones a la venta de chips avanzados de inteligencia artificial a China. Ese argumento está ganando tracción dentro de la administración Biden y entre capitales aliadas. El efecto práctico será un frenazo en la capacidad de China para entrenar nuevos modelos punteros, pero también hará que la inferencia sea más barata y más urgente en cualquier otro lugar, porque cada país que no pueda acceder a hardware Nvidia de gama alta necesitará maximizar lo que tiene.

Esa es exactamente la condición para la que Atomax está diseñado. Una NPU no reemplaza a una GPU en entrenamiento. Reemplaza a una GPU en inferencia, donde reside el coste marginal de ejecutar un producto de inteligencia artificial. Un chatbot que responde llamadas de clientes, un agente de voz que lee las respuestas en voz alta, un sistema de detección de fraude que escanea millones de mensajes: todas son cargas intensivas de inferencia, y son baratas de ejecutar en el silicio adecuado.

El profesor de KAIST Yu Hoe-jun lo explicó con claridad: depender completamente de chips extranjeros significa que todo tu ecosistema de inteligencia artificial es vulnerable a los cambios en la política de exportaciones de otro país. Atomax no es una solución completa. Pero es un pie en la puerta.

El índice de soberanía de IA cuenta una historia preocupante

Un análisis reciente del Centro para una Nueva Seguridad Estadounidense, citado por Dong-a Ilbo, encontró que Nvidia suministró GPUs para el 45 por ciento de 117 proyectos de infraestructura respaldados por gobiernos en todo el mundo a finales de junio. Ese número es impactante cuando se considera que muchos de esos gobiernos fueron elegidos con promesas de soberanía tecnológica. Están construyendo una IA soberana con chips de otra persona.

Corea del Sur no es la excepción. Sus diseñadores nacionales de chips pueden producir prototipos y validarlos en laboratorios. La brecha está entre la validación y la producción en volumen. El profesor Kim Yong-seok de la Universidad Kachon señaló que las empresas coreanas tienen la capacidad de diseño pero carecen de la capacidad de seguimiento para escalar. El remedio, argumentó, es que las instituciones públicas y los grandes conglomerados se conviertan en clientes ancla y acumulen despliegues de referencia, el tipo de historial comprobado en el mundo real que exigen los compradores extranjeros.

SK Telecom está haciendo exactamente eso con Atomax. La operadora no solo está comprando chips; los está sometiendo a pruebas de estrés bajo tráfico real, iterando rápidamente y demostrando que una NPU coreana puede manejar inferencia de producción a escala. Cada ampliación de servicio es un caso de referencia. Cada solicitud japonesa resuelta es una recomendación.

Qué sucede a continuación

La implicación inmediata es sencilla: SK Telecom puede reducir su gasto en Nvidia para cargas de trabajo de inferencia sin degradar la calidad del servicio. Ese margen importa cuando los precios de las GPU están subiendo y los controles de exportación se están endureciendo.

La implicación a largo plazo es geopolítica. Cada solicitud japonesa que Atomax gestiona es un voto en contra de una infraestructura de inteligencia artificial en Asia-Pacífico completamente bifurcada. Mantiene abierto un canal de cooperación técnica entre dos países que con frecuencia se enfrentan políticamente. También le da a Revelion apalancamiento en futuras negociaciones tanto con Seúl como con Tokio.

Las pruebas del Revel 100 en Mapo-gu determinarán si esto es un despliegue aislado o el inicio de un patrón repetible. Si los períodos de validación siguen comprimiéndose y la demanda japonesa se mantiene, Atomax podría convertirse en el modelo para un ecosistema coreano más amplio de chips de inferencia —uno que compita no en rendimiento de entrenamiento, sino en coste por inferencia, eficiencia energética y soberanía de la cadena de suministro.

Los chips están funcionando. Las solicitudes se acumulan. Y, por primera vez, una proporción significativa de ellas proviene del otro lado del mar.