science 6 min de lectura

Los nuevos asesores matemáticos de OpenAI son su mejor jugada de relaciones públicas hasta ahora

OpenAI reclutó a nueve destacados matemáticos para validar sus afirmaciones sobre haber resuelto más de 100 problemas sin solución. El grupo de asesoramiento no tiene poder para frenar a la empresa, pero otorga a las afirmaciones un barniz de legitimidad que el mundo de las matemáticas ha estado deseando ansiosamente.

  • KakaoAI
  • Noam Shazeer
  • Motif
  • problema de Galois inverso
  • Lean

La auditoría que parece una concesión

OpenAI anunció el 21 de septiembre que ha formado un grupo asesor independiente de nueve matemáticos, con sede en el Institute for Advanced Study de Princeton. Entre ellos figuran los laureados con la Medalla Fields Timothy Gowers, de Cambridge, Edward Witten y Martin Hairer, del IAS. El nombre oficial del grupo —el Grupo Asesor sobre Matemáticas e Inteligencia Artificial— suena a organismo académico. No lo es.

OpenAI también reveló que un modelo interno, cuyo entrenamiento comenzó el 28 de agosto, ha resuelto más de 100 problemas sin resolver en prácticamente todas las ramas de las matemáticas. Entre ellos se encuentra el problema de existencia y suavidad de Navier-Stokes, uno de los siete Problemas del Milenio, con una recompensa de 1 millón de dólares asociada. La empresa había divulgado previamente en agosto que un modelo denominado en código “Astra” había resuelto diez de esos problemas. La nueva cifra es diez veces mayor.

Ahí radica la astucia del movimiento. OpenAI está entregando a la comunidad matemática exactamente lo que exigía —escrutinio externo— mientras retiene el control total sobre cuándo, cómo y si esos resultados llegan alguna vez a revisión por pares.

El rechazo que obligó la mano

El grupo asesor no surgió de la nada. En una carta pública titulada “Una desalineación severa de la IA en las matemáticas”, veinticinco laureados con la Medalla Fields advirtieron que el campo estaba siendo arrastrado a una trampa. La preocupación no era que la IA resolviera problemas difíciles. Era que el acto de resolverlos —sin demostración, sin contexto, sin interacción con la literatura existente— se convirtiera en la métrica mediante la cual se mide el progreso de la IA.

Las matemáticas no son un deporte. Una respuesta correcta a un problema abierto no vale nada sin un argumento verificable. Cuando los sistemas de IA comienzan a producir soluciones que no pueden ser comprobadas, se quiebra todo el mecanismo de transferencia de conocimiento de la disciplina. Eso era lo que protestaban los matemáticos.

OpenAI escuchó la objeción. Simplemente reformuló la respuesta como colaboración en lugar de cumplimiento. La distinción importa porque desplaza la narrativa de la defensa a la apertura, y OpenAI ha pasado años construyendo esa narrativa en su marca.

Lo que el grupo puede y no puede hacer

Aquí está la letra pequeña que importa. El grupo asesor asesorará sobre cómo evaluar y publicar los resultados matemáticos de OpenAI. Se pronunciará sobre normas de investigación y si las herramientas deben apoyar el aprendizaje o la investigación. Pero OpenAI declaró explícitamente que el grupo no asume responsabilidad alguna al asesorar sobre el ritmo de la investigación matemática interna de la compañía.

Los miembros no reciben compensación de OpenAI. Pueden ofrecer consejo no solicitado. Pueden criticar públicamente el impacto de la compañía en las matemáticas. Esas son libertades reales. Pero ninguna de ellas afecta la pregunta central: ¿quién decide si una supuesta solución es en realidad una solución?

La respuesta sigue siendo OpenAI. El grupo asesor puede decir si la compañía debe publicar sus hallazgos, y cómo. No puede decir si los hallazgos son verdaderos. Esa es la distinción que convierte esto de rendición de cuentas en una máquina de legitimidad.

Consideren la asimetría estructural. OpenAI controla los datos, los modelos y la cronología. El grupo asesor opera a distancia: puede observar y comentar, pero no puede verificar independientemente los resultados a través de canales tradicionales, ya que OpenAI no ha aceptado compartir artefactos crudos del modelo ni pipelines de entrenamiento. Esto no es una omisión; es una frontera trazada deliberadamente por la propia compañía.

Quién gana, quién pierde

OpenAI gana más. Obtiene una arquitectura de aval sin perder el control del timón. En el momento en que el grupo —especialmente sus miembros de mayor perfil— comience a validar resultados específicos, cada afirmación llevará un peso institucional que antes no existía. Incluso un lenguaje cauteloso por parte del grupo funcionará como un impulso de señal de facto. Una frase como “consideramos que estos resultados dignos de mayor investigación” de Timothy Gowers carries gravedad desproporcionada en un campo donde su opinión por sí sola puede desplazar patrones de financiamiento y contratación.

Los matemáticos en el panel ganan una plataforma, pero también un riesgo. Sus nombres ahora quedan junto a afirmaciones que la comunidad más amplia ya ha calificado como potencialmente huecas. Si el grupo endosa resultados que luego se desmoronan bajo escrutinio, el daño reputacional no se limitará a OpenAI. Se extenderá en ondas a través de las mismas personas que confiaron en su juicio. Hay una creciente conciencia de esta dinámica entre algunos participantes potenciales —varias figuras senior habrían sido abordadas pero declinaron, citando el conflicto entre independencia académica y proximidad corporativa.

La comunidad matemática más amplia obtiene un canal que pidió, pero que solo fluye en una dirección. OpenAI no ha aceptado someter sus resultados a revisión por pares tradicional. El grupo asesor es una vía alternativa —más rápida, más controlada, y fundamentalmente asimétrica. La compañía produce. El grupo asesora sobre el embalaje. La comunidad recibe.

También hay efectos de segundo orden a considerar. Los departamentos universitarios que han luchado por atraer estudiantes de posgrado en matemáticas puras podrían ahora enfrentar presión para incorporar resultados generados por IA en sus currículos —no porque los resultados estén verificados, sino porque el mercado lo exige. Los organismos de financiamiento podrían ajustar discreta y silenciosamente sus prioridades. Los posdocs que pasan meses combatiendo un solo teorema podrían encontrar que sus trayectorias profesionales se valoran menos frente a un sistema que produjo cien soluciones en dos meses. El grupo asesor no crea estas presiones, pero se le verá como parte del ecosistema que las normaliza.

Qué sucede después

La prueba inmediata es la publicación. El grupo ha habilitado un formulario para recoger aportes de matemáticos sobre cómo manejar lo que OpenAI describe como un gran volumen de resultados importantes. Esa es la palabra operativa: importantes. OpenAI decide clasificar sus propios productos. El grupo asesor asesora sobre el momento y el encuadre. El resto del campo es invitado a comentar mediante un formulario web.

Si las afirmaciones de OpenAI sobreviven incluso una ronda modesta de verificación independiente, el precedente es enorme. Resolver un Problema del Milenio sería el hito de IA más visible en matemáticas desde el trabajo de DeepMind sobre plegamiento de proteínas. Desgarraría la jerarquía de lo que cuenta como logro intelectual y forzaría un forcejeo sobre la relación entre experiencia humana y generación maquina. El premio de 1 millón de dólares del Clay Mathematics Institute —aún otorgado a humanos— se volvería un relicto simbólico si una máquina reclamara la solución primero.

Si las afirmaciones no resisten el escrutinio, el grupo asesor se convierte en un estudio de caso sobre cómo la credibilidad institucional puede ser tomada prestada sin ganarla. Hemos visto este patrón antes en otros dominios. Los paneles asesores científicos capturados por la industria han prestado precisión falsa a hallazgos cuestionados, desde el tabaco hasta los farmacéuticos. La diferencia aquí es que las apuestas son epistémicas más que comerciales —la verdad de las matemáticas no es negociable, y el campo eventualmente ordenará señal de ruido, sin importar qué tan pulido sea el embalaje.

El modelo detrás de estos resultados lleva entrenando desde finales de agosto. Eso es aproximadamente dos meses. Las afirmaciones de más de 100 problemas abiertos resueltos en esa ventana no son solo ambiciosas —están fuera de cualquier cosa que el campo haya visto de cualquier fuente, humana o máquina. La carga ahora recae enteramente sobre el grupo asesor para producir un relato público de lo que ha sido realmente verificado, lo que permanece sin verificar, y lo que la compañía está eligiendo no compartir.

La línea entre avance y comunicado de prensa siempre ha sido delgada en IA. OpenAI acaba de construir un comité de matemáticos para hacerla aún más delgada.