OpenAI afirma que un modelo interno ha resuelto uno de los problemas más difíciles de las matemáticas. de la Universidad de Nueva Yorkmatic, Tristan Buckmaster, dice que la versión que le contaron sobre cómo sucedió se desmoronó mientras hablaba por teléfono con la compañía.
OpenAI anunció el martes que uno de sus modelos internos había demostrado una "explosión" en tiempo finito para las ecuaciones de Navier-Stokes forzadas, uno de los siete Problemas del Premio del Milenio, cada uno con una recompensa de 1 millón de dólares.
El término "explosión" significa que las ecuaciones permiten que la velocidad de un fluido se vuelva infinita en un punto, lo cual no está permitido por las leyes de la física.
La empresa afirma que el argumento fue comprobado en Lean, un lenguaje de verificación de pruebas utilizado para confirmar formalmente las demostracionesmatic.
Si se confirma, sería el segundo problema del milenio resuelto, y el primero atribuido a una empresa de inteligencia artificial.
Días antes, Buckmaster y Levent Alpöge, matemáticomatictrabaja para Anthropic, habían publicado sus resultados: explosión en tiempo finito bajo forzamiento suave para medios porosos incompresibles de Euler y Boussinesq en 3D, formalizados en Lean. «Un logro extraordinario», dijo Terence Tao, ganador de la Medalla Fields.
Esa parte de la historia no se discute. El propio Buckmaster es muy enfático en su declaración sobre el origen de las ideas.
Según escribió, la línea de ataque tiene su origen en Diego Córdoba y Luis Martínez-Zoroa, quienes pasaron años construyendo explosiones forzadas mediante la aplicación de técnicas violentas.
Él y Alpöge utilizaron modelos de lenguaje complejos para impulsar ese programa hacia la forzante suave y Euler. Buckmaster fue más allá y afirmó que creía que Martínez-Zoroa debería recibir la Medalla Fields.
El anuncio de OpenAI se produjo un día después de Buckmaster , que describe una situación caótica que comenzó cuando empezó a circular el rumor de que Anthropic había resuelto un importante problema abierto.
El jueves 3 de septiembre, envió un correo electrónico a unmaticde OpenAI para evitar confusiones, haciendo hincapié en que su trabajo con Alpöge era una colaboración personal y no contaba con el apoyo de Anthropic ni de la Universidad de Nueva York. Leyó la respuesta, que fue cordial e incluso le ofreció recursos informáticos de OpenAI.
Las llamadas se produjeron el domingo 6 de septiembre. Buckmaster dice que Sébastien Bubeck se puso en contacto, que ambas partes mantuvieron un par de conversaciones esa tarde y que Alpöge no estaba en la línea.
Le informaron de que un modelo interno de OpenAI había generado una prueba de aproximadamente 100 páginas sobre la explosión forzada de Navier-Stokes, utilizando un forzamiento suave a lo largo de las "opciones c y d" en el enunciado formal del problema de Charles Fefferman.
Buckmaster escribió que ese era el camino estrecho que él y Alpöge habían elegido en secreto, uno que casi nadie más seguía. Dijo que oír la palabra "forzado" era una clara señal de alarma.
Según Buckmaster, Bubeck declaró a Alpöge que el resultado de OpenAI contó con muy poca intervención humana.
Buckmaster escribió: “Se descubrió que todo un equipo había estado trabajando en el problema, que esta era una de las varias cosas que se habían intentado, que se había comenzado a trabajar en el problema no forzado, que el equipo primero aplicó el modelo a problemas más fáciles, incluido Euler, que incluso el mensaje que me habían mostrado había sido escrito mediante la ayuda de Codex, y que se había utilizado una cantidad increíble de capacidad de cálculo”.
Dice que cuando preguntó cuándo se envió la primera solicitud, la respuesta llegó con retraso, y finalmente la ubicó después de que la noticia de su trabajo y el de Alpöge llegara a OpenAI.
Buckmaster afirma que él y Alpöge habían guardado sus borradores de pruebas dentro de las sesiones del OpenAI Codex y que, cuando preguntó si el modelo de OpenAI podría haber sido entrenado con esos datos, no obtuvo respuesta.
Ha declarado claramente que no afirma que haya sucedido; simplemente afirma que la pregunta quedó sin respuesta.
También alega que Bubeck presionó en dos ocasiones para que se eliminara a Alpöge como autor debido a sus vínculos con Anthropic y que una vez le preguntó: "¿Por qué arruinarías tu carrera?"
OpenAI negó las acusaciones. Bubeck calificó las afirmaciones de "falsas e incendiarias" en una breve publicación en X, dijo que había participado en el debate "siguiendo las normas académicas" y prometió una respuesta más completa.
En una rueda de prensa el martes, Bubeck afirmó que el modelo había llegado al problema de Euler de una manera diferente a como lo hicieron losmatic, pero que la demostración completa de Navier-Stokes siguió una ruta similar.
La prueba se elaboró durante el fin de semana, después de que Buckmaster dijera que la noticia de su resultado llegó a OpenAI.
“No utilizamos sus indicaciones ni sus pruebas para guiar nuestros modelos”, dijo.
Ambas partes se basan en el enfoque de Córdoba, quien dijo que ambos están "un poco en shock" y que una demostración completa "será una gran sorpresa para nosotros". Elmaticde la Universidad de Chicago, Luis Silvestre, lo describió como días de debate ininterrumpido en todo el campo.
Si estás leyendo esto, ya llevas ventaja. Mantente al día con nuestro boletín informativo.