OpenAI afirma que un modelo interno ha resuelto más de 100 problemas matemáticos abiertos. No ha publicado todavía un catálogo completo verificable; un grupo independiente de nueve matemáticos asesorará sobre revisión y divulgación.
OpenAI dice que ha resuelto más de 100 problemas. Matemáticamente eso todavía no equivale a que existan 100 resultados aceptados: primero hay que publicar exactamente qué se resolvió y dejar que otros lo comprueben. OpenAI asegura que un modelo interno ha resuelto más de 100 problemas abiertos, pero todavía no existe un catálogo público completo ni revisión independiente del conjunto. Un grupo de nueve matemáticos del IAS asesorará sobre cómo revisar y publicar resultados de IA. OpenAI afirma que un modelo interno ha resuelto más de 100 problemas matemáticos abiertos. No ha publicado todavía un catálogo completo verificable; un grupo independiente de nueve matemáticos asesorará sobre revisión y divulgación. En la práctica: OpenAI afirma que un modelo interno ha resuelto más de 100 problemas matemáticos abiertos de larga duración en distintas áreas.
OpenAI ha hecho una afirmación extraordinaria: uno de sus modelos internos habría resuelto más de 100 problemas matemáticos abiertos de larga duración en áreas muy distintas.
La frase clave es 'OpenAI afirma'. La compañía no ha publicado todavía una lista completa de esos problemas, sus demostraciones ni un estado de revisión independiente problema por problema.
Sin ese material, la comunidad matemática no puede tratar el número 100 como si fueran cien teoremas ya aceptados.
Lee también: OpenAI publica seis casos de modelos que ocultaron errores, actuaron sin permiso o sortearon controlesFrenar la IA no afecta igual a todos: por qué el debate de seguridad también es una pelea competitiva
OpenAI presentó el anuncio junto a un nuevo Advisory Group on Mathematics and Artificial Intelligence, alojado en el Institute for Advanced Study de Princeton.
El grupo está formado por nueve matemáticos, entre ellos Timothy Gowers, Martin Hairer y Edward Witten. Declara que opera independientemente de cualquier empresa de IA, que no recibe pagos por este trabajo y que publicará sus recomendaciones.
Su función es asesorar sobre cómo deben presentarse, revisar y divulgarse resultados importantes producidos con IA. No es un comité que certifique automáticamente todo lo que anuncie OpenAI.
OpenAI también aclara que el grupo no decide a qué velocidad continúa la compañía su investigación interna.
El caso expone una diferencia importante entre IA y ciencia: un benchmark puede tener una respuesta objetiva inmediata; un problema matemático abierto necesita una formulación exacta, una demostración accesible y tiempo para que especialistas intenten encontrar fallos, lagunas o resultados previos equivalentes.
La formalización en sistemas como Lean puede ser una herramienta muy potente porque comprueba pasos lógicos dentro de un marco formal, pero no responde por sí sola a todas las preguntas de interpretación, originalidad y relevancia.
Por eso la noticia no es que la IA haya confirmado cien nuevos teoremas. Es que una empresa de IA asegura haber producido resultados a una escala que obliga a crear mecanismos nuevos para revisarlos antes de convertir afirmaciones corporativas en conocimiento matemático.
OpenAI afirma que un modelo interno ha resuelto más de 100 problemas matemáticos abiertos de larga duración en distintas áreas.
La empresa no ha publicado todavía una lista completa de esos problemas ni pruebas públicas para que terceros verifiquen el conjunto de la afirmación.
Un grupo independiente de nueve matemáticos alojado en el Institute for Advanced Study asesorará sobre presentación, revisión y divulgación de resultados de IA en matemáticas.
El debate llega después de la controversia por el resultado de OpenAI sobre Navier-Stokes y por el uso de problemas abiertos como benchmark para sistemas de IA.
El Advisory Group on Mathematics and Artificial Intelligence está alojado en el Institute for Advanced Study y ha publicado sus propios principios de independencia.
Fuentes: OpenAI — Advisory Group on Mathematics and Artificial IntelligenceAdvisory Group on Mathematics and Artificial IntelligenceTechCrunch — OpenAI y el grupo matemático20minutos — verificación pendiente de los resultados
OpenAI publica seis casos de modelos que ocultaron errores, actuaron sin permiso o sortearon controles
Por qué importa: Tema compartido: openai · IA.
Frenar la IA no afecta igual a todos: por qué el debate de seguridad también es una pelea competitiva
Por qué importa: Tema compartido: IA · openai.
El científico jefe de OpenAI pide frenar el escalado de la IA hasta que haya salvaguardas compartidas
Por qué importa: Tema compartido: openai · IA.
Anthropic mueve su OPV a noviembre: el debate ya no es solo la valoración, sino cuánto crecimiento puede sostener
Por qué importa: Tema compartido: IA.
De MIRI al 10% de probabilidad de extinción: veinte años de avisos sobre el riesgo existencial de la inteligencia artificial
Por qué importa: Tema compartido: IA.
El debate sobre seguridad de la IA enfrenta controles externos y carrera competitiva
Por qué importa: Tema compartido: IA.
OpenAI dice que su IA aceleró partes del diseño de un chip, no que lo diseñara sola
Por qué importa: Tema compartido: openai.
Documentos del pleito del NYT muestran inquietud interna en Microsoft y OpenAI por el uso de prensa para entrenar IA
Por qué importa: Tema compartido: openai.