Claude, el modelo de inteligencia artificial de Anthropic, ha logrado un avance inesperado en un problema derivado de la hipótesis de Riemann, uno de los grandes enigmas matemáticos del último siglo y medio. En un experimento sin precedentes, la IA elevó un límite matemático clave del 41,6 % al 67,2 %, un salto cuantitativo que los matemáticos humanos no habían conseguido en décadas. Lo extraordinario del caso no es solo el resultado, sino el proceso: un empleado de Anthropic sin formación en matemáticas avanzadas logró guiar al modelo con instrucciones tan simples como «sigue adelante» y «cree en ti mismo».
Qué es la hipótesis de Riemann y por qué lleva 165 años sin resolverse
Formulada en 1859 por el matemático alemán Bernhard Riemann, la hipótesis de Riemann es un problema sobre la distribución de los números primos. Riemann propuso que todos los ceros no triviales de la función zeta tienen parte real igual a 1/2. Décadas de trabajo han confirmado este comportamiento para miles de millones de ceros, pero una prueba general sigue siendo esquiva. El Clay Mathematics Institute la incluyó entre sus siete Problemas del Milenio, con un premio de un millón de dólares para quien logre demostrarla o refutarla. A día de hoy, ni los matemáticos más brillantes ni las mejores inteligencias artificiales han conseguido cerrar el caso.
El desafío no es solo técnico: la hipótesis tiene profundas implicaciones en teoría de números, criptografía y física. Cualquier progreso, por parcial que sea, representa un hito. Lo que logró Claude fue avanzar en uno de los resultados derivados de la hipótesis —un límite inferior sobre ciertas propiedades— que llevaba décadas estancado.
El experimento de Anthropic: 650 ideas fallidas y una insistencia humana
Jarred Sumner, empleado de Anthropic sin formación específica en matemáticas avanzadas, decidió poner a prueba una variante experimental de Claude. Su primera instrucción fue directa: que intentara resolver la hipótesis de Riemann sin más restricciones. El modelo generó y probó 650 ideas. Ninguna funcionó. Sin embargo, Sumner no se detuvo ahí.
«No te rindas, IA», fue su mensaje reiterado durante el siguiente día y medio. Claude escribió cientos de scripts en Python y realizó comprobaciones numéricas sistemáticas. Fue entonces cuando dos de los subagentes que se activaron en el proceso encontraron ideas que permitían avanzar en uno de los resultados derivados de la hipótesis, un campo que también llevaba décadas progresando muy lentamente. La clave estaba en conectar trabajos recientes de varios matemáticos que habían investigado el problema por separado, sin que nadie hubiera detectado antes que esas herramientas podían combinarse.
El papel de la persistencia: ¿por qué funcionó «cree en ti mismo»?
Durante buena parte del proceso, las intervenciones de Sumner se limitaron a decirle al modelo frases como «sigue adelante» y «cree en ti mismo». Algunos observadores señalaron que esto no tiene que ver con la autoestima de una máquina, sino con el permiso implícito para consumir más cómputo a pesar de los fracasos repetidos. Al no poner un límite nuevo tras cada intento fallido, el modelo pudo explorar caminos que de otro modo habrían quedado truncados. Hay quien afirma que esta teoría no tiene mucho sentido, pero los hechos son tozudos: el resultado llegó.
Del 41,6 % al 67,2 %: qué significa ese salto cuantitativo
El límite sobre el que Claude trabajó es una cota inferior en un resultado derivado de la hipótesis de Riemann. Sin entrar en el detalle técnico (que el propio modelo explicó en un documento validado posteriormente), se trata de la proporción de casos o propiedades que se pueden afirmar con certeza bajo ciertas condiciones de la función zeta. Durante décadas, ese límite se había movido muy lentamente, con avances de apenas unos puntos porcentuales cada varios años. Que una IA lo elevara del 41,6 % al 67,2 % en una sola sesión de trabajo representa un progreso de años —quizá décadas— comprimido en menos de 48 horas.
El paso de 650 ideas fallidas a un hallazgo concreto ilustra la naturaleza del trabajo matemático asistido por IA: el modelo no descubrió una teoría completamente nueva, sino que recorrió vastas colecciones de literatura científica para detectar conexiones que los humanos no habían logrado ver. Es un patrón que comienza a repetirse en investigaciones científicas de todo tipo.
Cómo Claude conectó los puntos entre trabajos de matemáticos humanos
Para lograr el avance, Claude combinó resultados de diversos matemáticos que habían trabajado sobre la hipótesis de Riemann en los últimos años. La novedad del modelo fue detectar que todas esas herramientas desarrolladas por expertos humanos se podían ensamblar para superar el límite anterior. No se trató de una idea radicalmente nueva, sino de una síntesis inteligente que ningún investigador individual había realizado.
Este tipo de patrón —la IA como conectora de conocimiento fragmentado— está empezando a emerger en campos como la biología computacional, la física de materiales y, ahora, las matemáticas puras. La capacidad de procesar miles de artículos, mantener el contexto de cada uno y buscar intersecciones no evidentes es un talento genuinamente complementario al del investigador humano.
31 millones de tokens y una validación matemática rigurosa
El experimento consumió recursos computacionales masivos. Las dos sesiones de Claude Code que se utilizaron generaron 31 millones de tokens de salida. Aunque Anthropic no detalló el coste económico exacto, la cifra da una idea de la magnitud de cómputo involucrada.
Después de encontrar el resultado, los agentes de Claude no se limitaron a darlo por bueno. Intentaron desmontarlo activamente, buscaron contraejemplos, descargaron 54 estudios relacionados en arXiv para comprobar que nadie hubiera publicado esa idea previamente, y luego volvieron a demostrar la proposición desde cero. Dos matemáticos de Anthropic estudiaron la prueba resultante mediante la plataforma Lean, un asistente de verificación formal, y la validaron. Ese proceso de revisión interna es tan importante como el hallazgo mismo, porque garantiza que el resultado no es un espejismo estadístico ni una coincidencia numérica.
Lean: la red de seguridad que certifica el trabajo de la IA
Lean es un sistema de verificación de pruebas matemáticas asistido por ordenador. Permite escribir demostraciones en un lenguaje formal que la máquina puede comprobar paso a paso, eliminando el margen de error humano o de interpretación. Que los matemáticos de Anthropic validaran la prueba de Claude mediante Lean es una señal de que el resultado se sostiene sobre fundamentos sólidos. No es la primera vez que se usa Lean para certificar hallazgos de IA, pero sí una de las aplicaciones más ambiciosas hasta la fecha.
Implicaciones para la investigación matemática: ¿estamos ante un nuevo tipo de matemático?
Puede que Claude no sea, de momento, el matemático más genial del mundo. Pero tanto él como otros modelos que están asombrando en el campo de las matemáticas están dejando algo claro: pueden comportarse como investigadores infatigables, capaces de consumir enormes cantidades de literatura para encontrar conexiones útiles. La hipótesis de Riemann sigue infranqueable, pero la IA sigue confirmando que su capacidad bruta puede sernos de mucha ayuda.
El contraste con hitos anteriores es revelador. En 1997, Deep Blue redefinió el ajedrez al vencer a Garry Kasparov. Hoy, OpenAI y Anthropic apuntan a algo similar con las matemáticas: no solo resolver problemas, sino descubrir caminos que los humanos no habían explorado. La diferencia es que las matemáticas son un dominio mucho más amplio y complejo que el ajedrez, y los modelos actuales aún tropiezan con problemas de razonamiento profundo y generalización.
Preguntas frecuentes sobre el avance de Claude en la hipótesis de Riemann
¿Qué significa exactamente que Claude haya pasado del 41,6 % al 67,2 %?
Significa que, en un resultado derivado de la hipótesis de Riemann —una cota inferior sobre ciertas propiedades de la función zeta— la IA logró elevar el límite conocido desde el 41,6 % hasta el 67,2 %. Es decir, ahora se puede afirmar con certeza que, bajo las condiciones establecidas, un 67,2 % de los casos cumplen la propiedad, frente al 41,6 % anterior. Es un avance cuantitativo significativo en un problema que llevaba décadas estancado.
¿Claude ha resuelto la hipótesis de Riemann?
No. La hipótesis de Riemann sigue sin demostrarse ni refutarse. El avance se produjo en uno de sus resultados derivados, no en la hipótesis central. Anthropic señaló explícitamente que no espera que las técnicas encontradas ayuden a resolver el problema original.
¿Cómo logró Claude este avance sin ser un matemático experto?
El modelo combinó trabajos recientes de varios matemáticos humanos que habían investigado el problema por separado. Claude detectó que esas herramientas podían integrarse para superar el límite anterior. No creó teoría nueva, sino que identificó una conexión que nadie había visto. El proceso fue guiado por un empleado sin formación matemática avanzada, Jarred Sumner, que simplemente insistió en que el modelo siguiera intentándolo.
¿Qué papel jugó la validación con Lean?
Dos matemáticos de Anthropic usaron la plataforma Lean para verificar formalmente la prueba generada por Claude. Lean permite escribir demostraciones en un lenguaje que la máquina comprueba paso a paso, eliminando errores humanos. La validación confirmó que el resultado es correcto y no un artefacto estadístico.
¿Cuánto costó este experimento en términos de recursos?
Se generaron 31 millones de tokens de salida en dos sesiones de Claude Code. Anthropic no reveló el coste económico exacto, pero la cifra indica un uso masivo de capacidad computacional. Además, los agentes descargaron 54 estudios de arXiv para verificar que nadie hubiera publicado la idea antes.
La IA como investigadora incansable: el patrón que se repite en ciencia
El caso de Claude y la hipótesis de Riemann no es aislado. En otros campos, la inteligencia artificial está empezando a demostrar que puede actuar como una fuerza de exploración sistemática, recorriendo bibliotecas enteras de conocimiento en busca de combinaciones no evidentes. En biología, ha identificado nuevas dianas farmacológicas; en física de materiales, ha sugerido compuestos con propiedades inesperadas; en matemáticas, está ayudando a resolver conjeturas que llevaban décadas abiertas.
Lo que distingue a estos sistemas no es la creatividad en el sentido humano —no generan marcos teóricos completamente nuevos—, sino la persistencia y la capacidad de mantener contexto sobre miles de documentos. Un investigador humano tarda años en especializarse en una subárea; una IA puede leer todos los artículos publicados sobre esa subárea en cuestión de horas y detectar patrones que nadie había anotado.
El rol del humano en la ecuación: de matemático experto a entrenador de persistencia
El experimento de Anthropic revela un cambio sutil pero profundo en la dinámica de la investigación asistida por IA. Jarred Sumner no era un matemático experto, pero entendía cómo interactuar con el modelo para mantenerlo en la pista. Su contribución no fue técnica, sino estratégica: decidir cuándo insistir, cuándo dar permiso para consumir más recursos, cuándo decir «cree en ti mismo». Esa habilidad —gestionar la perseverancia de una máquina— puede convertirse en una competencia valiosa en los laboratorios del futuro.
Algunos críticos señalan que atribuir emociones a la IA es un antropomorfismo engañoso, y que lo que realmente hizo Sumner fue eliminar los límites de cómputo que el propio sistema se impone tras fracasos repetidos. Desde esa perspectiva, el prompt «cree en ti mismo» no es más que una forma coloquial de decir «reintenta con más recursos». Sea cual sea la explicación, el resultado es el mismo: se logró un avance que llevaba décadas resistiéndose.
El futuro de la IA en matemáticas: ¿hacia una colaboración simbiótica?
La hipótesis de Riemann sigue siendo una frontera infranqueable, pero el experimento de Anthropic sugiere que la IA puede ser una herramienta poderosa para progresar en sus derivados y en problemas similares. La combinación de exploración masiva, conexión de literatura dispersa y verificación formal con Lean apunta a un ecosistema donde humanos y máquinas colaboran de forma simbiótica: los humanos establecen la dirección y la persistencia; las máquinas ejecutan la exploración y la síntesis.
No se trata de reemplazar a los matemáticos, sino de amplificar su alcance. Un investigador humano puede tener una intuición brillante, pero le llevará meses o años probar todas sus consecuencias. Una IA puede tomar esa intuición, explorar sus ramificaciones en miles de direcciones y devolver al humano las conexiones más prometedoras. El tiempo de ciclo se comprime, y lo que antes requería toda una carrera académica puede ahora lograrse en semanas.
El verdadero impacto del avance de Claude no está en el 67,2 % —una cifra que probablemente será superada pronto—, sino en la demostración de que un modelo de lenguaje, guiado por un no experto, puede contribuir de forma significativa a un problema matemático de primer nivel. Si la tendencia continúa, podríamos estar asistiendo al nacimiento de una nueva forma de hacer matemáticas, donde la genialidad sigue siendo humana, pero la persistencia es máquina.