Claude Avanza en un Problema Matemático de 167 Años: 31 Millones de Tokens, 60 Agentes y un Salto del 41,6% al 67,2%
Anthropic
El modelo Claude de Anthropic logró avances en un problema matemático de 167 años de antigüedad, que data de 1859. Utilizando 31 millones de tokens, 60 agentes especializados y aprendizaje por refuerzo avanzado, Claude mejoró su tasa de éxito en el problema del 41,6% al 67,2%, aprovechando Lean para la verificación.
El modelo Claude de Anthropic ha sacado del estancamiento un problema matemático de 167 años, logrando un avance significativo. El problema, planteado en 1859, tiene sus raíces en la teoría analítica de números y aborda la naturaleza de los números primos. El desempeño de Claude en este problema saltó del 41,6% al 67,2% después de aplicar un novedoso régimen de entrenamiento. El modelo consumió 31 millones de tokens, lo que equivale a aproximadamente 25,6 millones de palabras, y durante el proceso generó 650 GB de datos. Para abordar el problema, Claude utilizó 60 agentes especializados, cada uno analizando alrededor de 2400 artículos, incluidos 54 artículos relevantes de arXiv, para asegurar que su razonamiento fuera sólido. El uso de aprendizaje por refuerzo y la verificación mediante Lean, un asistente de demostración, fueron cruciales. Anthropic atribuye el éxito a esta combinación de cómputo a gran escala y verificación formal, marcando un nuevo hito en el descubrimiento matemático asistido por IA.
Fuente: AI-News.ru —
original
