클로드, 167년 된 수학 문제 진전: 3100만 토큰, 60개 에이전트, 41.6%에서 67.2%로 도약
Anthropic
앤트로픽의 클로드 모델이 1859년의 167년 된 수학 문제에서 진전을 보였습니다. 3100만 토큰, 60개의 전문화된 에이전트, 그리고 고급 강화 학습을 사용하여 클로드는 해당 문제에 대한 성공률을 41.6%에서 67.2%로 향상시켰으며, 검증을 위해 린(Lean)을 활용했습니다.
Anthropic의 Claude 모델이 167년 된 수학 문제를 난관에서 벗어나게 하며 중요한 돌파구를 마련했습니다. 1859년에 제기된 이 문제는 해석적 정수론에 뿌리를 두고 있으며 소수의 본질과 관련이 있습니다. Claude는 새로운 훈련 방식을 적용한 후 이 문제에 대한 성과가 41.6%에서 67.2%로 향상되었습니다. 모델은 약 2560만 단어에 해당하는 3100만 개의 토큰을 소비했으며, 그 과정에서 650GB의 데이터를 생성했습니다. 문제를 해결하기 위해 Claude는 60개의 전문 에이전트를 사용했으며, 각 에이전트는 arXiv에서 관련 논문 54편을 포함하여 약 2400편의 논문을 분석하여 추론의 타당성을 확보했습니다. 강화 학습과 증명 보조 도구인 Lean을 통한 검증이 crucial했습니다. Anthropic은 이러한 대규모 계산과 형식적 검증의 결합 덕분에 성공을 거두었다고 평가하며, 이는 AI 지원 수학적 발견의 새로운 이정표를 세웠습니다.
출처: AI-News.ru —
원문
