⚡ EILMELDUNG
Chinesische Forscher erzielen Durchbruch: Open-Source-KI-Agent „Hyra“ löst Mathematikproblem, an dem AlphaEvolve, GPT und Claude scheiterten
Tencent
Ein neues Preprint auf arXiv löst ein seit langem bestehendes Problem in der additiven Kombinatorik, wobei die entscheidende Konstruktion von Hyra vorgeschlagen wurde, einem Open-Source-KI-Agenten von Tencent, der auf dem Modell Hy3 basiert. Trotz Versuchen von AlphaEvolve von Google DeepMind, GPT und Claude gelang keiner der Durchbruch, und Hyras Lösung wurde im Beweisassistenten Lean formal verifiziert. Diese Leistung markiert einen Meilenstein als erstes bedeutendes KI-Mathematikergebnis durch ein Open-Source-Modell, und der Mathematiker Thomas Bloom hat das Ergebnis unterstützt und sogar „Hyra“ als Koautor aufgeführt.
Ein neuer Preprint auf arXiv mit dem Titel „Settling the Optimal Exponent Relating Sumsets and Difference Sets“ von Haowei Lin (Tencent Hunyuan) und Shanda Li (Carnegie Mellon University) löst eine zentrale Frage der additiven Kombinatorik, an der führende KI-Systeme, darunter AlphaEvolve von Google DeepMind, GPT und Claude, gescheitert waren. Das Problem betrifft die Beschränkung des Verhältnisses von Summenmenge zu Differenzmenge, wobei frühere KI-gestützte Ergebnisse nur Exponenten um 1,14 erreichten, die wahre obere Schranke jedoch nachweislich exakt 2 beträgt. Der Durchbruch gelang, als die Forscher dem KI-Agenten Hyra erlaubten, Konstruktionen und Beweisskizzen in natürlicher Sprache vorzuschlagen, anstatt nur explizite Listen, was zu einer neuartigen Konstruktion führte, die anschließend manuell und durch einen formalen Beweis in Lean 4 verifiziert wurde. Hyra, ein Open-Source-Forschungsagent von Tencent, basierend auf dem Hy3-Modell (ein 295B-MoE-Modell, veröffentlicht unter Apache 2.0), arbeitete etwa einen Tag lang, wobei GPT-5.6 Sol als Richter diente, um die Suche zu leiten; die endgültige Konstruktion wurde jedoch unabhängig von Menschen geprüft. Der Mathematiker Thomas Bloom, bekannt für seine strenge Prüfung von KI-Behauptungen, verifizierte das Ergebnis und formulierte den Satz sogar neu, wobei er die Autoren als „Lin, Li und Hyra“ auflistete und damit die KI als Koautor anerkannte. Obwohl der Preprint noch nicht begutachtet ist, macht die Kombination aus maschinell geprüftem Beweis in Lean und unabhängiger menschlicher Verifikation dies zu einem seltenen und glaubwürdigen KI-Beitrag zur Mathematik, insbesondere bemerkenswert, da er von einem Open-Source-Modell stammt, im Gegensatz zu früheren Errungenschaften geschlossener Modelle.
Quelle: Habr — хаб ИИ —
Original
