OnderzoekModellen 🇷🇺 14.08.2026 21:02

Neurochirurg bewijst vermoeden dat wiskundigen 22 jaar lang voor raadsels stelde met een 16 uur durende GPT-5.6-run

OpenAIOpenAI
Een neurochirurg, Dr. Shanmu Jin, bewees het vermoeden van Crouzeix, een langdurig probleem in de matrixanalyse, en werd daarbij geholpen door een 16 uur durende autonome run van OpenAI's GPT-5.6 Sol. Zijn bewijs werd geverifieerd door verschillende wiskundigen, waaronder de auteur van het vermoeden, en een tweede onafhankelijk bewijs verscheen enkele dagen later. Dit markeert een mijlpaal: een belangrijke wiskundige bijdrage door een amateur, in combinatie met een AI-model.
Wiskundige Alex Townsend had ChatGPT bijna een jaar lang gevraagd om het vermoeden van Crouzeix te bewijzen, maar het model gaf consequent foutieve of onvolledige bewijzen. Op 30 juli 2026 stuurde ChatGPT een link naar een preprint die drie dagen eerder was geplaatst, met de claim dat er een oplossing was. Townsend en zijn collega Anna Greenbaum lazen het sceptisch en realiseerden zich al snel dat het echt was. De auteur, dr. Shanmu Jin, is een neurochirurg in opleiding en postdoc, geen professionele wiskundige. Hij raakte geïnteresseerd in het vermoeden van Crouzeix tijdens zijn werk aan transcraniële echografie, en formuleerde een bewijsstrategie in een sessie van zestien uur met GPT-5.6 Sol in ChatGPT Work, zonder internettoegang. Het model gebruikte een portfolio van uiteenlopende strategieën, tegenstrijdige audits, en eliminatie op basis van tegenvoorbeelden, zoals gepromoot door Jin. Het bewijs werd onafhankelijk gecontroleerd door Townsend, Greenbaum, en Michel Crouzeix, en later versterkt door een tweede, ander bewijs van de wiskundigen Emil Lorist en Felix Schwenninger, die ook gebruikmaakten van ChatGPT 5.6 Pro. Deze casus benadrukt een paradigmaverschuiving in wiskundige ontdekkingen en roept vragen op over de duurzaamheid van collegiale toetsing.
Bron: Habr — хаб ИИ — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws