Chinese open-weight AI: Kimi K3 daagt Amerikaanse frontiermodellen uit
Moonshot AI
OpenAI
Anthropic
Meta
Mistral
DeepSeek
De Chinese startup Moonshot AI heeft Kimi K3 uitgebracht, een open-weight model met 2,8 biljoen parameters, en claimt topprestaties in benchmarks. Onafhankelijke tests door Artificial Analysis plaatsen het op de derde plaats in hun Intelligence Index, achter alleen Claude Fable 5 en GPT-5.6 Sol. Kimi K3 blinkt uit in agentische en automatiserings taken en vormt een aanzienlijke uitdaging voor Amerikaanse frontiermodellen.
De Chinese startup Moonshot AI, gesteund door de Chinese internet- en handelsgroep Alibaba, heeft een open-weight model uitgebracht genaamd Kimi K3 met 2,8 biljoen parameters. Volgens interne benchmarks presteert het uitzonderlijk goed en staat het net achter de high-end versies van concurrenten Claude Fable 5 en GPT-5.6 Sol. Bij coderingstaken wint Kimi K3 twee van de zes disciplines en eindigt het in alle andere opzichten op minstens de derde plaats. Als universele agent presteert het zelfs beter, met winst in drie van de zes tests, terwijl Fable 5 in het algemeen leidt. Een onafhankelijke evaluatie door het laboratorium Artificial Analysis vond vergelijkbare resultaten: Kimi behaalde 57 punten op hun Intelligentie-Index, een sprong van de 17e naar de 3e plaats, slechts drie punten achter Claude Fable 5 en twee achter GPT-5.6 Sol. Kimi K3 presteerde bijzonder goed bij agentische en automatiseringstaken, en versloeg Fable 5 zelfs op het gebied van automatisering. Het hallucinatiepercentage was aanzienlijk hoger vergeleken met de K2-versie (51%), maar Fable 5 (55%) en GPT-5.6 Sol (85%) scoorden slechter op deze metriek. Dit volgt na de release van DeepSeek in januari 2025 als een nieuwe fundamentele uitdaging voor de gevestigde multimodale AI's van OpenAI, Google en Anthropic, wat suggereert dat open-source modellen kunnen concurreren met westerse grensverleggende modellen, ondanks het Amerikaanse chipexportembargo.
Bron: Heise online —
origineel
