Modellen 🇷🇺 23.07.2026 23:47

Hoe GPT-5.6 en Kimi K3 Goed Ontwerp Leerden — Design Arena Research

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic
Design Arena-onderzoekers analyseerden GPT-5.6 Sol en Kimi K3 om te begrijpen hoe ze hoogwaardig ontwerp bereiken. Sol onderdrukt actief gangbare AI-ontwerppatronen, terwijl Kimi K3 een AI-agent simuleert binnen zijn redeneerketen.
Design Arena, een blinde vergelijkingsbenchmark waarbij mensen stemmen op AI-gegenereerde websites, heeft analyses van twee topmodellen gepubliceerd: GPT-5.6 Sol (OpenAI) en Kimi K3 (Moonshot AI). Sol behaalde een Elo van 1353 op Web Design (Niet-Agentisch), waarmee het zijn voorganger GPT-5.5 met 18 plaatsen overtreft, en zette nieuwe Pareto-grenzen voor snelheid en kosten. Onderzoekers ontdekten dat Sol leerde om AI-antipatronen (bijvoorbeeld paarse verloopjes, bento-grids) te onderdrukken door ze simpelweg niet te genereren, waardoor 'gaten' in zijn ontwerpruimte ontstaan. Daarentegen vermijdt GLM 5.2 antipatronen door ze helemaal niet te hebben geleerd. Kimi K3 behaalde de toppositie in de eenmalige Frontend Arena met een Elo van 1408 en in de 3D Design Arena met een Elo van 1450. K3 simuleert een complete AI-agent binnen zijn redeneerketen, schrijft tien keer meer code in gedachten dan andere Kimi-modellen en gebruikt een geleerde 'internetindex' om echte afbeeldings-ID's van Unsplash te herinneren zonder gebroken links. Elk model gebruikt een andere strategie: GLM 5.2 vermijdt slecht ontwerp door onwetendheid, Sol door actieve onderdrukking, en K3 door iteratieve mentale simulatie.
Bron: Habr — хаб ИИ — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws