⚡ EILMELDUNG
ModelleOpen Source 🇺🇸 27.07.2026 02:02

Kimi K3: 2,8 Billionen Parameter und was wir noch vom Pelikan-Benchmark lernen können

Moonshot AIMoonshot AI DeepSeekDeepSeek AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind
Das chinesische KI-Labor Moonshot AI hat Kimi K3 veröffentlicht, ein Modell mit 2,8 Billionen Parametern, das behauptet, Claude Opus 4.8 und GPT-5.5 zu übertreffen, aber hinter Claude Fable 5 und GPT-5.6 Sol zurückbleibt. Das Modell ist über Website und API verfügbar, mit versprochenen offenen Gewichten bis zum 27. Juli 2026. Simon Willison testete es mit seinem SVG-Benchmark „Pelikan auf einem Fahrrad“ und stellte hohe Kosten und einen hohen Verbrauch an Reasoning-Token fest.
Moonshot AI hat Kimi K3 angekündigt, ihr leistungsfähigstes Modell mit 2,8 Billionen Parametern, das jetzt über ihre Website und API verfügbar ist. Der Open-Weight-Release ist für den 27. Juli 2026 geplant. Moonshot behauptet, dass es bei selbstberichteten Benchmarks Claude Opus 4.8 und GPT-5.5 übertrifft, aber gegen Claude Fable 5 und GPT-5.6 Sol verliert. Die Preisgestaltung liegt bei 3 Dollar pro Million Input-Token und 15 Dollar pro Million Output-Token, was es zum teuersten chinesischen KI-Modell bisher macht. Simon Willison testete K3 mit seinem Pelikan-SVG-Benchmark über OpenRouter und zahlte 0,25 Dollar für den Output. Das Modell verwendete 95 Input-Token und 16.658 Output-Token (13.241 Reasoning-Token). Das generierte SVG war von schlechter visueller Qualität, aber der Alternativtext war gut. Willison merkt an, dass der Pelikan-Benchmark nicht länger prädiktiv für die gesamte Modellqualität ist, aber weiterhin nützlich für ‚Hello-World‘-Tests, Kostenschätzung und grundlegende Fähigkeitsüberprüfungen bleibt.
Quelle: Simon Willison — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten