ModelleGeschäft & Markt 🇷🇺 10.08.2026 14:01

Qwen3.8 Max veröffentlicht: Übertrifft Claude Fable 5 im Agentic Index bei 6 Dollar pro Million Tokens

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Alibaba hat die endgültige Version von Qwen3.8 Max veröffentlicht, ein multimodales Modell mit 2,4 Billionen Parametern und einem Kontext von einer Million Tokens. Unabhängige Tests zeigen, dass es Claude Fable 5 im Agentic Index übertrifft, und die API-Preise sind deutlich niedriger als bei der Konkurrenz. Die offenen Gewichte stehen jedoch noch aus.
Alibaba hat offiziell Qwen3.8 Max veröffentlicht, ein natives multimodales Mixture-of-Experts-Modell mit 2,4 Billionen Parametern. Es unterstützt Text-, Bild- und Videoeingaben und gibt Text aus, mit einem Kontextfenster von bis zu einer Million Tokens (983.000 Eingabe- und 131.000 Ausgabe-Tokens im Denkmodus). Das Modell verfügt über standardmäßig aktiviertes hybrides Denken, Funktionsaufrufe und integrierte Tools und wird für Programmierung und professionelle agentische Workflows beworben. Unabhängige Tests von Artificial Analysis zeigen, dass Qwen3.8 Max im Intelligence Index 58,1 Punkte erreicht (gegenüber 62,1 für Claude Fable 5) und im Agentic Index 58,4 Punkte (gegenüber 56,6 für Claude Fable 5), wobei nur zwei Claude Opus 5 Modi höher eingestuft werden. Die Preise liegen bei 2 Dollar pro Million Eingabe-Tokens und 6 Dollar pro Million Ausgabe-Tokens, mit Cache-Lesevorgängen bei 0,25 Dollar pro Million Tokens – etwa fünfmal günstiger als Claude Fable 5 beim Input und 8,3-mal günstiger beim Output. Allerdings ist das Modell wortreich: Es generierte bei einem vollständigen Intelligence Index Lauf etwa 150 Millionen Tokens, etwa das 2,3-fache des Medians (66 Millionen) vergleichbarer Modelle. Die Geschwindigkeit liegt bei etwa 82 Ausgabe-Tokens pro Sekunde, mit einer Latenzzeit für das erste Token von etwa 2,8 Sekunden. Stand Morgen des 10. August waren die offenen Gewichte für Qwen3.8 Max und Qwen3.8-27B noch nicht veröffentlicht, obwohl Alibaba versprach, sie in der Woche ab dem 3. August bereitzustellen. Das große Modell benötigt etwa 4,8 Terabyte in BF16 oder 1,2 Terabyte in 4-Bit, was eine lokale Bereitstellung für die meisten unpraktikabel macht. Der Artikel legt nahe, dass Qwen3.8 Max für agentisches Programmieren, die Analyse langer Dokumente, mehrstufige Prozesse und als Backup zu Claude geeignet ist, empfiehlt jedoch, es vor einem Wechsel an den eigenen Aufgaben zu testen.
Quelle: Habr — хаб ИИ — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten