Qwen3.8 Max julkaistu: päihittää Claude Fable 5:n Agentic-indeksissä 6 dollarilla miljoonaa tokenia kohden
Alibaba/Qwen
Anthropic
Alibaba on julkaissut Qwen3.8 Maxin lopullisen version, joka on 2,4 biljoonan parametrin multimodaalinen malli miljoonan tokenin kontekstiominaisuudella. Riippumattomat testit osoittavat, että se ylittää Claude Fable 5:n Agentic-indeksissä, ja sen API-hinnoittelu on huomattavasti kilpailijoita alhaisempi. Avoimet painot ovat kuitenkin vielä julkaisematta.
Alibaba on virallisesti julkaissut Qwen3.8 Max -mallin, joka on natiivi multimodaalinen asiantuntijasekoitusmalli (mixture-of-experts), jossa on 2,4 biljoonaa parametria. Se tukee teksti-, kuva- ja videoaineistoa sekä tuottaa tekstiä, ja sen konteksti-ikkuna on jopa miljoona tokenia (983 000 syötettyä ja 131 000 tuotettua tokenia ajattelutilassa). Mallissa on oletuksena käytössä hybridiajattelu, funktiokutsut ja sisäänrakennetut työkalut, ja sitä mainostetaan ohjelmointiin ja ammattimaiseen agenttityönkulkuun. Artificial Analysisin riippumaton testaus osoittaa, että Qwen3.8 Max saa Älykkyysindeksissä (Intelligence Index) pisteet 58,1 (verrattuna Claude Fable 5:n 62,1:een) ja Agenttisuusindeksissä (Agentic Index) pisteet 58,4 (verrattuna Claude Fable 5:n 56,6:een), ja vain kaksi Claude Opus 5 -tilaa sijoittuu korkeammalle. Hinnoittelu on 2 dollaria miljoonaa syötettyä tokenia kohti ja 6 dollaria miljoonaa tuotettua tokenia kohti, ja välimuistin luvut maksavat 0,25 dollaria miljoonaa tokenia kohti – noin viisi kertaa halvempi kuin Claude Fable 5 syötössä ja 8,3 kertaa halvempi tuotossa. Malli on kuitenkin monisanainen: se tuotti noin 150 miljoonaa tokenia täydellä Älykkyysindeksin ajolla, mikä on noin 2,3 kertaa vertailukelpoisten mallien mediaani (66 miljoonaa). Nopeus on noin 82 tuotettua tokenia sekunnissa, ja ensimmäisen tokenin viive on noin 2,8 sekuntia. Elokuun 10. päivän aamuna Qwen3.8 Maxin ja Qwen3.8-27B:n avoimia painoja ei ollut vielä julkaistu, vaikka Alibaba lupasi niiden ilmestyvän elokuun 3. päivän alkavalla viikolla. Suuri malli vaatii noin 4,8 teratavua BF16-muodossa tai 1,2 teratavua 4-bittisenä, mikä tekee paikallisesta käytöstä useimmille epäkäytännöllistä. Artikkelin mukaan Qwen3.8 Max sopii agenttipohjaiseen koodaukseen, pitkien asiakirjojen analysointiin, monivaiheisiin prosesseihin ja varamalliksi Claudelle, mutta suosittelee testaamaan sitä omilla tehtävillä ennen vaihtoa.
Lähde: Habr — хаб ИИ —
Alkuperäinen
