Moonshot AI julkaisee suositun Kimi-K3-mallinsa painot – lähes markkinajohtajien tasolla, mutta paljon yksinkertaisempi käyttää
Moonshot AI
OpenAI
Anthropic
Kiinalainen Moonshot AI on avannut Kimi-K3-mallinsa painot. Se suoriutuu paremmin kuin aiemmat OpenAI:n ja Anthropicin mallit, mutta maksaa 2–3 kertaa vähemmän käyttää, ja välimuistin osumatarkkuus on jopa 90 prosenttia koodaustöissä. Malli käyttää sekoitetun tarkkuuden formaatteja MXFP4 ja MXFP8, ja se on optimoitu vähemmän tehokkaille laitteistoille, kuten Nvidia H20:lle.
Moonshot AI on julkaissut Kimi-K3-mallinsa painot vapaasti saataville, jolloin kuka tahansa riittävällä laskentateholla voi ajaa sitä paikallisesti. Malli suoriutuu huomattavasti paremmin kuin OpenAI:n GPT:n ja Anthropic Clauden aiemmat sukupolvet, ja se on vain hieman jäljessä uusimmista Sol- ja Fable-malleista. Kimi-K3:n käyttökustannukset ovat kaksi–kolme kertaa halvemmat kuin amerikkalaisilla vastineilla, ja välimuistiosumien myötä koodaustehtävissä kustannukset laskevat 0,30 dollariin miljoonalta tokenilta verrattuna kolmen dollarin vakiosyöttöhintaan. Tehokkuus johtuu todennäköisesti MXFP4:n käytöstä painojen tallennukseen ja MXFP8:n käytöstä aktivointiin, jotka molemmat ovat matalan tarkkuuden formaatteja, jotka säästävät muistia. Sen 2,8 biljoonasta parametristä vain 104,2 miljardia on aktiivisia samanaikaisesti. Malli on suunniteltu toimimaan Nvidia H20 -kiihdyttimillä, joilta puuttuu natiivisti MX-liukulukutuki, mutta se saattaa toimia vielä tehokkaammin Blackwell-siruilla. Kimi-K3 korvaa avain-arvo-välimuistin kiinteän koon tilankäsittelijällä, jota kutsutaan Kimi Delta Attentioniksi, ja käyttää MoE-arkkitehtuuria, jossa aktivoituu vain 16 896:sta asiantuntijasta. Vain painot ovat kuitenkin avoimia; koulutusprosessi ja tietoaineisto pysyvät omaisuutena.
Lähde: 3DNews —
Alkuperäinen
