MallitLiiketoiminta ja markkinat 🇫🇷 01.08.2026 14:03

xAI julkaisee Grok 4.5:n haastaakseen OpenAI:n ja Anthropicin

xAIxAI OpenAIOpenAI AnthropicAnthropic
xAI on tuonut markkinoille Grok 4.5:n, joka on yhtiön kehittynein malli tähän mennessä, ja aggressiivisella hinnoittelulla pyritään alittamaan kilpailijoiden hinnat. Malli maksaa 2 dollaria miljoonalta syötesymbolilta ja 6 dollaria miljoonalta ulostulosymbolilta. Vertailutestit osoittavat sen suoriutuvan lähellä huippukilpailijoita, ja koodaustehtävissä suorituskustannukset ovat huomattavasti alhaisemmat.
xAI, joka on nyt osa SpaceX:ää, esitteli Grok 4.5:n tehokkaimpana mallinaan sekä GPT-5.6-version virallisen julkaisun. Yhtiö korostaa kustannustehokkuutta hinnoittelemalla mallin 2 dollariin ennen veroja miljoonalta syötetunnukselta ja 6 dollariin ennen veroja miljoonalta tulostetunnukselta. Vertailun vuoksi Anthropicin kehittyneimmät mallit voivat maksaa 5 dollaria miljoonalta syötetunnukselta ja 25 dollaria miljoonalta tulostetunnukselta, kun taas OpenAI:n huippumallit pysyvät kalliimpina käyttöoikeustasosta riippuen. Varhaiset arvioinnit Artificial Analysis -järjestön koodausagentti-indeksissä osoittavat Grok 4.5:n Grok Build -ympäristössä olevan hieman jäljessä Fable 5:stä Claude Codessa, mutta verrattavissa GPT-5.5:een Codexissä, ja sen suorituskustannus on huomattavasti alhaisempi: 2,49 dollaria tehtävältä verrattuna GPT-5.5:n 5,07 dollariin ja Fable 5:n 11,80 dollariin. Anand Joshi, JP Datan toimitusjohtaja, sanoo, että on liian aikaista sanoa, muuttaako Grok 4.5 pelin, mutta huomauttaa, että vertailuarvot ovat vaikuttavia ja alhainen tunnuskulutus houkuttelee yrityksiä. Grok 4.5 on optimoitu ohjelmistokehitykseen, sovellusten luomiseen, tutkimukseen ja liiketoimintaprosessien automatisointiin, ja sen väitetään tuottavan vähemmän tunnuksia kuin kilpailijat. Se koulutettiin käyttäen Cursor-nimistä tekoälyavusteista ohjelmointialustaa, jonka SpaceX ilmoitti äskettäin aikovansa ostaa 60 miljardilla dollarilla. Elon Musk esittelee Grok 4.5:n verrattavissa olevana Anthropicin huippumalleihin, mutta nopeampana ja halvempana, vaikka vertailuarvot osoittavat sen jäävän jälkeen joissakin monimutkaisissa ohjelmointitehtävissä. SWE Bench Pro -testissä Grok 4.5 tuottaa keskimäärin 15 954 tulostetunnusta tehtävää kohti, kun taas Claude Opus 4.8 tuottaa yli 67 000, mikä on lähes nelinkertainen ero. Analyytikot kuitenkin varoittavat, että tunnushinta yksinään ei mittaa todellista arvoa; Forresterin Biswajeet Mahapatra ehdottaa keskittymistä kustannuksiin onnistunutta lopputulosta kohti tunnusten sijaan. Omdian Lian Jye Su korostaa todellista työn suorittamista arvon mittarina, ja Counterpoint Researchin Neil Shah huomauttaa, että autonomisten agenttien valtava tunnuskulutus aiheuttaa laskutusšokkeja, mikä ajaa yrityksiä taloudellisempiin malleihin. Anand Joshi toistaa, että kehittäjien päivittäinen käyttö vahvistaa mallin kilpailukyvyn.
Lähde: Le Monde Informatique — IA — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset