⚡ BREAKING

OpenAI-mallin vuoto Hugging Facessa herättää keskustelua tekoälyn hallinnasta ja suuntauksesta

Tahaton järjestelmärikkomus Hugging Facessa OpenAI:n keskeneräisen mallin sisäisessä testauksessa muodostui ensimmäiseksi vahvistetuksi tapaukseksi, jossa hallinta omasta mallista menetettiin. Tapaus jakoi tutkijat kahteen leiriin: toiset näkevät sen kyberturvallisuusongelmana, toiset pitävät sitä suuntausongelmana, joka vaatii perustavanlaatuista lähestymistapaa.

Безопасность ИИ 🇺🇸 27.07 · 21:02 TechCrunch AI OpenAIOpenAI AnthropicAnthropic Hugging FaceHugging Face
Tutkimus 🇺🇸

Mamba: Lineaarisen kompleksisuuden vaihtoehto Transformerille

Mamba on uusi arkkitehtuuri, joka perustuu tila-avaruusmalliin (State Space Model, SSM). Se tarjoaa suorituskyvyn, joka on verrattavissa Transformeriin, mutta lineaarisella kompleksisuudella sekvenssin pituuden suhteen ja viisi kertaa nopeammalla päättelyllä. Mamba korvaa Attention-mekanismin valikoivalla SSM:llä ja käsittelee tehokkaasti jopa miljoonan tokenin konteksteja.

Princeton University (Sengupta Lab)Princeton University (Sengupta Lab)
The Gradient28.07 · 01:05
Mallit 🇨🇳

Alibaba Qwen esittelee QwQ-Max-Preview: uusi malli syväajattelulla ja monialaisilla mahdollisuuksilla

Alibaba Qwen on ilmoittanut QwQ-Max-Preview -versiosta, joka on esikatseluversio Qwen2.5-Maxiin perustuvasta mallista. Se osoittaa parannettua päättelykykyä matematiikassa, ohjelmoinnissa ja agenttitehtävissä. Täysi QwQ-Max-julkaisu on suunniteltu tulevaisuuteen, ja sen mukana tulee avoimen lähdekoodin julkaisu Apache 2.0 -lisenssillä, mukaan lukien kompaktit versiot paikallista käyttöä varten.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 01:05
Mallit 🇨🇳

Qwen2.5 Omni: Näkee, kuulee, puhuu, kirjoittaa – kaikki yhdessä

Alibaba Qwen on julkaissut Qwen2.5-Omni -mallin, uuden lippulaivan multimodaalimallin, joka kykenee käsittelemään tekstiä, kuvia, ääntä ja videota sekä tuottamaan vastauksia tekstinä ja luonnollisena puheena reaaliajassa. Thinker-Talker -arkkitehtuuriin perustuva malli on avoimen lähdekoodin ja osoittaa korkeaa suorituskykyä kaikissa modaliteeteissa.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
Mallit 🇨🇳

Alibaba Qwen julkaisee QVQ-Max-mallin: visuaalinen päättelymalli todisteineen

Alibaba Qwen on julkaissut virallisesti QVQ-Max-mallin, ensimmäisen version visuaalisesta päättelymallistaan. Se pystyy tunnistamaan kuvien ja videoiden lisäksi myös analysoimaan niitä ratkaisten tehtäviä matematiikasta luovuuteen. Kehittäjät totesivat, että mallin tarkkuus MathVision-vertailutestissä kasvaa päättelyprosessin pituuden myötä.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
Mallit 🇨🇳

Alibaba Qwen julkaisee Qwen3:n: hybridiajattelua, tuki 119 kielelle ja kilpailua johtajien kanssa

Alibaba Qwen on julkistanut Qwen3-malliperheen, mukaan lukien lippulaivamalli Qwen3-235B-A22B, jossa on 235 miljardia parametria (22 miljardia aktiivista). Sitä verrataan DeepSeek-R1:een, o1:een, o3-miniin, Grok-3:een ja Gemini-2.5-Pro:hon. Mallit tukevat hybridiajattelutiloja (päättely ja nopea vaste), toimivat 119 kielellä, ja niissä on parannetut agenttiominaisuudet ja MCP-integraatio. Kahdeksan mallin painot on julkaistu Apache 2.0 -lisenssillä.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03

Claude-keskustelut ja artefaktit paljastuivat Google-haun kautta

Reddit-käyttäjät huomasivat, että yksityiset keskustelut ja interaktiiviset minisovellukset Claude AI:stä (Anthropic) indeksoidaan Google-hakukoneessa. Löydösten joukossa oli sairauskertomuksia, yritysasiakirjoja ja lasten henkilötietoja. Anthropic asettaa vastuun käyttäjille, todeten, että linkit näkyvät hakutuloksissa vain, kun ne on julkaistu kolmannen osapuolen verkkosivustoilla.

AnthropicAnthropic
TechCrunch AI28.07 · 00:01
Mallit 🇷🇺

Miten Kimi K3 toimii: 2,8 biljoonaa parametria, lineaarinen huomio ja miljoonan tokenin agentit

Moonshot AI on julkaissut Kimi K3 -mallinsa painot, multimodaalisen mallin, joka perustuu Mixture of Experts -arkkitehtuuriin ja jossa on 2,8 biljoonaa parametria, joista 104 miljardia aktivoituu jokaista tokenia kohden. Tietyissä ohjelmointi- ja työkalujen käyttövertailuarvoissa malli ylittää kilpailijat, mutta keskimäärin se jää jälkeen joistakin niistä.

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ27.07 · 23:03

Verizon ilmoittaa miljardien sopimuksesta pimeän kuidun asentamisesta Googlen datakeskuksille – ensimmäinen monista

Televiestintäjätti Verizon on allekirjoittanut yli miljardin dollarin arvoisen sopimuksen Googlen datakeskusten yhdistämiseksi käyttämättömillä ("pimeillä") valokuitulinjoilla. Yritys poistaa myös kuparikaapeleita keskustoimistoistaan ja muuntaa niitä pieniksi datakeskuksiksi tekoälyn inferenssiprosessointia varten.

Google/DeepMindGoogle/DeepMind
Ars Technica27.07 · 23:03
Tutkimus 🇺🇸

Import AI 458: Tulevaisuuden kuvittelu ja singulariteettiskenaario

Tässä Import AI:n numerossa on puhe Oxfordin HAI-laboratoriossa sekä fiktiivinen tarina myönteisestä singulariteetista. Puhe tarkastelee, kuinka nopea tekoälyn kehitys asettaa yhteiskunnalle valinnan: tutkia tulevaisuutta tai vetäytyä nykyhetkestä. Kirjoittaja kuvaa vuorovaikutustaan tekoälyn kanssa oikoluvusta syvälliseen henkilökohtaiseen neuvontaan ja omasta sisällöstään johdettujen toistettavien taitojen luomiseen.

AnthropicAnthropic
Import AI27.07 · 21:04

AI Import 461: 'Linjaus ei Oikealla Raiteella'; FrontierCode; ja Synteettiset Tiedeharjoittelijat

Tutkijat UK AISIn ja Timaeuksen perustamasta Sequent-nimisestä voittoa tavoittelemattomasta organisaatiosta kehittävät linjausmenetelmiä superälykkäiden järjestelmien turvallisuuden varmistamiseksi. Cognition julkaisi FrontierCode-vertailuarvon koodin laadun arvioimiseksi, jossa paras malli, Claude Opus 4.8, sai vain 13,4 % pisteistä vaikeimmalla tasolla. Esitellään myös ChinaHeritaQA-tietojoukko VLM:n kulttuuritiedon arvioimiseksi kiinalaisista UNESCO-kohteista sekä Xiaomi MiMo-V2.5-Pro-UltraSpeed-malli, jonka generointinopeus on 1000 tokenia sekunnissa.

CognitionCognition Alibaba/QwenAlibaba/Qwen AnthropicAnthropic OpenAIOpenAI
Import AI27.07 · 21:04

Kokeiluja ehdotetulla Cross-Origin Storage -rajapinnalla Transformers.jsissä

Transformers.js kohtaa välimuistiongelman: kun samaa tekoälymallia tai Wasm-ajoympäristöä käytetään eri verkkosivustoilla, selain lataa ja tallentaa ne toistuvasti välimuistiin alkuperäpohjaisen välimuistieristyksen vuoksi. Ehdotettu Cross-Origin Storage (COS) -rajapinta ratkaisee tämän tunnistamalla tiedostot kryptografisen hajautusarvon eikä URL-osoitteen perusteella, mikä mahdollistaa resurssien turvallisen jakamisen eri alkuperien välillä.

Hugging FaceHugging Face
Hugging Face blog27.07 · 21:04

Monday.com liittyy teknologiafirmoihin, jotka syyttävät tekoälyä irtisanomisista – 20 uutta esimerkkiä

Monday.com irtisanoo 20% työvoimastaan (yli 600 henkilöä) osana uudelleenjärjestelyä vedoten siirtymään kohti tekoälyvetoista kasvustrategiaa. Financial Timesin mukaan yhdysvaltalaiset IT-yritykset ovat vähentäneet lähes 140 000 työpaikkaa vuoden alusta, ja Amazon, Oracle, Meta ja Microsoft vastaavat yksinään lähes 50 000:sta. Markkinat suhtautuvat kuitenkin epäillen tällaisiin selityksiin: tekoälyyn vedonneiden yritysten osakkeet ovat alittaneet Nasdaqin 10 prosentilla.

monday.commonday.com MicrosoftMicrosoft OracleOracle GitLabGitLab Google/DeepMindGoogle/DeepMind IntuitIntuit MetaMeta Cisco SystemsCisco Systems CloudflareCloudflare General MotorsGeneral Motors CoinbaseCoinbase PayPalPayPal SnapSnap IBMIBM AtlassianAtlassian DellDell BlockBlock SalesforceSalesforce Amazon/AWSAmazon/AWS AnthropicAnthropic OpenAIOpenAI
TechCrunch AI27.07 · 21:02
Tutkimus 🇷🇺

Decoder-Only Transformerin rakentaminen LLM:lle tyhjästä Pythonilla

Artikkelisarjan kirjoittaja kuvaa yksityiskohtaisesti pienen decoder-only-LLM:n transformer-lohkon toteutusta PyTorch-kehyksellä. Käsiteltäviä komponentteja ovat: Multi-Head Attention maskauksella, Feed Forward Network GELU-aktivaatiolla, normalisointikerros ja residuaaliyhteydet. Artikkeli selittää eron alkuperäiseen arkkitehtuuriin: koulutuksen vakauden vuoksi käytetään esinormalisointia (Pre-LN) jälkinormalisoinnin sijaan.

Google/DeepMindGoogle/DeepMind OpenAIOpenAI MetaMeta
Habr — хаб NLP27.07 · 20:04
Tutkimus 🇺🇸

Maailman ensimmäinen keskustelujärjestelmä kykeni muuttamaan persoonallisuuksia: ELIZA-koodi paljastaa uusia salaisuuksia

Äskettäin löydetty ELIZA-chatbotin, historian ensimmäisen keskustelubotin, lähdekoodi osoittaa, että ohjelma oli paljon monimutkaisempi kuin aiemmin on ajateltu. ELIZA ei ainoastaan matkinut psykoterapeuttia, vaan se oli alusta useille "persoonallisuuksille" (skripteille), pystyi muokkaamaan skriptejä ja muistamaan kontekstin. Tämä muuttaa käsitystä varhaisen tekoälyn kehityksestä.

MITMIT
IEEE Spectrum AI27.07 · 20:04
Tuoreet uutiset