Mallit 🇺🇸

Google DeepMind esittelee Gemini 3.6 Flash, 3.5 Flash-Lite ja 3.5 Flash Cyber -mallit

Google DeepMind ilmoitti kolmesta uudesta tekoälymallista: Gemini 3.6 Flash, 3.5 Flash-Lite ja erikoistunut 3.5 Flash Cyber. Nämä mallit pyrkivät tehostamaan toimintaa, vähentämään viivettä ja parantamaan suorituskykyä agenttimaisissa työnkuluissa. Gemini 3.6 Flash käyttää 17 prosenttia vähemmän tulostustunnuksia ja on edeltäjäänsä halvempi. 3.5 Flash-Lite on 3.5-sarjan nopein malli, kun taas 3.5 Flash Cyber on suunniteltu kyberturvallisuuteen.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 06:03
Sääntely 🇨🇳

Globaalin tekoälyn tulevaisuuden muotoilu yhdessä — Kiinan aloite antaa vahvan sysäyksen tekoälyn kehitykselle

Xinhuan erikoisraportissa korostetaan, että Kiina on esittänyt aloitteen, jonka tavoitteena on muotoilla yhdessä maailmanlaajuisen tekoälyn tulevaisuutta. Tämä aloite on suunniteltu antamaan vahva sysäys tekoälyn kehitykselle maailmanlaajuisesti ja edistämään kansainvälistä yhteistyötä ja koordinointia tällä alalla.

GNews ZH — 人工智能24.07 · 06:02
Mallit 🇺🇸

Self-Distilled Reasoning Amazon Nova -mallien hienosäätöön

Amazon on esitellyt Self-Distilled Reasoning (SDR) -menetelmän Amazon Nova 2 -mallien ohjattuun hienosäätöön (SFT). SDR luo päättelyketjuja (CoT) niitä vailla oleville tietojoukoille käyttämällä itse mallia. Tämä ratkaisee päättelyn tukahduttamisen ongelman ja vähentää katastrofaalista unohtamista, parantaen kohdesuorituskykyä säilyttäen samalla yleiset kyvyt.

Amazon Web ServicesAmazon Web Services
AWS ML blog24.07 · 05:06

Entinen Intelin toimitusjohtaja Pat Gelsinger haluaa elvyttää Mooren lain valon avulla

Inteliltä lähdön jälkeen Pat Gelsingeristä tuli pääomasijoitusyhtiö Playground Capitalin osakas, joka sijoittaa syväteknologiaan. Hän panostaa litografian startup-yrityksiin voittaakseen puolijohteiden fyysiset rajoitteet ja elvyttääkseen Mooren lain. Gelsinger uskoo, että edistyksen avain on parantaa litografian valonlähteitä, ja tukee xLight-yritystä.

ASMLASML NVIDIANVIDIA GroqGroq Cerebras SystemsCerebras Systems
Wired AI24.07 · 05:05
Tutkimus 🇺🇸

Simulaatio fyysiselle tekoälylle: katsaus

Datan kerääminen fyysiselle tekoälylle todellisessa maailmassa on hidasta, kallista ja riskialtista prosessia. Simulaatio mahdollistaa suurten fotorealistisen fyysisen datamäärien tuottamisen GPU-rinnakkaisuuden avulla. Tämä artikkeli tarkastelee suosittuja simulaatiomoottoreita: MuJoCo, MuJoCo Warp, NVIDIA Isaac Sim ja Isaac Lab, sekä uutta fysiikkamoottoria Newton, jonka ovat kehittäneet NVIDIA, Google DeepMind ja Disney Research.

NVIDIANVIDIA Google DeepMindGoogle DeepMind MuJoCoMuJoCo
Hugging Face blog24.07 · 05:05

MSI lanseeraa EdgeXpert MS-C931 -pienoissupertekoälytietokoneen NVIDIA DGX Sparkin pohjalta: yksityiskohtainen arvostelu

MSI on julkistanut EdgeXpert MS-C931 -nimisen kompaktin version NVIDIA DGX Sparkista (Project DIGITS), joka perustuu Grace Blackwell GB10 -järjestelmäpiiriin ja tarjoaa jopa 1000 TOPSia FP4-muodossa. Laite sisältää 128 Gt LPDDR5x-keskusmuistia, 4 Tt NVMe SSD -levyn, 10 GbE-liitännän ja valinnaisen 200 GbE ConnectX-7-verkkosovittimen klusterointia varten. Arvostelussa käsitellään suorituskykytestejä, virrankulutusta ja kyvykkyyttä suurten kielimallien käsittelyyn.

NVIDIANVIDIA Micro-Star International (MSI)Micro-Star International (MSI) RealtekRealtek MediaTekMediaTek
ServerNews24.07 · 05:05

Wistron avaa ensimmäisen Yhdysvaltain-tehtaansa NVIDIA-superpiireille Fort Worthissa

Taiwanilainen Wistron on avannut 324 000 neliöjalan tehtaan Texasissa valmistaakseen NVIDIA GB300 Grace Blackwell Ultra- ja Vera Rubin -superpiirejä. 700 miljoonan dollarin investointi on luonut yli 500 työpaikkaa, ja suunnitelmissa on palkata 1 000 työntekijää vuoden loppuun mennessä. Hanke on osa NVIDIA:n sitoutumista tekoälyinfrastruktuurin rakentamiseen Yhdysvalloissa.

NVIDIANVIDIA
NVIDIA blog24.07 · 05:04
Mallit 🇺🇸

Poolside julkaisee Laguna S 2.1 -mallin – avoimen painoarvon malli agenttipohjaiseen ohjelmointiin, joka ylittää painoluokkansa SWE-Bench Multilingual -testissä

Poolside julkaisi Laguna S 2.1 -mallin, jossa on 11,8 miljardia parametria ja 8 miljardia aktiivista parametria tokenia kohden. Se on suunniteltu agenttipohjaiseen ohjelmointiin. Se perustuu Mixture-of-Experts (MoE) -arkkitehtuuriin, tukee enintään 1 miljoonan tokenin kontekstia ja voi toimia yhdellä NVIDIA DGX Spark -laitteella. Laguna S 2.1 on ensimmäisellä sijalla avoimien mallien joukossa, joiden koko tunnetaan, Terminal-Bench 2.1 (70,2 %) ja SWE-Bench Multilingual (78,5 %) -testeissä, ja se päihittää monet suuremmat kilpailijat.

PoolsidePoolside DeepSeekDeepSeek NVIDIANVIDIA TencentTencent Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
MarkTechPost24.07 · 05:04
Sääntely 🇷🇺

USA:n valtiovarainministeriö uhkaa Kiinan tekoälyä pakotteilla, Nvidian toimitusjohtaja puolustaa avoimia malleja

Yhdysvaltain valtiovarainministeriön johtaja totesi, että hallinto harkitsee pakotteita kiinalaisia tekoälymalleja vastaan mahdollisen immateriaalioikeusvarkauden vuoksi. Nvidian toimitusjohtaja Jensen Huang vastasi, ettei kiinalaisia avoimia malleja pidä pelätä, koska ne vain lisäävät sirujen ja datakeskusten kysyntää.

NVIDIANVIDIA Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ24.07 · 05:03
Tuoreet uutiset