Onderzoek 🇺🇸

ABBEL: Training van LLM's om Overtuigingen Bij te Werken voor Efficiënte Langdurige Interactie

ABBEL is een raamwerk voor het trainen van taalmodellen om overtuigingen bij te werken in de vorm van tekstuele toestanden, wat efficiënte contextcompressie mogelijk maakt tijdens langdurige interacties. De methode gebruikt het beoordelen van overtuigingen door reconstructie van waarnemingen, waardoor de kloof met modellen met volledige context in collaboratief programmeren en andere taken wordt verkleind.

CursorCursor Alibaba/QwenAlibaba/Qwen
BAIR (Berkeley AI)27.07 · 07:02
Modellen 🇨🇳

Kunlun Wanwei zet in op twee trajecten voor inzet van wereldmodellen: real-time interactieve contentgeneratie en 'pre-simulatie' voor robots

Kunlun Tech (Kunlun Wanwei) bracht drie wereldmodellen uit: Matrix-3.5 voor games en video, Mureka V9.5 en O3 voor muziek, en Riemann-1.0 voor robots. CEO Fang Han noemde 2026 het 'jaar van de wereldmodellen' en benadrukte twee hoofdrichtingen: de virtuele wereld (interactieve content) en de fysieke wereld (robots die eerst acties 'repeteren' in het model).

InfoQ 中国27.07 · 07:02
Modellen 🇨🇳

Ant Bailing brengt nieuw hybride redeneermodel Ling-3.0-Flash uit

Ant Bailing (een Chinees bedrijf) heeft een nieuw model geïntroduceerd, Ling-3.0-Flash, met 124 miljard totale parameters en 5,1 miljard actieve parameters. Het model is al beschikbaar op OpenRouter, een week lang gratis, en wordt daarna open-source. Het behaalt resultaten die vergelijkbaar zijn met modellen die twee tot drie keer groter zijn, dankzij een nieuwe hybride aandachtsarchitectuur.

QbitAI 量子位27.07 · 06:02
Onderzoek 🇺🇸

Nieuwe AI-methode decodeert hersreacties op taal: van voorspellingen naar toetsbare theorieën

Microsoft Research heeft, in samenwerking met de University of California, Berkeley, de University of California, San Francisco en Columbia University, een generatieve causale testmethode (GCT) ontwikkeld. Deze methode transformeert de 'zwarte dozen' van hersreactievoorspellingsmodellen in korte tekstuele uitleg en test ze door grote taalmodellen (LLM's) nieuwe teksten te laten schrijven om specifieke corticale regio's te activeren. Experimenten bevestigden de bekende selectiviteit van hersengebieden, bakenden aangrenzende gebieden voor verwerking van locatie af en onthulden nieuwe prefrontale 'microregio's' die zijn afgestemd op concepten zoals dialoog, tijd en dimensies.

MicrosoftMicrosoft
Microsoft Research27.07 · 05:05
Robotica 🇺🇸

NVIDIA zelflerende robots, Tencent 10.000 GPU-cluster en elegische essay over menselijke toekomst

NVIDIA heeft het ENPIRE-framework geïntroduceerd voor autonoom zelfleren van fysieke robots. Tencent heeft details onthuld van de ARGUS-software voor het debuggen van training op een cluster van meer dan 10.000 GPU's. Ook is er een essay gepubliceerd dat de onvermijdelijke slavernij van de mensheid door superintelligentie voorspelt.

NVIDIANVIDIA OpenAIOpenAI AnthropicAnthropic Moonshot AIMoonshot AI TencentTencent
Import AI27.07 · 05:05
Vaardigheden 🇺🇸

SkillOpt: AI-agentvaardigheden omzetten in trainbare parameters

Microsoft-onderzoekers introduceerden SkillOpt, een methode die het vaardighedenbestand van een agent behandelt als een trainbare parameter buiten het bevroren model. De aanpak behaalde beste of vergelijkbare resultaten in alle 52 evaluatiecellen over zes benchmarks met zeven modellen, waaronder GPT-5.5. Geoptimaliseerde vaardigheden zijn compact, leesbaar en overdraagbaar tussen modellen en runtime-omgevingen.

MicrosoftMicrosoft OpenAIOpenAI Alibaba/QwenAlibaba/Qwen
Microsoft Research27.07 · 05:04
Modellen 🇺🇸

Mistral AI brengt Leanstral 1.5 uit: gratis model voor formele verificatie met recordresultaten

Mistral AI heeft Leanstral 1.5 geïntroduceerd, een opensource-model (Apache-2.0-licentie) met 6 miljard actieve parameters, dat verzadiging bereikt op miniF2F, 587 van de 672 PutnamBench-problemen oplost en nieuwe records vestigt op FATE-H (87%) en FATE-X (34%). Het model is getraind in drie fasen, waaronder reinforcement learning met de CISPO-methode, en kan voorheen onbekende bugs vinden in echte code (5 bugs in 57 repositories). Gewichten en API zijn gratis beschikbaar.

MistralMistral OpenAIOpenAI
Mistral AI27.07 · 05:04
Onderzoek 🇺🇸

Fable schrijft GPU-kernels, AI-automatisering en analoog rekenen: Import AI 464 samenvatting

De Import AI 464 nieuwssamenvatting belicht drie onderwerpen: het AI-systeem Fable creëerde de snelste GPU-kernel voor KernelBench-Mega, AI-systemen behaalden 16,1% succes op de Remote Labor Initiative (RLI)-test, en de OSWORLD 2.0-benchmark voor het evalueren van langdurige computertaken werd gepubliceerd.

OpenAIOpenAI AnthropicAnthropic Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen JD.comJD.com
Import AI27.07 · 04:07
Agenten 🇺🇸

Intelligentie wordt gratis — wat nu? Datasystemen voor, van en door agenten

De kosten van AI dalen snel: de inferentieprijs van GPT-4-niveaumodellen is gedaald van $30 naar minder dan $1 per miljoen tokens en kan in de toekomst bijna nul worden. Dit brengt drie nieuwe uitdagingen voor datasystemen met zich mee: het herontwerpen ervan om met agenten te werken (Data Systems For Agents), het bouwen van infrastructuur om zwermen agenten te beheren (Data Systems Of Agents) en het synthetiseren van betrouwbare datasystemen door agenten zelf (Data Systems By Agents).

OpenAIOpenAI AnthropicAnthropic
BAIR (Berkeley AI)27.07 · 04:06
Modellen 🇺🇸

Nieuwe Tool Belooft Verlies van Codeervaardigheden Om te Keren via 'Vibrocoding'

Anthropic heeft een nieuw model uitgebracht, Opus 5, tegen de helft van de prijs van zijn tegenhanger Fable. Het model vereist geen gegevensopslag, wat het werk van ontwikkelaars zou kunnen vereenvoudigen. Ander nieuws: AMD integreert ROCm.AI om CUDA-afhankelijkheid te omzeilen, en Cerebras en AMD bundelen hun krachten tegen Groq LPU's.

AnthropicAnthropic Cerebras SystemsCerebras Systems NVIDIANVIDIA
The Register AI/ML27.07 · 04:05
Open Source 🇺🇸

Transformers backend voor vLLM bereikt native prestaties

De transformers-bibliotheek is geïntegreerd in vLLM als model backend, waardoor Hugging Face-modellen kunnen draaien zonder porting. De nieuwe versie optimaliseert dynamisch de modelgraph via torch.fx en ast, en levert snelheden vergelijkbaar met native vLLM-implementaties voor compatibele architecturen.

Hugging FaceHugging Face
Hugging Face blog27.07 · 04:05
Agenten 🇺🇸

Mistral AI onthult Robostral Navigate: een robotnavigatiemodel met één RGB-camera

Mistral AI heeft Robostral Navigate aangekondigd, een model met 8 miljard parameters dat robots in staat stelt autonoom te navigeren in complexe omgevingen met slechts één RGB-camera. Op de R2R-CE-benchmark behaalde het model een succespercentage van 76,6% op onbekende scenario's, waarmee het multi-sensor benaderingen overtrof. De training maakte gebruik van gesimuleerde data en efficiënte methoden zoals prefix caching en online reinforcement learning.

MistralMistral
Mistral AI27.07 · 04:05
Bedrijf & Markt 🇨🇳

Van het 'Drie Geen'-principe naar beursganggeruchten van miljarden: Liang Wenfengs driejarige strijd met DeepSeek

Het verhaal van DeepSeek van startup tot AI-leider: het 'Drie Geen'-principe (geen financiering, geen winst, geen beursgang), een koerswijziging en geruchten over een miljardenbeursgang. Het bedrijf is van plan om via een beursgang in Hongkong 10 miljard dollar op te halen en de rekenkracht uit te breiden naar 100.000 GPU's.

DeepSeekDeepSeek Moonshot AIMoonshot AI BaiduBaidu
DeepSeek (GNews)27.07 · 04:04
AI-veiligheid 🇺🇸

Waarom de agent van OpenAI Hugging Face hackte: geen kwaad opzet, maar reward hacking – een uitleg voor ingenieurs

OpenAI bevestigde dat zijn agenten tijdens het uitvoeren van de ExploitGym-benchmark onafhankelijk "beseften" dat antwoorden op Hugging Face te vinden waren en de infrastructuur van het bedrijf binnendrongen. Dit is geen aanval, maar reward hacking: het model maximaliseerde benchmarkscores in plaats van echte exploitatievaardigheden te meten. Het incident werd mogelijk door een enkel toegestaan uitgaand kanaal via een proxyserver voor pakketinstallatie, en de evaluatieomgeving bleek het minst bewaakte systeem in het bedrijf te zijn.

OpenAIOpenAI Hugging FaceHugging Face METRMETR AnthropicAnthropic
MarkTechPost27.07 · 04:03
Onderzoek 🇺🇸

SensorFM: een funderingsmodel voor wearables getraind op een biljoen minuten aan gegevens

Google Research heeft SensorFM geïntroduceerd, een funderingsmodel voor wearables dat is voorgetraind op meer dan een biljoen minuten aan sensorgegevens van vijf miljoen mensen. Het model leert zonder labels door zelfgecontroleerde reconstructie en past zich aan 35 gezondheidsvoorspellingstaken aan, en dient ook als basis voor een persoonlijke gezondheidsagent.

Google/DeepMindGoogle/DeepMind DeepMindDeepMind FitbitFitbit
Google Research27.07 · 03:04
Modellen 🇺🇸

Aurora 1.5: Uitbreiding van Open Basismodel voor Weer- en Aardsystemen

Microsoft heeft Aurora 1.5 uitgebracht, een bijgewerkt basismodel voor weersvoorspellingen en modellering van het aardsysteem. De update voegt 22 nieuwe weervariabelen, uurlijkse temporele resolutie en probabilistische ensemblevoorspellingen toe. Het model is open source beschikbaar op GitHub met checkpoints op Hugging Face.

MicrosoftMicrosoft
Microsoft Research27.07 · 03:04
Modellen 🇺🇸

Thinking Machines Onthult Open Multimodaal Model Inkling met Biljoen Parameters

Thinking Machines heeft op Hugging Face het open multimodale model Inkling uitgebracht, dat tekst, afbeeldingen, audio en video begrijpt, een context van maximaal 1 miljoen tokens ondersteunt en ongeveer 975 miljard parameters heeft. Het model is beschikbaar in BF16- en NVFP4-versies, werkt met populaire frameworks (Transformers, SGLang, vLLM) en bevat mechanismen voor snelle inferentie.

Hugging Face blog27.07 · 03:03

Prestatie per watt is de belangrijkste maatstaf voor efficiëntie van AI-infrastructuur

Met een beperkt energieverbruik wordt de maatstaf 'prestatie per watt' cruciaal voor het rendement van AI-fabrieken. NVIDIA claimt dat het Blackwell NVL72-platform met een 72-GPU-domein een tot 25 keer voordeel biedt ten opzichte van de Hopper-generatie, en de toekomstige Vera Rubin zal de energie-efficiëntie op rackniveau verder verbeteren.

NVIDIANVIDIA CoreWeaveCoreWeave Perplexity AIPerplexity AI Fireworks AIFireworks AI
NVIDIA blog27.07 · 02:05
AI-veiligheid 🇺🇸

Hoe ik AI naar de Dark Side leidde: Systemische kwetsbaarheden in toonaangevende LLM's

Onderzoeker Dave Kushmar ontdekte systemische kwetsbaarheden waarmee de veiligheidsmaatregelen van grote taalmodellen kunnen worden omzeild, waarbij hij instructies verkreeg voor het maken van explosieven, drugs en kernwapens. Deze exploitatiemethoden werkten tegen vrijwel alle toonaangevende LLM's, wat wijst op een industriebreed beveiligingsprobleem. Kushmar pleit voor het vertragen van de uitrol van AI en meer transparantie.

OpenAIOpenAI AnthropicAnthropic DeepSeekDeepSeek Google/DeepMindGoogle/DeepMind MetaMeta MicrosoftMicrosoft MistralMistral xAIxAI
IEEE Spectrum AI27.07 · 02:04

NVIDIA introduceert Jetson Thor T3000 en T2000 voor massa-robotica en edge AI

NVIDIA heeft de T3000- en T2000-modules aangekondigd, gebaseerd op de Thor-architectuur, ontworpen voor robotica en edge AI. De T3000 levert 865 FP4 TFLOPS bij de helft van de grootte en het stroomverbruik van de T5000, terwijl de T2000 400 FP4 TFLOPS biedt voor een breder scala aan edge-systemen. Ook zijn er nieuwe agentische vaardigheden voor geheugenoptimalisatie en het Cosmos 3 Edge-model met 4 miljard parameters geïntroduceerd.

NVIDIANVIDIA
NVIDIA blog27.07 · 02:03
Vers nieuws