Modèles 🇨🇳

Les six petits dragons des modèles du monde en débat au WAIC : le dividende de l'industrie réside dans l'absence de consensus

Lors du forum WAIC, une discussion a réuni six entreprises travaillant sur les modèles du monde. Les responsables techniques ont divergé sur des questions clés : les modèles du monde doivent-ils viser la précision physique ou la plausibilité, quelles capacités sont les plus importantes, et quel sera le premier consensus dans l'industrie ? La transition des démonstrations au déploiement réel a également été abordée.

QbitAI 量子位24.07 · 12:02

AMD dévoile les puces X100 basées sur Zen 5 pour robots : fonctionnement 24h/24 et durée de vie de 10 ans

AMD a annoncé la série X100 de processeurs embarqués basés sur l'architecture Zen 5 avec des graphiques RDNA 3.5 et une unité de traitement neuronal XDNA 2 pour la robotique. Les puces sont conçues pour une durée de vie de 10 ans, ont une plage de TDP de 45 à 120 W et une plage de température de fonctionnement de -40 à 105 °C. Le modèle phare X199 avec 16 cœurs et 40 unités de calcul a démontré sa supériorité sur l'Intel Core Ultra lors des tests, bien que la comparaison ait été nuancée.

Intel CorporationIntel Corporation NVIDIANVIDIA
3DNews24.07 · 12:02

L'essor de l'IA devient plus coûteux : les taux des prêts pour la construction de centres de données augmentent

En raison de l'essor de l'intelligence artificielle, les géants américains de la technologie empruntent de plus en plus de fonds pour la construction de centres de données, mais les prêteurs augmentent les taux d'intérêt. Meta a récemment obtenu un financement à un taux supérieur à 7 %, soit 0,4 point de pourcentage de plus que l'année dernière, ce qui indique une préoccupation croissante des prêteurs quant à la rentabilité de tels projets.

MetaMeta AnthropicAnthropic BroadcomBroadcom
3DNews24.07 · 12:02
Recherche 🇨🇳

La société chinoise Jinghe Nengyuan dévoile le premier système de batterie intelligent bionique au monde

Lors de la conférence 2026 sur les systèmes thermiques automobiles, le président de l'entreprise et directeur de l'Institut de recherche avancée sur les batteries de l'Université Tsinghua, Li Yantao, a annoncé le premier système de batterie intelligent bionique au monde. Selon les données du projet, le système réduit le cycle de développement de plus de 60 %, diminue les coûts de recherche de plus de 50 %, améliore l'uniformité thermique de la batterie de 31 % et réduit la température maximale des cellules de 8 degrés Celsius.

36Kr24.07 · 12:02
Agents 🇨🇳

Android Studio Quail 2 Stable : prise en charge de multiples agents d'IA et débogage amélioré

La version stable d'Android Studio Quail 2 a été publiée, améliorant les capacités de l'agent d'IA Gemini : désormais plusieurs dialogues peuvent être exécutés en parallèle. L'IDE intègre l'outil LeakCanary pour détecter les fuites mémoire, et l'analyse des plantages a été améliorée. De plus, la fonctionnalité Studio Labs pour tester des fonctions d'IA expérimentales a été stabilisée.

Google/DeepMindGoogle/DeepMind
InfoQ 中国24.07 · 12:02

De la « course aux modèles » au « règlement de comptes » : à quoi ressemble désormais la concurrence dans l'industrie de l'IA — Réponses du WAIC 2026

Lors du WAIC 2026, les experts ont noté un changement de paradigme : l'industrie de l'IA passe de la démonstration des capacités des modèles à une comptabilité financière stricte (« règlement de comptes »). Trois domaines de coûts clés sont abordés : l'infrastructure (investissements totaux dépassant 700 milliards de dollars pour un chiffre d'affaires de seulement 50 milliards), l'inférence (coût par token divisé par 8 à 10, mais coûts totaux en hausse) et le capital (les investisseurs exigent une économie réelle). Les modèles restent importants, mais l'accent se déplace vers le produit, les capacités agentiques, l'infrastructure et les données de confiance.

AnthropicAnthropic Moonshot AIMoonshot AI
InfoQ 中国24.07 · 12:02

Google DeepMind dévoile Gemini 3.5 Flash Cyber, un modèle léger pour la cybersécurité

Google DeepMind a annoncé Gemini 3.5 Flash Cyber, un modèle spécialisé basé sur 3.5 Flash, affiné pour la recherche, la vérification et la correction de vulnérabilités. Le modèle sera disponible via un programme pilote limité destiné aux gouvernements et partenaires de confiance pour une atténuation proactive des vulnérabilités critiques.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 11:04

NVIDIA Vera Rubin : Intelligence maximale par dollar pour l'IA agentique

NVIDIA a présenté la plateforme Vera Rubin, conçue pour le post-entraînement continu des modèles d'IA agentiques. La métrique clé devient « l'intelligence par dollar », combinant le coût des tokens et l'efficacité de l'entraînement. La plateforme promet une réduction par quatre du nombre de GPU par rapport à Blackwell.

NVIDIANVIDIA Prime IntellectPrime Intellect Perplexity AIPerplexity AI Together AITogether AI
NVIDIA blog24.07 · 11:04
Agents 🇺🇸

Smartsheet construit un serveur MCP distant sur AWS pour intégrer des agents IA aux données d'entreprise

La plateforme de gestion du travail Smartsheet a construit un serveur MCP distant sur AWS, offrant aux agents IA un accès structuré aux données et fonctions. L'architecture comprend AWS Fargate, Amazon Bedrock et Neptune, prenant en charge à la fois les assistants IA internes (Smart Assist) et les clients externes (Amazon Quick, Claude Desktop). Des optimisations ont permis d'économiser plus de 3 milliards de tokens, et un système de gestion d'accès a été mis en place pour les clients entreprises.

SmartsheetSmartsheet Amazon Web ServicesAmazon Web Services AnthropicAnthropic
AWS ML blog24.07 · 11:04
Modèles 🇨🇳

Goldman Sachs évalue Kimi K3 : un modèle open-source chinois atteint le seuil d'« intelligence » pour un déploiement mondial, la concurrence dans les modèles haut de gamme s'intensifie

Les analystes de Goldman Sachs ont noté que le modèle Kimi K3 de Moonshot AI a atteint le niveau d'intelligence clé requis pour le déploiement mondial des modèles d'IA open-source. Parallèlement, la concurrence entre les modèles haut de gamme devient de plus en plus féroce.

Moonshot AIMoonshot AI
Moonshot Kimi (GNews)24.07 · 11:03
Modèles 🇺🇸

Claude intègre définitivement Fable 5 dans les abonnements Max et Team Premium

Anthropic inclut le modèle Fable 5 dans les abonnements Max et Team Premium de façon permanente à partir du 20 juillet 2026, avec des limites de 50 %. Les abonnements Pro et Team Standard recevront un crédit unique de 100 $. La concurrence de GPT-5.6 Sol et Kimi K3 a forcé Anthropic à abandonner ses projets de rendre Fable 5 disponible uniquement par API.

AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI
Simon Willison24.07 · 11:03

Après le lancement du modèle K3, Moonshot AI fait face à une pénurie de puissance de calcul — suspend l’inscription des nouveaux utilisateurs

La start-up chinoise d’IA Moonshot AI (Yue Zhi An Mian) a signalé une pénurie de ressources de calcul après avoir publié son nouveau modèle K3. En conséquence, l’entreprise a temporairement suspendu l’inscription des nouveaux utilisateurs du segment grand public (C-end) pour équilibrer la charge et garantir la stabilité du service.

Moonshot AIMoonshot AI
Moonshot Kimi (GNews)24.07 · 11:02
Recherche 🇷🇺

Les modèles de raisonnement ont besoin d'une nouvelle mesure : le classement public MERA Reason dévoilé

Le classement MERA Reason a été lancé pour évaluer les modèles de raisonnement en russe. Il comprend quatre ensembles de tâches : Luzitania (mathématiques de niveau olympiade), TMath (un large éventail de problèmes), MMReD (raisonnement contextuel dense) et un composant à venir. L'objectif est de mesurer objectivement la capacité d'un modèle à construire des chaînes de raisonnement, pas seulement à reproduire des connaissances.

Т-БанкТ-Банк Alibaba/QwenAlibaba/Qwen
Habr — хаб ИИ24.07 · 11:01

L’injection de prompt ne se guérit pas par des filtres : comment isoler le texte non fiable avec des motifs architecturaux

L’injection de prompt est un défaut structurel des grands modèles de langage où un texte non fiable est exécuté comme une instruction. Les filtres et les prompts système sont inefficaces : même les meilleures défenses sont contournées dans 90 % des cas lors d’attaques adaptatives. Les approches qui fonctionnent — Dual-LLM, CaMeL et la règle des Two Meta — construisent un isolement plutôt que d’essayer de distinguer le bien du mal.

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MicrosoftMicrosoft
Habr — хаб ИИ24.07 · 11:01
Infos fraîches