Nunchaku Lite : inférence 4 bits des modèles de diffusion dans Diffusers

Nunchaku est une méthode de quantification SVDQuant (W4A4) pour les transformateurs de diffusion. La nouvelle intégration Nunchaku Lite permet de charger des points de contrôle quantifiés directement via from_pretrained() dans Diffusers, sans moteur séparé. La vitesse de génération augmente jusqu'à 1,8 fois, la consommation crête de VRAM diminue jusqu'à 50 %.

Hugging FaceHugging Face BaiduBaidu
Hugging Face blog24.07 · 02:04
Open Source 🇨🇳

Alibaba open-source sa pile IA SAIL : plus de 260 frameworks prêts à l'emploi

La division de développement de puces d'Alibaba, Ping Tou Ge, a annoncé l'open-source de sa plateforme logicielle IA propriétaire, T-Head SAIL. Cette pile, utilisée sur 560 000 puces de la série Zhenwu, couvre les couches allant des pilotes aux outils de développement et est compatible avec plus de 260 frameworks populaires, notamment PyTorch et TensorFlow. La solution vise à abaisser la barrière d'entrée pour les développeurs et à accélérer la migration depuis CUDA.

Alibaba/QwenAlibaba/Qwen
QbitAI 量子位24.07 · 02:03
Robotique 🇨🇳

WAIC 2026 : TARS et AWE 3.5 brisent les « eaux profondes » de l'industrie — robots travailleurs et simulateur physique intégré

L'entreprise chinoise TARS (它石智航) a présenté à WAIC 2026 une nouvelle version de son modèle embarqué AWE 3.5 — le premier modèle embarqué supportant le cycle complet du pré-entraînement au post-entraînement. La démonstration inclut de nombreuses tâches (assemblage, emballage, tri) réalisées par un seul modèle sans changement de paramètres, ainsi qu'un simulateur physique interactif pour l'apprentissage par renforcement dans un environnement virtuel.

QbitAI 量子位24.07 · 02:02

Anthropic publie la version bêta du plugin de sécurité Claude pour Claude Code – Scanner de vulnérabilités multi-agents pour le terminal

Anthropic a publié une version bêta du plugin de sécurité Claude pour Claude Code. Le plugin effectue une analyse de vulnérabilité multi-agents d'un référentiel directement dans une session Claude Code, puis transforme les résultats sélectionnés en correctifs que l'utilisateur peut examiner et appliquer manuellement. L'analyse peut couvrir l'ensemble du code source ou les modifications avant une validation.

AnthropicAnthropic
MarkTechPost24.07 · 01:04
Robotique 🇨🇳

1B paramètres vs π0 : une équipe chinoise domine le classement de l'intelligence incarnée avec un modèle léger

L'entreprise chinoise Youbot (优艾智合) avec son modèle FabriVLA à 1 milliard de paramètres a pris la première place du classement mondial Evo-SOTA pour l'intelligence incarnée, dépassant π0. Le modèle a atteint un taux de succès de 90 % sur le benchmark multitâche Meta-World MT50, prouvant que les architectures légères peuvent rivaliser avec les géantes. L'entreprise a ensuite présenté le système d'IA industriel FabriX et le robot humanoïde « 隙锋 » (Xifeng), conçus pour des tâches d'usine réelles.

QbitAI 量子位24.07 · 01:03
Open Source 🇺🇸

Gigatoken : tokeniseur BPE en Rust encode du texte à 24,53 Go/s, jusqu'à 989 fois plus rapide que les tokeniseurs HuggingFace

Marcel Roed, doctorant à Stanford, a publié Gigatoken, un tokeniseur BPE écrit en Rust avec des liaisons Python, atteignant des vitesses allant jusqu'à 24,53 Go/s sur un AMD EPYC à 144 cœurs, soit 989 fois plus rapide que les tokeniseurs HuggingFace et 681 fois plus rapide que tiktoken. L'accélération provient d'un pré-tokeniseur SWAR écrit à la main et de la mise en cache des pré-tokens.

OpenAIOpenAI Hugging FaceHugging Face Google/DeepMindGoogle/DeepMind MetaMeta Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Moonshot AIMoonshot AI NVIDIANVIDIA MicrosoftMicrosoft Allen Institute for AIAllen Institute for AI Answer.AIAnswer.AI MistralMistral
MarkTechPost24.07 · 01:03
Recherche 🇨🇳

Pourquoi les robots restent-ils bloqués dans les démos ? La nouvelle société iFlytek répond : manque de « conscience de soi »

Yao Fang Intelligence, une nouvelle société fondée par iFlytek, explique que le principal problème des robots n'est pas la vitesse mais le manque de « conscience de soi » (本体认知). Ils proposent leur propre architecture iFLYTEK-Embodied-Omni, qui intègre VLM, VGM et AGM pour surmonter les limites de VLA et compenser le manque de données réelles. L'architecture a déjà démontré des performances élevées sur des benchmarks incluant LIBERO-Plus et RoboTwin 2.0.

科大讯飞科大讯飞 NVIDIANVIDIA
QbitAI 量子位24.07 · 01:02
Modèles 🇺🇸

Un conseiller de la Maison-Blanche accuse la chinoise Moonshot d’avoir volé le modèle d’Anthropic, les experts sont sceptiques

Michael Kratsios, conseiller scientifique de la Maison-Blanche, a affirmé que l’entreprise chinoise Moonshot a copié le modèle Fable d’Anthropic pour créer son modèle Kimi K3, en utilisant des puces dont l’exportation vers la Chine est interdite. Cependant, les experts sont sceptiques face à cette accusation, notant que la distillation ne pourrait pas produire des résultats aussi rapides et puissants.

Moonshot AIMoonshot AI AnthropicAnthropic
TechCrunch AI24.07 · 01:02
Infos fraîches