Affaires et MarchéModèles 🇷🇺 07.08.2026 15:03

Turbo Cloud présente les premiers résultats de ses nouveaux modèles d'IA : contexte de un million de jetons et 753 milliards de paramètres

DeepSeekDeepSeek Alibaba/QwenAlibaba/Qwen
Le fournisseur de cloud russe Turbo Cloud, qui fait partie du groupe RTK-DATA, a enrichi son Foundation Model Hub avec des modèles d'IA de nouvelle génération. Une semaine après la sortie de DeepSeek-V4-Flash-0731 et de GLM 5.2, l'entreprise fait état d'un intérêt constant de la part des développeurs et des utilisateurs professionnels. Le catalogue comprend également deux modèles Qwen couvrant un large éventail de besoins des entreprises.
Le fournisseur cloud russe Turbo Cloud, qui fait partie du groupe RTK-DATA, a enrichi sa plateforme Foundation Model Hub avec de nouveaux modèles d'IA de dernière génération. Une semaine après l'apparition sur la plateforme des modèles DeepSeek-V4-Flash-0731 et GLM 5.2, l'entreprise observe un intérêt constant de la part des développeurs et des utilisateurs professionnels. DeepSeek-V4-Flash-0731 excelle dans les tâches gourmandes en ressources nécessitant rapidité, précision et capacité à gérer un contexte géant : son contexte d'un million de jetons permet d'analyser en une seule passe de grands ensembles de documents, des référentiels de code ou des bases de connaissances hétérogènes, tandis que l'architecture mise à jour améliore le traitement du texte et la génération de code, y compris les scénarios agentiques en plusieurs étapes. GLM 5.2 cible les charges de travail d'ingénierie et d'analyse complexes, allant du raisonnement et des calculs en plusieurs étapes à la construction de systèmes d'agents autonomes ; ses poids ouverts le rendent prisé dans les projets nécessitant une personnalisation et un audit approfondis. Le catalogue comprend également deux modèles Qwen : Qwen3.6-35B-A3B avec 35 milliards de paramètres et un contexte allant jusqu'à 262 000 jetons, qui traite le texte et les images pour des tâches professionnelles typiques telles que la génération de contenu, la recherche dans les bases internes et l'automatisation des tâches courantes, et Qwen3.5-122B-A10B avec 122 milliards de paramètres pour des scénarios d'entreprise plus lourds tels que le traitement de grands volumes de documents, l'analyse et les assistants IA avancés. Tous les modèles sont fournis via une API unifiée compatible OpenAI, ce qui permet de basculer sans modification de code ; l'intégration ne nécessite pas de déployer sa propre infrastructure GPU, et une gestion flexible des clés ainsi que des limites de consommation configurables (quotidiennes, hebdomadaires, mensuelles) permettent aux équipes de contrôler l'utilisation des ressources. Le paiement se fait selon un modèle de paiement à l'utilisation, ne facturant que les jetons réellement traités.
Source: CNews — original
Nos articles précédents sur ce sujet ↓
Infos fraîches