Geschäft & MarktModelle 🇷🇺 07.08.2026 15:03

Turbo Cloud meldet erste Ergebnisse der neuen KI-Modelle: Million-Token-Kontext und 753 Milliarden Parameter

DeepSeekDeepSeek Alibaba/QwenAlibaba/Qwen
Der russische Cloud-Anbieter Turbo Cloud, Teil der RTK-DATA-Gruppe, hat seinen Foundation Model Hub um KI-Modelle der neuen Generation erweitert. Eine Woche nach der Veröffentlichung von DeepSeek-V4-Flash-0731 und GLM 5.2 berichtet das Unternehmen von einem stetigen Interesse seitens Entwickler und Geschäftskunden. Der Katalog umfasst auch zwei Qwen-Modelle, die ein breites Spektrum an Unternehmensanforderungen abdecken.
Der russische Cloud-Anbieter Turbo Cloud, Teil der RTK-DATA-Gruppe, hat seinen Foundation Model Hub um aktuelle KI-Modelle der neuen Generation erweitert. Eine Woche nachdem die Modelle DeepSeek-V4-Flash-0731 und GLM 5.2 auf der Plattform erschienen sind, beobachtet das Unternehmen ein stetiges Interesse von Entwicklern und Geschäftskunden. DeepSeek-V4-Flash-0731 zeichnet sich durch ressourcenintensive Aufgaben aus, die Geschwindigkeit, Genauigkeit und die Fähigkeit erfordern, einen riesigen Kontext zu halten: Sein Kontext von einer Million Token ermöglicht die Analyse großer Dokumentationsbestände, Code-Repositories oder heterogener Wissensbasen in einem einzigen Durchgang, während die aktualisierte Architektur die Textverarbeitung und Code-Generierung verbessert, einschließlich mehrstufiger agentischer Szenarien. GLM 5.2 richtet sich an komplexe technische und analytische Arbeitslasten, von mehrstufigem Denken und Berechnungen bis hin zum Aufbau autonomer Agentensysteme; offene Gewichte machen es für Projekte attraktiv, die eine tiefe Anpassung und Prüfung erfordern. Der Katalog enthält auch zwei Qwen-Modelle: Qwen3.6-35B-A3B mit 35 Milliarden Parametern und einem Kontext von bis zu 262.000 Token, das mit Text und Bildern für typische Geschäftsaufgaben wie Inhaltsgenerierung, Suche in internen Basen und Routineautomatisierung arbeitet, sowie Qwen3.5-122B-A10B mit 122 Milliarden Parametern für anspruchsvollere Unternehmensszenarien wie die Verarbeitung großer Dokumentationsmengen, Analytik und fortschrittliche KI-Assistenten. Alle Modelle werden über eine einheitliche, OpenAI-kompatible API bereitgestellt, sodass ein Wechsel ohne Codeänderungen möglich ist. Die Integration erfordert keine eigene GPU-Infrastruktur, und ein flexibles Schlüsselmanagement sowie konfigurierbare Verbrauchsgrenzen (täglich, wöchentlich, monatlich) ermöglichen Teams die Kontrolle über die Ressourcennutzung. Die Bezahlung erfolgt nach einem Pay-as-you-go-Modell, wobei nur tatsächlich verarbeitete Token berechnet werden.
Quelle: CNews — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten