Baseten schließt sich den Hugging-Face-Inference-Anbietern an und bietet Zugang zu modernsten Modellen
Baseten
Moonshot AI
DeepSeek
Baseten ist jetzt ein unterstützter Inference-Anbieter auf dem Hugging-Face-Hub und erweitert damit die serverlosen Inferenzmöglichkeiten. Die Integration ermöglicht den Zugriff auf beliebte Open-Weight-LLMs wie Kimi K3, DeepSeek V4 Flash und GLM-5.2 direkt von Modellseiten und Client-SDKs aus. Nutzer können zwischen direkter Abrechnung über den Anbieter oder weitergeleiteter Abrechnung über Hugging Face wählen.
Baseten ist nun ein unterstützter Inference-Anbieter im Hugging Face Hub und schließt sich damit dem Ökosystem der serverlosen Inference-Anbieter an. Diese Integration ermöglicht es Entwicklern, direkt von Hugging-Face-Modellseiten sowie über Client-SDKs (Python und JavaScript) auf von Baseten gehostete Modelle zuzugreifen. Zunächst unterstützt Baseten Konversations- und Textgenerierungsaufgaben und bietet Zugriff auf Modelle wie Kimi K3, DeepSeek V4 Flash und GLM-5.2. Nutzer können entweder ihren eigenen Baseten-API-Schlüssel für direkte Anfragen verwenden oder Anfragen über Hugging Face routen, wobei das HF-Konto des Nutzers belastet wird. PRO-Nutzer erhalten monatlich 2 US-Dollar an Inference-Guthaben. Die Integration ist auch in verschiedenen Agent-Harnesses wie Pi, OpenCode, Hermes Agents und OpenClaw verfügbar.
Quelle: Hugging Face blog —
Original
