Amazon Bedrock führt explizites Prompt-Caching für OpenAI GPT-5.6-Modelle ein
OpenAI
Amazon Web Services
OpenAI GPT-5.6 Sol, Terra und Luna sind jetzt auf Amazon Bedrock allgemein verfügbar und bieten drei Leistungsstufen. Die Veröffentlichung führt außerdem explizites Prompt-Caching ein, das eine präzise Kontrolle über die gecachten Prompt-Teile ermöglicht, mit einem Rabatt von 90 Prozent für gecachte Eingaben.
Amazon Bedrock hat die allgemeine Verfügbarkeit der OpenAI GPT-5.6-Modelle, darunter Sol, Terra und Luna, bekannt gegeben. Die Modelle sind über die OpenAI-kompatible Responses-API auf dem bedrock-mantle-Endpunkt zugänglich. Eine wichtige neue Funktion ist das explizite Prompt-Caching, bei dem Benutzer Cache-Grenzen markieren können, wobei gecachte Eingaben mit einem Rabatt von 90 % abgerechnet werden und 30 Minuten lang verfügbar sind. Implizites Caching ist standardmäßig aktiviert. GPT-5.6 unterstützt Reasoning-Aufwandsstufen von „none“ bis „xhigh“, Funktionsaufrufe und strukturierte JSON-Ausgabe. Die Modelle bieten eine nutzungsbasierte Preisgestaltung pro Token mit AWS-Sicherheit und Governance. GPT-5.6 Sol ist für komplexes Reasoning konzipiert, Terra für ausgewogene Arbeitslasten und Luna für Aufgaben mit hohem Volumen. Die explizite Caching-Funktion ist besonders vorteilhaft für agentische Workflows mit wiederholten Systemanweisungen und Werkzeugdefinitionen.
Quelle: AWS ML blog —
Original
