Amazon Bedrock introduceert expliciete prompt caching voor OpenAI GPT-5.6 modellen
OpenAI
Amazon Web Services
OpenAI GPT-5.6 Sol, Terra en Luna zijn nu algemeen beschikbaar op Amazon Bedrock, met drie capaciteitsniveaus. De release introduceert ook expliciete prompt caching, waarmee precieze controle over gecachede promptgedeelten mogelijk is, met een 90% korting voor gecachede invoer.
Amazon Bedrock heeft de algemene beschikbaarheid aangekondigd van OpenAI GPT-5.6-modellen, waaronder Sol, Terra en Luna. De modellen zijn toegankelijk via de OpenAI-compatibele Responses API op het bedrock-mantle-eindpunt. Een belangrijke nieuwe functie is expliciete prompt-caching, waarbij gebruikers cache-grenzen kunnen markeren; gecachte invoer wordt gefactureerd met een korting van 90% en is 30 minuten beschikbaar. Impliciete caching is standaard ingeschakeld. GPT-5.6 ondersteunt redeneerinspanning van 'geen' tot 'xhigh', functieaanroepen en gestructureerde JSON-uitvoer. De modellen bieden betalen-per-token-prijzen met AWS-beveiliging en -governance. GPT-5.6 Sol is ontworpen voor complex redeneren, Terra voor gebalanceerde workloads en Luna voor taken met een hoog volume. De expliciete caching-functie is vooral gunstig voor agentische workflows met herhaalde systeeminstructies en tooldefinities.
Bron: AWS ML blog —
origineel
