Amazon Bedrock introduce el almacenamiento explícito en caché de mensajes para los modelos OpenAI GPT-5.6
OpenAI
Amazon Web Services
Los modelos OpenAI GPT-5.6 Sol, Terra y Luna ya están disponibles de forma general en Amazon Bedrock, ofreciendo tres niveles de capacidad. El lanzamiento también introduce el almacenamiento explícito en caché de mensajes, que permite un control preciso sobre las partes del mensaje almacenadas en caché con un descuento del 90% para las entradas en caché.
Amazon Bedrock ha anunciado la disponibilidad general de los modelos OpenAI GPT-5.6, que incluyen Sol, Terra y Luna. Los modelos son accesibles a través de la API compatible con OpenAI Responses en el endpoint bedrock-mantle. Una nueva característica clave es el almacenamiento en caché explícito de indicaciones, donde los usuarios pueden marcar límites de caché, con entradas almacenadas en caché facturadas con un descuento del 90% y disponibles durante 30 minutos. El almacenamiento en caché implícito está habilitado de forma predeterminada. GPT-5.6 admite niveles de esfuerzo de razonamiento desde ninguno hasta xhigh, llamadas a funciones y salida JSON estructurada. Los modelos ofrecen precios por token con la seguridad y gobernanza de AWS. GPT-5.6 Sol está diseñado para razonamiento complejo, Terra para cargas de trabajo equilibradas y Luna para tareas de alto volumen. La característica de almacenamiento en caché explícito es particularmente beneficiosa para flujos de trabajo agentivos con instrucciones de sistema repetidas y definiciones de herramientas.
Fuente: AWS ML blog —
original
