Amazon Bedrock introduz cache explícito de prompts para modelos OpenAI GPT-5.6
OpenAI
Amazon Web Services
OpenAI GPT-5.6 Sol, Terra e Luna agora estão geralmente disponíveis no Amazon Bedrock, oferecendo três níveis de capacidade. O lançamento também introduz cache explícito de prompts, permitindo controle preciso sobre partes de prompts em cache com 90% de desconto para entradas em cache.
A Amazon Bedrock anunciou a disponibilidade geral dos modelos OpenAI GPT-5.6, incluindo Sol, Terra e Luna. Os modelos são acessíveis por meio da API Responses compatível com OpenAI no endpoint bedrock-mantle. Um novo recurso importante é o cache explícito de prompts, onde os usuários podem marcar limites de cache, com entradas armazenadas em cache faturadas com desconto de 90% e disponíveis por 30 minutos. O cache implícito está habilitado por padrão. O GPT-5.6 suporta níveis de esforço de raciocínio de 'none' a 'xhigh', chamada de funções e saída JSON estruturada. Os modelos oferecem precificação por token com segurança e governança da AWS. O GPT-5.6 Sol é projetado para raciocínio complexo, Terra para cargas de trabalho equilibradas e Luna para tarefas de alto volume. O recurso de cache explícito é particularmente benéfico para fluxos de trabalho agênticos com instruções de sistema e definições de ferramentas repetidas.
Fonte: AWS ML blog —
original
