ModelosNegócios e Mercado 🇺🇸 30.07.2026 20:03

Amazon Bedrock introduz cache explícito de prompts para modelos OpenAI GPT-5.6

OpenAIOpenAI Amazon Web ServicesAmazon Web Services
Os modelos OpenAI GPT-5.6 Sol, Terra e Luna agora estão geralmente disponíveis no Amazon Bedrock, oferecendo três níveis de capacidade. O lançamento também introduz cache explícito de prompts, permitindo controle preciso sobre as partes do prompt em cache com um desconto de 90% para entradas em cache.
A Amazon Bedrock anunciou a disponibilidade geral dos modelos OpenAI GPT-5.6, incluindo Sol, Terra e Luna. Os modelos são acessíveis por meio da API Responses compatível com OpenAI no endpoint bedrock-mantle. Um novo recurso importante é o cache explícito de prompts, onde os usuários podem marcar limites de cache, com entradas armazenadas em cache faturadas com desconto de 90% e disponíveis por 30 minutos. O cache implícito está habilitado por padrão. O GPT-5.6 suporta níveis de esforço de raciocínio de 'none' a 'xhigh', chamada de funções e saída JSON estruturada. Os modelos oferecem precificação por token com segurança e governança da AWS. O GPT-5.6 Sol é projetado para raciocínio complexo, Terra para cargas de trabalho equilibradas e Luna para tarefas de alto volume. O recurso de cache explícito é particularmente benéfico para fluxos de trabalho agênticos com instruções de sistema e definições de ferramentas repetidas.
Fonte: AWS ML blog — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas