LLM 0.32rc2: Novo modelo padrão GPT-5.6 Luna e comando de endpoint openai
OpenAI
Google/DeepMind
Moonshot AI
LLM 0.32rc2 corrige um problema de dependência e introduz dois recursos: o GPT-5.6 Luna substitui o GPT-4o mini como modelo padrão, e um novo comando `llm openai endpoint` permite executar prompts em endpoints compatíveis com OpenAI arbitrários, sem configuração prévia.
O LLM 0.32rc2, lançado em 30 de julho de 2026, corrige um problema de dependência e adiciona dois recursos. O modelo padrão para usuários sem um padrão personalizado agora é o GPT-5.6 Luna, substituindo o GPT-4o mini. O Luna custa US$ 0,20 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída, em comparação com US$ 0,15/US$ 0,60 do GPT-4o mini. Os usuários podem voltar para o GPT-4o mini ou escolher o GPT-5 nano (US$ 0,05/US$ 0,40) por meio de comandos. O novo comando `llm openai endpoint` permite executar prompts, chats e listagens de modelos em qualquer endpoint compatível com OpenAI sem configuração prévia de modelo, e essas chamadas não são registradas. O recurso foi adicionado devido à falta de uma ferramenta de linha de comando para testar prompts em endpoints de imitação do Chat Completions da OpenAI. Ele pode ser usado por meio de uma linha única do uvx, por exemplo, com um modelo local do LM Studio.
Fonte: Simon Willison —
original
