Novo modelo Flash da DeepSeek iguala OpenAI GPT-5.6 Luna com custos cerca de 60% menores
DeepSeek
OpenAI
A DeepSeek lançou o modelo econômico V4 Flash "0731", que obteve 50 pontos no índice Artificial Analysis Intelligence, dez a mais que a versão anterior V4 Flash. O modelo fica apenas um ponto atrás do modelo econômico da OpenAI, GPT-5.6 Luna, mas custa cerca de 60% menos por tarefa, graças a um desconto de 98% em cache. As melhorias são especialmente visíveis em tarefas de agente: no benchmark GDPval, a pontuação subiu de 1189 para 1559 pontos Elo, e as alucinações diminuíram.
A DeepSeek lançou um novo modelo econômico, o V4 Flash "0731", que pontua 50 pontos no índice de Inteligência da Artificial Analysis, dez pontos a mais que a versão anterior lançada em abril de 2026. Isso é apenas um ponto a menos que o modelo econômico da OpenAI, o GPT-5.6 Luna, enquanto o custo por tarefa é cerca de 60% menor, mesmo considerando o corte de 80% no preço da OpenAI. O fator-chave é o desconto de 98% no cache da DeepSeek, significativamente maior que a média da indústria de 90%. O modelo também consome doze por cento menos tokens que seu predecessor. As melhorias abrangem todas as categorias de teste, especialmente tarefas agentivas: no benchmark GDPval, que mede trabalho de escritório complexo do mundo real, a pontuação subiu de 1189 para 1559 pontos Elo, e a taxa de alucinação diminuiu. A arquitetura permanece inalterada: 284 bilhões de parâmetros, dos quais 13 bilhões são ativos, com uma janela de contexto de um milhão de tokens. Os pesos do modelo são distribuídos sob a licença MIT no Hugging Face.
Fonte: The Decoder (DE) —
original
