DeepSeek의 새로운 Flash 모델, 약 60% 낮은 비용으로 OpenAI GPT-5.6 Luna와 동급 성능
DeepSeek
OpenAI
DeepSeek는 예산형 모델 V4 Flash "0731"을 출시했으며, 이 모델은 Artificial Analysis Intelligence 지수에서 50점을 기록하여 이전 버전인 V4 Flash보다 10점 높습니다. 이 모델은 OpenAI의 예산형 모델 GPT-5.6 Luna보다 단 1점 낮지만, 캐시 98% 할인 덕분에 작업당 비용이 약 60% 저렴합니다. 개선 사항은 특히 에이전트 작업에서 두드러지며, GDPval 벤치마크에서 1189에서 1559 Elo 포인트로 상승했고 환각 현상도 줄었습니다.
DeepSeek가 새로운 보급형 모델 V4 Flash "0731"을 출시했는데, Artificial Analysis Intelligence 지수에서 50점을 기록하여 2026년 4월에 출시된 이전 버전보다 10점 높습니다. 이는 OpenAI의 보급형 모델 GPT-5.6 Luna보다 단 1점 낮은 수준이며, 작업당 비용은 OpenAI의 80% 가격 인하를 감안하더라도 약 60% 더 낮습니다. 핵심 요인은 DeepSeek의 98% 캐시 할인율로, 업계 평균인 90%보다 상당히 높습니다. 이 모델은 또한 이전 모델보다 토큰 소비가 12% 적습니다. 개선 사항은 모든 테스트 범주에 걸쳐 있으며, 특히 에이전트 작업에서 두드러집니다. 복잡한 실제 사무 작업을 측정하는 GDPval 벤치마크에서 점수가 1189 Elo에서 1559 Elo로 상승했고, 환각 발생률은 감소했습니다. 아키텍처는 변경되지 않았습니다: 2840억 개의 파라미터 중 130억 개가 활성화되며, 컨텍스트 창은 100만 토큰입니다. 모델의 가중치는 Hugging Face에 MIT 라이선스로 배포됩니다.
출처: The Decoder (DE) —
원문
