Mô hình Flash mới của DeepSeek sánh ngang OpenAI GPT-5.6 Luna với chi phí thấp hơn khoảng 60%
DeepSeek
OpenAI
DeepSeek đã phát hành mô hình giá rẻ V4 Flash "0731", đạt 50 điểm trong chỉ số Artificial Analysis Intelligence, cao hơn mười điểm so với phiên bản V4 Flash trước đó. Mô hình này chỉ kém một điểm so với mô hình giá rẻ OpenAI GPT-5.6 Luna, nhưng có chi phí thấp hơn khoảng 60% cho mỗi tác vụ nhờ giảm giá 98% cho bộ nhớ đệm. Các cải thiện đặc biệt rõ rệt trong các tác vụ đại lý: trong benchmark GDPval, điểm số tăng từ 1189 lên 1559 điểm Elo, và tình trạng ảo giác cũng giảm bớt.
DeepSeek đã phát hành một mô hình giá rẻ mới, V4 Flash "0731", đạt 50 điểm trên chỉ số trí tuệ Artificial Analysis, nhiều hơn mười điểm so với phiên bản trước phát hành vào tháng 4 năm 2026. Điểm này chỉ kém một điểm so với mô hình giá rẻ GPT-5.6 Luna của OpenAI, trong khi chi phí cho mỗi tác vụ thấp hơn khoảng 60 phần trăm, ngay cả khi tính đến việc OpenAI đã giảm giá 80 phần trăm. Yếu tố quan trọng là mức chiết khấu bộ nhớ đệm 98 phần trăm của DeepSeek, cao hơn đáng kể so với mức trung bình của ngành là 90 phần trăm. Mô hình cũng tiêu thụ ít hơn mười hai phần trăm số token so với phiên bản tiền nhiệm. Các cải tiến bao phủ tất cả các hạng mục kiểm tra, đặc biệt là các tác vụ đại lý: trong điểm chuẩn GDPval, đo lường công việc văn phòng phức tạp trong thế giới thực, điểm số đã tăng từ 1189 lên 1559 điểm Elo, và tỷ lệ ảo giác giảm. Kiến trúc không thay đổi: 284 tỷ tham số, trong đó 13 tỷ hoạt động, với cửa sổ ngữ cảnh một triệu token. Trọng số của mô hình được phân phối theo giấy phép MIT trên Hugging Face.
Nguồn: The Decoder (DE) —
bản gốc
