Mô hìnhTác tử 🇨🇳 27.07.2026 06:02

Ant Bailing phát hành mô hình suy luận kết hợp mới Ling-3.0-Flash

Ant Bailing vừa chính thức phát hành mô hình suy luận kết hợp (hybrid reasoning) thuần bản địa mới, Ling-3.0-Flash, với tổng số tham số 124B nhưng chỉ kích hoạt 5.1B mỗi lần tính toán. Mô hình này đạt hoặc vượt các mô hình lớn hơn 2-3 lần về khả năng suy luận, tuân theo hướng dẫn và xử lý ngữ cảnh dài, mang lại hiệu suất cao hơn. Mô hình có sẵn trên OpenRouter với một tuần miễn phí giới hạn trước khi được mở mã nguồn.
7月24日,安百灵发布Ling-3.0-Flash模型,总参数量124B,每步激活5.1B参数,性能与比其大2-3倍的模型相当,同时降低了计算成本。该模型专为智能体应用设计,拥有超过10,000个真实交互环境,并在自我纠错和长期规划方面有所改进。它采用混合注意力架构,KDA线性注意力与MLA层的比例为5:1,并将Lightning Attention升级为KDA以提升状态追踪能力。每个token的专家激活比例从1/32降至1/64,从而提高效率。工程改进方面,包括集群级缓存,可将首token延迟降低60-80%,以及用于稳定性的多智能体协作框架。
Nguồn: QbitAI 量子位 — bản gốc
Bài viết liên quan trước đây ↓
Tin mới