Fable viết nhân GPU, Tự động hóa AI và Máy tính tương tự: Bản tin Import AI số 464
OpenAI
Anthropic
Moonshot AI
MiniMax
Alibaba/Qwen
JD.com
Fable đã tạo ra mega-kernel nhanh nhất cho KernelBench-Mega, đạt tốc độ tăng gấp 18,71 lần. Các nhà nghiên cứu từ CAIS và Scale Labs đã ghi nhận tỷ lệ thành công của tác nhân AI trong công việc tự do trực tuyến tăng từ 2,5% (tháng 10 năm 2025) lên 16,1% (tháng 7 năm 2026). Chuẩn đánh giá OSWORLD 2.0 cho các tác vụ máy tính kéo dài (trung bình 1,6 giờ) đã được phát hành; kết quả tốt nhất là 20,6%. JD đã công bố thông tin chi tiết về hệ thống quản lý tồn kho Oxygen AIIC của mình, chạy trên các NPU Huawei Ascend.
Fable đã viết mega-kernel thực sự đầu tiên cho KernelBench-Mega, đạt tốc độ nhanh hơn 18,71 lần trên RTX PRO 6000 Blackwell so với baseline PyTorch. Đây là kết quả tốt nhất trong benchmark, trong khi Claude Opus 4.8 đạt 14,4 lần, GLM-5.2 đạt 11,14 lần, và GPT 5.5 đạt 4,34 lần. Giải pháp của Fable sử dụng một lần khởi chạy kernel hợp tác duy nhất cho mỗi token, khác với 4-14 lần khởi chạy của các đối thủ. Theo Chỉ số Lao động Từ xa, tỷ lệ thành công của các hệ thống AI trên nền tảng freelancing trực tuyến đã tăng từ 2,5% lên 16,1% trong 8 tháng; các mô hình tốt nhất tính đến tháng 7 năm 2026 là GPT-5.5 (6,3%), Opus 4.8 (8,3%) và Fable 5 (16,1%). Đánh giá bao gồm các tác vụ trong lĩnh vực 3D, thiết kế, video, âm thanh, phân tích dữ liệu và ứng dụng web. OSWORLD 2.0 chứa 108 tác vụ kéo dài (thời gian trung bình 1,6 giờ) sử dụng 31 trang web và phần mềm (Slack, LinkedIn, REAPER, AWS, v.v.). Tác nhân tốt nhất, Claude Opus 4.8, đạt độ chính xác 20,6%, còn xa mức con người. JD đã giới thiệu Trung tâm Vật phẩm AI Oxygen để quản lý hàng tồn kho (700 triệu người dùng, hàng tỷ mã SKU). Hệ thống sử dụng kỹ thuật bản thể học, tìm kiếm ngữ nghĩa, LLM/VLM tự học, và một đường hầm dữ liệu thống nhất. Mọi thứ đều chạy trên NPU Huawei Ascend.
Nguồn: Import AI —
bản gốc
