⚡ TIN NÓNG
Opus 5 mới có giá chỉ bằng nửa Fable 5 nhưng mạnh hơn? Các bài kiểm tra gây bão mạng, người dùng sốc
Anthropic
Anthropic chính thức phát hành Opus 5, sánh ngang hoặc vượt trội Fable 5 ở nhiều chuẩn điểm chuẩn với giá chỉ bằng một nửa. Người dùng đã thử nghiệm khả năng của nó trong nhiều tác vụ sáng tạo và kỹ thuật, từ phát triển game đến mô hình 3D, nhiều người gọi nó là 'quái vật'.
Anthropic chính thức phát hành Opus 5, vượt qua Fable 5 ở nhiều benchmark khó với mức giá chỉ bằng một nửa. Trên Frontier-Bench, Opus 5 đánh bại mọi đối thủ, hơn gấp đôi hiệu suất của phiên bản tiền nhiệm Opus 4.8. Trên CursorBench ở mức nỗ lực cao nhất, nó chỉ thấp hơn 0,5% so với đỉnh cao của Fable 5. Người dùng báo cáo kết quả ấn tượng trong lập trình, mô hình 3D và phát triển game. Các bài kiểm tra đáng chú ý bao gồm bản sao Rocket League, cấu trúc tế bào 3D, cấu trúc tế bào 3D xoay 360 độ, mô phỏng đường hầm gió thời gian thực và bản sao Minecraft. Opus 5 cũng thể hiện mạnh mẽ trong thiết kế CAD và giáo dục. Trong một màn trình diễn tự xác minh, Opus 5 đã xây dựng lại mô hình 3D của Boeing 747 bằng cách trích xuất đường viền và đo 14 thông số cụ thể so với dữ liệu công khai, trong khi Fable 5 chỉ kiểm tra ảnh chụp màn hình bằng mắt thường. Giá của Opus 5 là 5 đô la mỗi triệu token đầu vào và 25 đô la mỗi triệu token đầu ra, bằng một nửa so với Fable 5. Trên ARC-AGI-3, Opus 5 đạt 30,2% so với 7,8% của GPT-4.5 Sol. Trên Human's Last Exam khi không có công cụ, Opus 5 đạt 56,3% so với 56,5% của Fable 5; với công cụ, Opus 5 đạt 64,7% so với 63,9% của Fable 5. Opus 5 cũng đạt điểm tuyệt đối trong Kỳ thi Olympic Toán học Quốc tế năm 2026 mà không cần công cụ bên ngoài. Ngoài ra, Anthropic đã giảm hơn 80% lời nhắc hệ thống của Claude Code mà không mất hiệu suất nhờ khả năng phán đoán cải thiện của Opus 5. Elon Musk đã đăng biểu đồ chi phí-hiệu suất FrontierCode chỉ cho thấy Grok 4.5 và Opus 5 nằm trên đường biên Pareto.
Nguồn: QbitAI 量子位 —
bản gốc
