Thứ Tư, 2 thg 9, 2026
Cập nhật: Claude Fable 5.1 đạt 1.765 điểm, dẫn đầu Code Arena WebDev với cách biệt 77 điểm
Models1 ngày trước1/43GitHub Copilot hiện đã hỗ trợ mô hình Claude Fable 5.1 của Anthropic cho các tác vụ lập trình dài hạn và workflow dạng agent. Với 1.765 điểm, mô hình này đứng đầu benchmark Code Arena: WebDev, vượt Qwen3.8 Max tới 77 điểm và nhảy vọt từ vị trí thứ 8 của phiên bản Fable 5 lên dẫn đầu. Mức giá blended cho mô hình này là 40 USD mỗi triệu token, giúp giảm 25% chi phí cho các khối lượng công việc thông thường.
Khả năng vision của Fable 5.1 cũng được cải thiện đáng kể trong việc nhận diện vật thể và phân tích bảng biểu trên ParseBench so với thế hệ trước. Mô hình đạt 52,6% trên benchmark Terminal Bench Science 0.1, cao hơn gấp đôi so với Fable 5, trong khi chi phí OCR tài liệu chỉ còn 15 cent mỗi trang. Ngoài ra, tính năng Enterprise Frontier Safeguards mới cho phép khách hàng đủ điều kiện lưu trữ dữ liệu hoạt động ngay trên hạ tầng cloud riêng của họ để đảm bảo quyền riêng tư.