GitHub Copilot hiện đã hỗ trợ mô hình Claude Fable 5.1 của Anthropic cho các tác vụ lập trình dài hạn và workflow dạng agent. Với 1.765 điểm, mô hình này đứng đầu benchmark Code Arena: WebDev, vượt Qwen3.8 Max tới 77 điểm và nhảy vọt từ vị trí thứ 8 của phiên bản Fable 5 lên dẫn đầu. Mức giá blended cho mô hình này là 40 USD mỗi triệu token, giúp giảm 25% chi phí cho các khối lượng công việc thông thường.

Khả năng vision của Fable 5.1 cũng được cải thiện đáng kể trong việc nhận diện vật thể và phân tích bảng biểu trên ParseBench so với thế hệ trước. Mô hình đạt 52,6% trên benchmark Terminal Bench Science 0.1, cao hơn gấp đôi so với Fable 5, trong khi chi phí OCR tài liệu chỉ còn 15 cent mỗi trang. Ngoài ra, tính năng Enterprise Frontier Safeguards mới cho phép khách hàng đủ điều kiện lưu trữ dữ liệu hoạt động ngay trên hạ tầng cloud riêng của họ để đảm bảo quyền riêng tư.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@code“generally available in @code with GitHub Copilot”x.com
  2. SUPPORT@arena“blended $40/MToken”x.com
  3. SUPPORT@shayneredford“False positive Safeguards down 60-80% on bio/cyber”x.com
  4. SUPPORT@jerryjliu0“costs 15c a page”x.com
  5. SUPPORT@skalskip92“big gains in object detection and counting”x.com
  6. SOURCE@sarahzorah“the world’s most advanced models for coding and knowledge”x.com
  7. SUPPORT@btibor91“Mythos 5.1 produced protein binders with binding affinities 10 times higher than the best designs”x.com
  8. SUPPORT@wesroth“Detection requires Anthropic’s API”x.com
Bản Markdown