Các nhà phát triển hiện đã có thể tiếp cận Muse Spark 1.3 qua Muse Code và Meta Model API, trong khi OpenCode cũng liệt kê mô hình này là miễn phí. Phiên bản xhigh phổ biến đạt 61 điểm trên Artificial Analysis Intelligence Index, ngang bằng với GPT-5.6 Sol, nhưng chi phí chỉ 0,55 USD mỗi tác vụ so với mức 0,95 USD của Sol. Đây là mô hình có chi phí thấp nhất trong nhóm đạt trên 59 điểm trên chỉ số này. Riêng phiên bản max đang trong giai đoạn xem trước giới hạn cho đối tác đạt 62 điểm.

Các chỉ số benchmark khác cho thấy DeepSWE tăng mạnh lên 75,4 từ mức 55,0, còn Terminal-bench 2.1 đạt 88,8, ngang với GPT-5.6 Sol. Điểm MRCR cho ngữ cảnh dài đạt 98,1, tăng vọt từ 55,5, tuy nhiên con số này đang vấp phải sự phản đối từ một nhà nghiên cứu. Người này cho rằng benchmark có thể bị overfitting và Muse Spark 1.3 không cho thấy sự vượt trội rõ rệt trong các bài kiểm tra ngữ cảnh dài khác.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@jilin_14“The leap from 1.0 to 1.3 is nothing short of a miracle”x.com
  2. SUPPORT@wesroth“from 55.0 to 75.4 on DeepSWE.”x.com
  3. SUPPORT@wesroth“And the limited-preview max version pushes that score to 62.”x.com
  4. SUPPORT@kimmonismus“Meta Muse Spark 1.3 is now free on OpenCode”x.com
  5. SUPPORT@eliebakouch“muse spark 1.3 doesn't seem to be better on other long context benchmarks => very likely benchmaxed on this specific task”x.com
  6. SOURCE@shishirpatil_“Muse Spark 1.3 is rolling out today with frontier performance almost too cheap to meter.”x.com
  7. SUPPORT@arthurmacwaters“impressive performance from muse spark 1.3, especially given it's a fraction of the cost of fable”x.com
  8. SUPPORT@artificialanlys“Meta's Muse Spark 1.3 (max), which is in limited preview for Meta's partners, scores 68 on the Artificial Analysis Coding Agent Index in the Muse Code harness, #2 behind only Claude Opus 5 (xhigh) in Claude Code.”x.com
Bản Markdown