Bản phát hành AI mới nhất của Anthropic đã vượt trội hơn một mô hình đối thủ trong bài kiểm tra trí tuệ tổng hợp. Claude Opus 5.5 giành vị trí đầu tiên trên Epoch Capabilities Index (ECI) với điểm số 167, vượt trội chặt chẽ mô hình GPT-6 Astra từ OpenAI.

GPT-6 Astra duy trì lĩnh đạo trong toán học với 170 điểm so với 168 của Opus, nhưng Opus dẫn trước trong kỹ thuật phần mềm với 167 so với 165 của Astra. Mô hình trung cỡ của Anthropic, Claude Sonnet 5.5, đạt điểm tương đương khoảng 165 như trong mô hình lớn Claude Fable 5.1. Dữ liệu chỉ số cho thấy Opus và Sonnet 5.5 mất dưới 1 điểm ECI khi chuyển từ nhiệm vụ chung sang kỹ thuật phần mềm, trong khi điểm số của Astra giảm khoảng 2 điểm.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCEhuggingnewshuggingnews.com
Bản Markdown