Mô hình trí tuệ nhân tạo mới nhất từ xAI, Grok 4.7, tập trung vào coding đa tác nhân và công việc tri thức chuyên nghiệp thông qua nền tảng Grok Build và API. Grok 4.7 sử dụng kiến trúc 2,1 nghìn tỷ tham số, đạt điểm 56 trên Artificial Analysis Coding Agent Index, xếp thứ tư sau Fable 5.1, GPT 6 Astra và Opus 5. Mô hình ghi nhận tỷ lệ thành công 38% trên Terminal Bench 4.0, tăng đáng kể so với 20,3% của Grok 4.6, cùng điểm số 19,6% trên Harvey Legal Agent Benchmark.

Grok 4.7 hỗ trợ cửa sổ ngữ cảnh 500.000 token với mức giá 2 USD cho 1 triệu token đầu vào và 6 USD cho 1 triệu token đầu ra. Dữ liệu hiệu suất từ Artificial Analysis cho thấy mô hình tiêu tốn 81.000 token đầu ra cho mỗi nhiệm vụ Intelligence Index, so với 36.000 của Grok 4.6. Đánh giá ban đầu bởi bộ chuẩn Vals cho điểm 54,2%, sau đó cải thiện lên vị trí thứ 10 trên Vals Index khi cập nhật SDK.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@coinmarketcap“Elon Musk calling it "a strong combination of intelligence, speed & low cost."”x.com
  2. SUPPORT@theo“Grok 4.7 doesn’t beat Sol. It doesn’t even best Grok 4.6 in many benchmarks.”x.com
  3. SUPPORT@theo“Grok 4.7 is much harder to forgive. They claimed it would be more token-efficient, and it's less by 30 to 80%.”x.com
  4. SOURCEmarketbrief.now
Bản Markdown