Nous Research cùng các nhà cung cấp API khác đang cho phép dùng thử miễn phí Ox Alpha trong thời gian giới hạn. Đây là mô hình reasoning đa phương thức được thiết kế riêng cho kỹ thuật phần mềm và các tác vụ sản xuất dài hạn. Mô hình sở hữu context window lên tới 1 triệu token, hỗ trợ đầu vào là văn bản, hình ảnh, video và có thể xuất ra tối đa khoảng 131.000 token mỗi phản hồi. Theo Nous Portal, công suất xử lý của mô hình đạt mức 1 triệu tỷ token mỗi ngày, dù một số chuyên gia vẫn còn nghi vấn về tính xác thực của con số này.

Các thử nghiệm ban đầu cho thấy Ox Alpha có khả năng tạo ra các cảnh 3D Three.js phức tạp chỉ trong một lần phản hồi với hơn 64.000 token mà không cần tài nguyên bên ngoài. Trên tập dữ liệu DeepSWE, mô hình đạt tỷ lệ thành công 80%, vượt qua Fable (65%) và Sol (52%). Giới quan sát thị trường đang đồn đoán rằng bản phát hành âm thầm này thực chất là GLM 5.3...

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@teknium“capacity for 1 quadrillion tokens per day”x.com
  2. SUPPORT@rohanpaul_ai“One prompt, 64,745 output tokens, and no external assets: Ox Alpha generated the code for an entire Three.js dreamcore 3D scene/world in a single shot”x.com
  3. SUPPORT@teortaxestex“The 100T/day promise (unsubstantiated so far afaik) is lowkey genius”x.com
  4. SUPPORT@teortaxestex“it does not take a lot of intelligence to perform SWE work at a superhuman level”x.com
  5. SUPPORT@alexatallah“$ ori [your fav harness] --model stealth/ox-alpha”x.com
  6. SUPPORT@askvenice“This is an experimental release. Ox Alpha is free for all users.”x.com
  7. SUPPORT@cline“Early benchmarks shows marginal improvement over Fable and GPT.”x.com
  8. SUPPORT@nousresearch“We have capacity for 1 quadrillion tokens per day.”x.com
Bản Markdown