Mô hình AI mới của Aleph Alpha, Kolibri, đã đạt được một thành tích đáng chú ý khi vượt mặt đối thủ Qwen trong kỳ thi AIME. Theo thông báo chính thức, Kolibri đạt được điểm số 96.9% trên AIME, một bằng chứng mạnh mẽ về khả năng suy luận và giải quyết vấn đề tối tượng cao của mô hình. Kết quả này cho thấy sự tiến bộ đáng kể của Kolibri so với các mô hình khác, bao gồm cả Qwen, trong việc xử lý các bài toán toán học phức tạp. AIME là một kỳ thi uy tín trong lĩnh vực toán học, nơi các mô hình AI được đánh giá dựa trên khả năng giải quyết các bài toán khó. Sự vượt trội của Kolibri tại AIME không chỉ là một cột mốc quan trọng cho Aleph Alpha mà còn cho thấy tiềm năng lớn của mô hình trong các tác vụ đòi hỏi tư duy logic và toán học.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@aleph__alpha“78B parameters. 3.46B active. Up to 1M tokens of context. Built in Europe.”x.com
  2. SUPPORT@testingcatalog“The Aleph Alpha team developed a bilingual German/English tokenizer and focused on including organic German data throughout the training process of the model, so that 21.3% of the pre-training tokens are German.”x.com
  3. SUPPORT@emollick“Europe's new “sovereign model” is fine-tuned on data generated by… GLM and Qwen”x.com
  4. SUPPORT@teortaxestex“Hybrid SWA, 3.46B active. Europe on the Pareto frontier indeed.”x.com
  5. SUPPORT@kimmonismus“In Aleph Alpha’s own evaluations, it scores 96.9% on AIME 2025 and 84.3% on GPQA Diamond. Its German overall score narrowly beats Qwen3.5 35B-A3B and GPT-OSS 120B.”x.com
  6. SOURCEmarketbrief.now
Bản Markdown