Thứ Hai, 24 thg 8, 2026
Liquid AI và Artificial Analysis ra mắt Pipette, bộ công cụ benchmarking mã nguồn mở đầu tiên cho di động
Nghiên cứu10 ngày trước1/15Trong đánh giá mới nhất từ Artificial Analysis phối hợp cùng Liquid AI, hai mô hình Nanbeige4.2-3B và LFM2.5-2.6B cùng đạt điểm thông minh trung bình cao nhất là 63 trên iPhone 17 Pro và Galaxy S26 Ultra. Để mô phỏng giới hạn bộ nhớ của thiết bị cầm tay, nhóm nghiên cứu đã giới hạn context window ở mức 16K token. Kết quả cho thấy LFM2.5-2.6B hoạt động hiệu quả hơn khi xử lý prompt 1.024 token chỉ mất 8 giây với 2,3 GB RAM, trong khi Nanbeige4.2-3B cần tới 21,4 giây và 4,0 GB.
Hợp tác này cũng giới thiệu Pipette, một bộ công cụ benchmarking mã nguồn mở đi kèm bộ dữ liệu công khai gồm 10.000 kết quả trên 35 loại mô hình và 4 dòng thiết bị khác nhau. Hiệu suất trên iPhone 17 Pro có sự chênh lệch rất lớn, với thời gian tạo nội dung end-to-end và mức chiếm dụng bộ nhớ tối đa dao động lần lượt từ 30 lần và 19 lần giữa các mô hình được thử nghiệm.