Các nhà nghiên cứu đã dùng reinforcement learning để huấn luyện một mô hình thị giác quy mô nhỏ có khả năng xác định vị trí trên bản đồ số. Mô hình VLM 4 tỷ tham số này đã đánh bại cả Qwen 3.5 122B và G...

Đăng nhập để góp ý, chỉnh sửa
Bản Markdown