Cantina Security hợp tác với Yeta Labs ra mắt apex-flash-1, một mô hình open-weights được huấn luyện chuyên biệt cho công tác nghiên cứu lỗ hổng bảo mật. Đây là một bản fine-tune bằng reinforcement learning dựa trên mô hình GLM-5.3-Flash của Z.ai, được phát hành trên Hugging Face theo giấy phép MIT. Liệu mô hình này có triển khai được không? Câu trả lời là có, trọng lượng theo giấy phép MIT chạy tốt trên vLLM, SGLang hoặc Transformers, nhưng định dạng BF16 đòi hỏi khoảng 640 GB bộ nhớ GPU. […] Bài viết Can an Open Model Do Security Research? Cantina’s apex-flash-1 Solves 40 of 60 Held-Out Bug Tasks xuất hiện lần đầu trên MarkTechPost.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCEmarktechpost.com
Bản Markdown