---
format: "aidr-story-markdown/v1"
id: "01b8bd072db9d88b3991380e19eadcf63b7629eb9efe119ea1769cc8f338c013"
canonical_url: "https://aidr.today/01b8bd07?lang=vi"
title: "LeVJEPA đạt hiệu suất tương đương V-JEPA 2 nhưng tốn ít tài nguyên hơn 20 lần"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-08-29T05:37:48.000Z"
category: "Research"
topics: ["open-source","inference","video"]
source_urls: ["https://huggingnews.com/ai/levjepa-matches-v-jepa-2-with-20x-less-video-pretraining-compute-45862a44","https://x.com/lukaskuhn77/status/2093318310779613563","https://x.com/randall_balestr/status/2093322239529652671","https://x.com/askalphaxiv/status/2093525041296396351","https://x.com/ylecun/status/2093549515831701539"]
summary: "Phương pháp pretraining mới này thay thế các bộ mã hóa mục tiêu (target encoders) và cơ chế tái tạo bằng một bộ mã hóa duy nhất, được huấn luyện thông qua tính bất biến và SIGReg. Cách tiếp cận end-to-end này giúp đạt hiệu suất ngang ngửa V-JEPA 2 trong khi giảm chi phí tính toán từ 5,6 đến 20,8 lần. LeVJEPA sử dụng một công thức ổn định để duy trì khả năng hiểu về hình ảnh và chuyển động, ngay cả khi loại bỏ ngẫu nhiên tới 95% video token. Phương pháp này là mã nguồn mở, giúp loại bỏ nhu cầu về masked predictions, stop-gradients hay các lịch trình teacher-student phức tạp."
---

# LeVJEPA đạt hiệu suất tương đương V\-JEPA 2 nhưng tốn ít tài nguyên hơn 20 lần

> [Open the canonical story](<https://aidr.today/01b8bd07?lang=vi>)

**Published:** 2026-08-29T05:37:48.000Z
**Category:** Research
**Topics:** open\-source, inference, video

## Summary

Phương pháp pretraining mới này thay thế các bộ mã hóa mục tiêu \(target encoders\) và cơ chế tái tạo bằng một bộ mã hóa duy nhất, được huấn luyện thông qua tính bất biến và SIGReg\. Cách tiếp cận end\-to\-end này giúp đạt hiệu suất ngang ngửa V\-JEPA 2 trong khi giảm chi phí tính toán từ 5,6 đến 20,8 lần\. LeVJEPA sử dụng một công thức ổn định để duy trì khả năng hiểu về hình ảnh và chuyển động, ngay cả khi loại bỏ ngẫu nhiên tới 95% video token\. Phương pháp này là mã nguồn mở, giúp loại bỏ nhu cầu về masked predictions, stop\-gradients hay các lịch trình teacher\-student phức tạp\.

## Sources

- [Story source](<https://huggingnews.com/ai/levjepa-matches-v-jepa-2-with-20x-less-video-pretraining-compute-45862a44>)
- [Story source](<https://x.com/lukaskuhn77/status/2093318310779613563>)
- [Supporting source](<https://x.com/randall_balestr/status/2093322239529652671>)
- [Supporting source](<https://x.com/askalphaxiv/status/2093525041296396351>)
- [Supporting source](<https://x.com/ylecun/status/2093549515831701539>)

