---
format: "aidr-story-markdown/v1"
id: "93b5bd18a62d3df4fc983c32dd0650f7edae8629401dddc23b942056ed26ef8e"
canonical_url: "https://aidr.today/93b5bd18?lang=vi"
title: "LLMs lặp lại 96% lỗi tự tin của JEV và làm suy yếu các vòng đánh giá"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-09-25T21:05:09.000Z"
category: "Research"
topics: ["llm"]
source_urls: ["https://marketbrief.now/ai/llms-repeat-96percent-of-jev-confident-errors-and-undermine-evaluation-c-16c162a3","https://huggingnews.com/ai/llms-repeat-96percent-of-jev-confident-errors-and-undermine-evaluation-c-16c162a3"]
summary: "Nghiên cứu mới cho thấy các mô hình LLM lớn đã lặp lại tới 96% số lỗi tự tin từ tập dữ liệu JEV, gây ra các vòng phản hồi sai lệch trong quá trình đánh giá. Điều này đặc biệt lo ngại vì nó có thể làm suy yếu đáng kể hiệu quả của các hệ thống đánh giá dựa trên AI."
---

# LLMs lặp lại 96% lỗi tự tin của JEV và làm suy yếu các vòng đánh giá

> [Open the canonical story](<https://aidr.today/93b5bd18?lang=vi>)

**Published:** 2026-09-25T21:05:09.000Z
**Category:** Research
**Topics:** llm

## Summary

Nghiên cứu mới cho thấy các mô hình LLM lớn đã lặp lại tới 96% số lỗi tự tin từ tập dữ liệu JEV, gây ra các vòng phản hồi sai lệch trong quá trình đánh giá\. Điều này đặc biệt lo ngại vì nó có thể làm suy yếu đáng kể hiệu quả của các hệ thống đánh giá dựa trên AI\.

## Sources

- [Story source](<https://marketbrief.now/ai/llms-repeat-96percent-of-jev-confident-errors-and-undermine-evaluation-c-16c162a3>)
- [Story source](<https://huggingnews.com/ai/llms-repeat-96percent-of-jev-confident-errors-and-undermine-evaluation-c-16c162a3>)

