---
format: "aidr-story-markdown/v1"
id: "8554e7ebf3c683eb16e0e320179e779f4691a062558c5eea0bac93abe8dca186"
canonical_url: "https://aidr.today/8554e7eb?lang=vi"
title: "OpenAI giảm 94% thời gian tải đoạn chat dài trong bản nâng cấp hiệu năng lớn nhất cho Codex"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-08-15T08:44:18.000Z"
category: "Releases"
topics: ["OpenAI","performance","Codex","optimization"]
source_urls: ["https://huggingnews.com/ai/openai-cuts-long-chat-load-times-94percent-in-largest-performance-upgrad-0b585c9e","https://x.com/scaling01/status/2088474114382025096","https://x.com/i_dg23/status/2088515880032301083","https://x.com/kimmonismus/status/2088529353722270201"]
summary: "Tuần tới, OpenAI sẽ triển khai đợt đại tu hạ tầng cho ChatGPT và Codex, cho phép hệ thống chỉ tải những phần hội thoại cần thiết thay vì phải render toàn bộ lịch sử trò chuyện. Thử nghiệm nội bộ trên một luồng chat 741 lượt trao đổi nặng 231 MB cho thấy thời gian tải trung bình giảm mạnh từ 27,6 giây xuống còn 1,66 giây. Bản nâng cấp cũng giảm 41% lượng bộ nhớ tiêu thụ và cắt giảm số request cần gửi từ 894 xuống chỉ còn 16. Bằng cách giảm số mục hội thoại cần tải mỗi phiên từ 15.529 xuống còn 64, tình trạng giật lag và ngốn RAM khi cuộn trang đã được giải quyết triệt để. Kiến trúc mới này đồng thời đặt nền móng kỹ thuật cho các AI agent có thể vận hành liên tục trong thời gian dài."
---

# OpenAI giảm 94% thời gian tải đoạn chat dài trong bản nâng cấp hiệu năng lớn nhất cho Codex

> [Open the canonical story](<https://aidr.today/8554e7eb?lang=vi>)

**Published:** 2026-08-15T08:44:18.000Z
**Category:** Releases
**Topics:** OpenAI, performance, Codex, optimization

## Summary

Tuần tới, OpenAI sẽ triển khai đợt đại tu hạ tầng cho ChatGPT và Codex, cho phép hệ thống chỉ tải những phần hội thoại cần thiết thay vì phải render toàn bộ lịch sử trò chuyện\. Thử nghiệm nội bộ trên một luồng chat 741 lượt trao đổi nặng 231 MB cho thấy thời gian tải trung bình giảm mạnh từ 27,6 giây xuống còn 1,66 giây\. Bản nâng cấp cũng giảm 41% lượng bộ nhớ tiêu thụ và cắt giảm số request cần gửi từ 894 xuống chỉ còn 16\. Bằng cách giảm số mục hội thoại cần tải mỗi phiên từ 15\.529 xuống còn 64, tình trạng giật lag và ngốn RAM khi cuộn trang đã được giải quyết triệt để\. Kiến trúc mới này đồng thời đặt nền móng kỹ thuật cho các AI agent có thể vận hành liên tục trong thời gian dài\.

## Sources

- [Story source](<https://huggingnews.com/ai/openai-cuts-long-chat-load-times-94percent-in-largest-performance-upgrad-0b585c9e>)
- [Story source](<https://x.com/scaling01/status/2088474114382025096>)
- [Supporting source](<https://x.com/i_dg23/status/2088515880032301083>)
- [Supporting source](<https://x.com/kimmonismus/status/2088529353722270201>)

