Người dùng đăng ký gói trả phí phát hiện ra giới hạn thực tế về lượng dữ liệu mà mô hình GPT 5.6 Sol có thể xử lý cùng lúc trên client Codex, dù trước đó đã có các bước cấu hình để đạt mức cao hơn. Các người dùng này báo cáo rằng giới hạn từ phía server chỉ nằm trong khoảng 360.000 đến 371.000 token, thấp hơn nhiều so với cửa sổ 1.050.000 token được công bố cho mô hình này. Một hướng dẫn từ Tibo Sottiaux từng chỉ người dùng cách chỉnh sửa file config.toml để mở khóa 1 triệu token lịch sử và mã nguồn.

Việc mở rộng ngữ cảnh sẽ khiến hạn mức sử dụng bị tiêu hao nhanh hơn, vì các token vượt quá giới hạn mặc định sẽ bị tính gấp đôi. Một số người dùng cho biết mức phạt này áp dụng cho bất kỳ token nào vượt quá ngưỡng 272.000. Thông thường, Codex sẽ tinh chỉnh các thiết lập ngữ cảnh mặc định để tối ưu hóa hiệu suất và chi phí, dù việc mở rộng cửa sổ ngữ cảnh sẽ giúp hệ thống ghi nhớ nội dung đầu ra tốt hơn.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@thsottiaux“GPT-5.6 Sol, for example, has a documented 1,050,000-token window”x.com
  2. SUPPORT@teknium“actual server-side max for codex subscriptions is just 360~K”x.com
  3. SUPPORT@teknium“371k is the actual absolute max”x.com
  4. SUPPORT@reach_vb“Tokens beyond the default context window count at 2x against your usage limits”x.com
  5. SUPPORT@kimmonismus“anything over 272k would consume usage limits at 2x the rate”x.com
Bản Markdown