OpenAI đã thay mô hình mà phần lớn người dùng gặp đầu tiên khi mở ChatGPT.
Đây không phải một buổi ra mắt rầm rộ. Công ty âm thầm đổi mô hình mặc định trong ô trò chuyện mà hàng trăm triệu người dùng mỗi ngày, từ GPT-5.3 Instant sang GPT-5.5 Instant.
Điểm đáng chú ý nhất không phải cái tên mới, mà là con số OpenAI lần này đưa thẳng ra công khai: 52,5%.
Đưa số liệu ảo giác ra mặt bàn
OpenAI không chỉ nói chung chung rằng chất lượng được cải thiện mạnh. Trong các nhóm câu hỏi rủi ro cao như y tế, pháp lý và tài chính, GPT-5.5 Instant được công ty cho biết tạo ra ít phát biểu ảo giác hơn 52,5% so với thế hệ trước. Trong những cuộc trò chuyện khó từng bị người dùng đánh dấu lỗi sự thật, phát biểu không chính xác giảm 37,3%.
Điểm benchmark cũng tăng:
| Bài kiểm tra | GPT-5.3 Instant | GPT-5.5 Instant |
|---|---|---|
| AIME 2025 | 65.4 | 81.2 |
| MMMU-Pro | 69.2 | 76 |
AIME là bài toán ở cấp độ thi đấu, nên bước nhảy từ 65,4 lên 81,2 là đáng kể. MMMU-Pro kiểm tra suy luận khoa học ở cấp độ tiến sĩ, và mô hình mới đã tiến sát vùng 80%.
Dù vậy, dòng Instant của ChatGPT chưa bao giờ chỉ phục vụ bảng xếp hạng. Mục tiêu của nó là độ trễ thấp đi cùng độ tin cậy cao. Khi người dùng hỏi liệu một loại thuốc có thể dùng cùng ibrutinib hay không, một câu trả lời sai sau 3 giây có thể nguy hiểm hơn nhiều so với câu trả lời đúng sau 30 giây chờ đợi.
Bớt cả những emoji gây rối mắt
OpenAI nói câu trả lời của mô hình mới gọn hơn, đi thẳng vào trọng tâm hơn, không mất nội dung thực chất, đồng thời vẫn giữ được sự ấm áp và cá tính khiến ChatGPT dễ dùng.
Nói ngắn gọn: bớt dài dòng.
Cụ thể, số từ trong câu trả lời giảm khoảng 30%, số dòng giảm khoảng 29%. OpenAI cũng nói mô hình tránh những thứ khiến câu trả lời trông lộn xộn, chẳng hạn emoji không cần thiết.
Nếu trong vài tháng qua bạn thấy ChatGPT dùng quá nhiều biểu tượng mục tiêu, tên lửa hay lấp lánh, bản cập nhật này cho thấy OpenAI đã nghe thấy phản hồi đó.
Cách triển khai
GPT-5.5 Instant ngay lập tức thay GPT-5.3 Instant để trở thành mô hình mặc định của ChatGPT.
- Người dùng Plus/Pro: dùng được ngay trên web, bản di động đang được triển khai.
- Người dùng Free/Go/Business/Enterprise: sẽ nhận trong vài tuần tới.
- Nhà phát triển: trong API, mô hình có tên
chat-latest; GPT-5.3 cũ vẫn được giữ ba tháng cho người dùng trả phí trong giai đoạn chuyển tiếp.
Một thay đổi ít ồn ào hơn nhưng khá quan trọng là nguồn bộ nhớ của ChatGPT nay hiển thị trên mọi mô hình. Người dùng có thể xem một ký ức về mình được rút ra từ cuộc trò chuyện hay tệp nào, rồi xóa hoặc chỉnh sửa. Nếu chia sẻ cuộc trò chuyện cho người khác, họ sẽ không thấy các nguồn bộ nhớ đó.
Vì sao OpenAI công bố số liệu ảo giác
Trong hai năm qua, các công ty mô hình lớn thường nói về ảo giác bằng ngôn ngữ khá mơ hồ. Hoặc họ nói đã giảm đáng kể, hoặc né tránh chủ đề này.
Lần này OpenAI ghi rõ tỷ lệ phần trăm vì một lý do dễ hiểu: quá nhiều người dùng ChatGPT đã gặp rắc rối vì câu trả lời sai trong tài chính, y tế và pháp lý, và sức ép dư luận đã đủ lớn. Làn sóng phản ứng khi GPT-4o bị cho nghỉ vào tháng 2, trong đó có người gọi GPT-4o là người bạn tốt nhất của mình, cũng cho OpenAI thấy mức độ phụ thuộc của người dùng vào mô hình mặc định sâu hơn tưởng tượng của đội sản phẩm.
Việc âm thầm đổi mô hình mặc định có thể không có sân khấu ra mắt, cũng không lên trang nhất. Nhưng nó trực tiếp quyết định hàng trăm triệu người sẽ nhận được kiểu câu trả lời nào trong lần tiếp theo họ hỏi ChatGPT.
Con số 52,5% lần này là lần đầu OpenAI đặt vấn đề ấy rõ ràng lên bàn.
Câu hỏi tiếp theo là: Claude và Gemini có công bố tỷ lệ ảo giác của riêng mình hay không?
Nguồn: CocoLoop, GPT-5.5 Instant: smarter, clearer, and more personalized (blog chính thức của OpenAI); OpenAI releases GPT-5.5 Instant, a new default model for ChatGPT (TechCrunch); OpenAI releases GPT-5.5 Instant update to make ChatGPT smarter with fewer emoji (9to5Mac)