# Openai lại đẩy cuộc đua lên tầm mới với GPT-5.6 và siêu ứng dụng

Đăng ngày: 2026-07-17

Nếu không phải vì sự kiện quá lớn của OpenAI, có lẽ hôm nay chúng ta đã nói về Meta Superintelligence Labs và Muse Spark 1.1. Phiên bản này được đánh giá là khá tốt, thậm chí còn tích hợp vào Meta Model API, cho thấy Meta rất tự tin. Nhưng tiếc thay, mọi sự chú ý lại đổ dồn vào một đợt ra mắt mô hình tiền tuyến mới của OpenAI: GPT-5.6, với ba phiên bản Sol, Terra và Luna – những cái tên gợi nhớ Mặt Trời, Trái Đất, Mặt Trăng, thay vì cách đặt tên "văn chương" như của Claude. Điểm nhấn đáng kể nhất của GPT-5.6 là cấp độ nỗ lực "ultra" mới, mà OpenAI tự hào là "cài đặt khả năng cao nhất của chúng tôi". Nó điều phối nhiều tác nhân trên các luồng công việc song song để hoàn thành các tác vụ phức tạp nhanh hơn. Cụ thể, cấp độ max cho GPT-5.6 nhiều thời gian hơn xhigh để suy luận, khám phá các phương án thay thế, kiểm tra và điều chỉnh cách tiếp cận. Còn ultra thì đi xa hơn nữa, mặc định điều phối bốn tác nhân song song, đổi lấy việc sử dụng nhiều token hơn để có kết quả mạnh mẽ hơn và thời gian hoàn thành nhanh hơn cho các tác vụ đòi hỏi cao. Trên nhiều tiêu chuẩn, GPT-5.6 không chỉ đạt hiệu suất cao hơn mà còn có chi phí thấp hơn so với Fable hay Opus. Chẳng hạn, Terra có hiệu suất nhỉnh hơn Fable 5, trong khi Luna vượt trội Opus 4.8; mỗi phiên bản đều làm được điều đó trong khoảng 1/3 thời gian, với khoảng 1/2 lượng token đầu ra và xấp xỉ 1/4 chi phí ước tính. Mô hình này cũng lập kỷ lục mới về hiệu suất trên Terminal-Bench 2.1 và DeepSWE, vốn kiểm tra quy trình làm việc dòng lệnh phức tạp và kỹ thuật đường dài trong cơ sở mã thực tế. Thậm chí còn có những cải tiến khó đánh giá hơn trong việc sử dụng máy tính, tạo bản trình bày/tài liệu và nghiên cứu khoa học mà tôi tin rằng không thể xem nhẹ. Như tôi từng dự đoán hồi tháng 4, việc OpenAI hôm nay ra mắt ChatGPT Work cùng bản cập nhật ứng dụng desktop Codex có lẽ là bước áp chót trong chiến lược siêu ứng dụng của họ. ChatGPT Work là một ứng dụng desktop mới, hợp nhất Codex và ChatGPT. Cùng với đó là các tính năng beta như Sites, gọi công cụ theo lập trình (programmatic tool calling) và multi-agent beta trong Responses API. Về mặt kinh tế, OpenAI giới thiệu API với ba mức giá theo tầng: Sol có giá 5 đô la/30 đô la cho mỗi triệu input/output token, Terra là 2.5 đô la/15 đô la, và Luna là 1 đô la/6 đô la. Lần đầu tiên có thêm giá ghi vào bộ nhớ đệm, đồng thời vẫn giữ nguyên mức giảm giá 90% cho việc đọc từ bộ nhớ đệm. OpenAI định vị Sol là phiên bản chủ lực với khả năng cao nhất, Terra có khả năng tương tự GPT-5.5 nhưng chi phí thấp hơn, còn Luna là lựa chọn nhanh nhất/rẻ nhất cho khối lượng lớn. Tất nhiên, các tuyên bố chính thức từ OpenAI rất hùng hồn. Sam Altman gọi đây là "mô hình tốt nhất mà chúng tôi từng sản xuất" và nhấn mạnh hiệu quả kinh tế cho doanh nghiệp: "5.6 Sol là một bước tiến lớn về số đô la bỏ ra trên mỗi tác vụ." Greg Brockman cũng khẳng định mục tiêu là "mức giá tốt nhất cho bất kỳ cấp độ hiệu suất mục tiêu nào" và khả năng cao nhất có thể. OpenAI tuyên bố GPT-5.6 Sol đạt mức cao mới 53.6 điểm trên Agents’ Last Exam, đánh bại Claude Fable 5 thích ứng tới 13.1 điểm. Ngay cả Terra và Luna cũng vượt trội Fable với chi phí thấp hơn khoảng 1/16. Các cải tiến về chất lượng tài liệu, bản trình bày và bảng tính được quảng cáo là xuất sắc, có thể xuất sang các công cụ doanh nghiệp hiện có. Đáng chú ý, đây cũng là mô hình có khả năng nhất của OpenAI từ trước đến nay trong các tác vụ liên quan đến an ninh mạng và sinh học, dù một số lệnh gọi API trong các lĩnh vực lưỡng dụng có thể bị chặn hoặc tạm dừng để xem xét an toàn. Tuy nhiên, các đánh giá độc lập từ Artificial Analysis lại mang đến một bức tranh chi tiết hơn. Họ xếp GPT-5.6 Sol (max) đạt 59 điểm trên Chỉ số Thông minh của họ, chỉ thấp hơn Claude Fable 5 (max) 1 điểm, nhưng lại có chi phí mỗi tác vụ chỉ bằng khoảng 1/3 của Fable.

Canonical: https://www.tungpham.vn/blog/openai-lai-day-cuoc-dua-len-tam-moi-voi-gpt-56-va-sieu-ung-dung
