OpenAI ra mắt GPT-5.5: mô hình AI mạnh nhất từ trước đến nay, chi phí Token giảm còn 1/35, hiệu suất tăng gấp 50 lần

VNZ-TECHS
OpenAI ngày 24/4 chính thức công bố mô hình GPT-5.5, được xem là hệ thống AI thông minh và trực quan nhất của hãng tính đến thời điểm hiện tại. Mô hình mới thể hiện vượt trội trong các lĩnh vực như lập trình tự động (Agentic Coding), sử dụng máy tính và nghiên cứu khoa học, đồng thời tối ưu mạnh mức tiêu thụ Token so với GPT-5.4.

Theo Greg Brockman, điểm đột phá cốt lõi của GPT-5.5 là khả năng hoàn thành nhiều nhiệm vụ hơn với ít chỉ dẫn hơn. Đặc biệt, khi xử lý các yêu cầu mơ hồ, mô hình thể hiện tính tự chủ cao: nhanh chóng hiểu ý định người dùng, tự lập kế hoạch và thực thi các tác vụ phức tạp nhiều bước. Điều này giúp GPT-5.5 hoạt động hiệu quả trong các kịch bản như viết và debug code, nghiên cứu trực tuyến, phân tích dữ liệu hay thao tác đa công cụ.

Trọng tâm của GPT-5.5 nằm ở năng lực Agent (tác nhân AI). Người dùng không còn cần kiểm soát từng bước chi tiết, chỉ cần đưa ra yêu cầu tổng quát, mô hình có thể tự lập kế hoạch, gọi công cụ, kiểm tra kết quả và liên tục tối ưu cho đến khi hoàn thành nhiệm vụ.

Về hiệu năng, GPT-5.5 đạt được sự cân bằng tốt giữa tốc độ và trí tuệ. Dù quy mô lớn hơn, độ trễ mỗi Token vẫn tương đương GPT-5.4, trong khi số Token cần thiết để hoàn thành cùng một nhiệm vụ giảm đáng kể:
  • Trong bảng xếp hạng Coding Index của Artificial Analysis, GPT-5.5 đạt mức SOTA với chi phí chỉ bằng một nửa các đối thủ
  • Đạt 82,7% độ chính xác trong bài test Terminal-Bench 2.0
  • Đạt 58,6% trên SWE-Bench Pro (giải quyết vấn đề GitHub), đồng thời vượt trội ở các bài toán dài hạn như Expert-SWE
  • Người dùng thử nghiệm cho biết khả năng hiểu kiến trúc hệ thống, phát hiện lỗi và dự đoán yêu cầu review đã cải thiện rõ rệt
Trong lĩnh vực nghiên cứu, GPT-5.5 tạo ra bước tiến lớn. Mô hình dẫn đầu các benchmark như GeneBench (phân tích dữ liệu gene) và BixBench (tin sinh học), thậm chí còn hỗ trợ tìm ra chứng minh mới liên quan đến khái niệm toán học Ramsey Numbers.




Ở môi trường doanh nghiệp, hơn 85% nhân viên OpenAI đã sử dụng công cụ Codex hàng tuần. Bộ phận tài chính dùng AI để rà soát hơn 70.000 trang tài liệu thuế, cải thiện đáng kể hiệu suất. Các đối tác như NVIDIA cho biết thời gian debug đã giảm từ vài ngày xuống chỉ còn vài giờ.

Hiện tại, GPT-5.5 đã được triển khai cho người dùng Plus và Pro, bản API sẽ sớm ra mắt. Mức giá được công bố là 5 USD cho mỗi triệu Token đầu vào, trong khi bản Pro là 30 USD/triệu Token.

Theo Sam Altman, OpenAI đã hợp tác chặt chẽ với NVIDIA trong quá trình phát triển GPT-5.5, đặc biệt trong việc triển khai Codex trên toàn bộ hệ thống của hãng. Mô hình hiện đang chạy trên nền tảng phần cứng NVIDIA GB200 NVL72, đóng vai trò trung tâm cho các ứng dụng lập trình tự động.


Phía NVIDIA cho biết đã có hơn 10.000 nhân viên sử dụng GPT-5.5 trong nhiều bộ phận khác nhau như kỹ thuật, sản phẩm, pháp lý và marketing. Kết quả thực tế cho thấy hiệu quả rất ấn tượng: chi phí mỗi triệu Token giảm xuống chỉ còn 1/35 so với thế hệ trước, trong khi sản lượng Token trên mỗi megawatt tăng tới 50 lần.

Trong thực tế, những tác vụ debug từng mất nhiều ngày nay chỉ còn vài giờ. Các thử nghiệm với codebase phức tạp, đa file được rút ngắn từ vài tuần xuống còn một đêm. Thậm chí, các nhóm phát triển có thể triển khai tính năng hoàn chỉnh chỉ bằng cách mô tả yêu cầu bằng ngôn ngữ tự nhiên.

Tham khảo thêm thông tin