OpenAI ra mắt mô hình suy luận mạnh nhất o3-pro trên ChatGPT, trả lời vấn đề phức tạp chính xác hơn
OpenAI đang không ngừng cập nhật các mô hình AI thế hệ mới với tốc độ nhanh chóng. Sau khi ra mắt mô hình o3 và o4-mini trên nền tảng ChatGPT vào tháng 4, mô hình mạnh nhất o3-pro của OpenAI đã chính thức được triển khai hôm nay. Các mô hình o3 và o4-mini được thiết kế để tích hợp toàn bộ công cụ có sẵn của ChatGPT. Những mô hình được gắn nhãn "pro" cho thấy khả năng dành thêm thời gian để xử lý câu hỏi, đổi lại là câu trả lời chất lượng cao và chính xác hơn.
Trong thông báo cập nhật về o3-pro, OpenAI cho biết: “Chúng tôi khuyến nghị sử dụng mô hình này cho các vấn đề phức tạp đòi hỏi độ tin cậy cao và chấp nhận chờ đợi vài phút.” Dữ liệu thử nghiệm cho thấy o3-pro vượt trội hơn so với o3 và o1-pro.
Tuy nhiên, hiện o3-pro vẫn có một số hạn chế trên ChatGPT, hiện tại chưa hỗ trợ tạo ảnh và Canvas; người dùng cần chuyển sang các mô hình khác để sử dụng những tính năng này. Mô hình này đã mở cho người dùng ChatGPT Pro và Team, trong khi người dùng doanh nghiệp và giáo dục sẽ được tiếp cận vào tuần tới. OpenAI cũng chính thức phát hành mô hình o3 và o4-mini.
OpenAI giới thiệu đây là kết quả đào tạo mới nhất trong dòng mô hình o, cho phép suy nghĩ lâu hơn trước khi trả lời và được tuyên bố là “mô hình thông minh nhất mà OpenAI từng phát hành”, đánh dấu bước nhảy vọt lớn cho ChatGPT. Từ người dùng tò mò đến nhà nghiên cứu cấp cao đều sẽ được lợi ích. Lần đầu tiên, các mô hình suy luận mới có thể thông minh sử dụng và kết hợp mọi công cụ trong ChatGPT, bao gồm tìm kiếm web, phân tích tệp tải lên bằng Python, suy luận đầu vào hình ảnh và thậm chí tạo hình ảnh.
Điểm cốt lõi là các mô hình này được huấn luyện để suy luận khi nào và cách sử dụng công cụ để đưa ra câu trả lời chi tiết, sâu sắc, thường trong chưa đầy một phút, giúp xử lý các vấn đề phức tạp hiệu quả hơn, tiến gần hơn đến một ChatGPT thông minh và tự hành.
o3 là mô hình suy luận mạnh nhất của OpenAI, dẫn đầu trong các lĩnh vực như mã hóa, toán học, khoa học và nhận thức hình ảnh, đạt kỷ lục mới (SOTA) trên các bài kiểm tra như Codeforces, SWE-bench và MMMU. OpenAI cho biết o3 phù hợp với các truy vấn nâng cao đòi hỏi phân tích đa chiều và câu trả lời không rõ ràng, đặc biệt xuất sắc trong xử lý hình ảnh, biểu đồ và đồ thị. Theo đánh giá của chuyên gia bên ngoài, o3 giảm 20% lỗi nghiêm trọng so với o1 trong các nhiệm vụ thực tế khó, đặc biệt trong lập trình, tư vấn/doanh nghiệp và sáng tạo ý tưởng. Người thử nghiệm sớm nhấn mạnh tính nghiêm ngặt trong phân tích của o3 và khả năng tạo, đánh giá giả thuyết mới, đặc biệt trong sinh học, toán học và kỹ thuật.
o4-mini là mô hình nhỏ hơn, được tối ưu cho suy luận nhanh và hiệu quả chi phí, đạt hiệu suất ấn tượng trong toán học, mã hóa và nhiệm vụ hình ảnh. Tại AIME 2025, với trình thông dịch Python, o4-mini đạt 99.5%. Trong đánh giá chuyên gia, nó vượt trội hơn o3-mini trong cả nhiệm vụ phi STEM và khoa học dữ liệu nhờ hiệu suất cao. Nhờ tính hiệu quả, o4-mini có giới hạn sử dụng cao hơn o3, trở thành lựa chọn mạnh mẽ cho các vấn đề đòi hỏi công suất lớn.
So với các mô hình suy luận trước đây, o3 và o4-mini hỗ trợ hội thoại tự nhiên hơn, đặc biệt khi tham chiếu ký ức và cuộc trò chuyện trước để trả lời cá nhân hóa và phù hợp hơn.
Trong quá trình phát triển o3, OpenAI nhận thấy xu hướng “càng nhiều sức mạnh tính toán = hiệu suất tốt hơn” tương tự như trong quá trình tiền huấn luyện GPT. Bằng cách đi lại con đường mở rộng, OpenAI tăng gấp 10 lần thời gian tính toán và suy luận, vẫn đạt cải tiến đáng kể, chứng minh hiệu suất tăng khi mô hình được suy nghĩ nhiều hơn. So với o1, o3 cung cấp hiệu suất cao hơn với cùng độ trễ và chi phí; nếu cho thời gian suy nghĩ dài hơn, hiệu suất tiếp tục cải thiện.
Ví dụ cho thấy các mô hình này có thể tích hợp hình ảnh trực tiếp vào chuỗi suy nghĩ. Chúng không chỉ xem hình ảnh mà còn suy luận từ hình ảnh, mở ra loại hình giải quyết vấn đề mới kết hợp thị giác và văn bản. Người dùng có thể tải ảnh bảng trắng, biểu đồ sách giáo khoa hoặc phác thảo tay, ngay cả khi mờ, lật ngược hoặc chất lượng thấp, mô hình vẫn diễn giải được. Với công cụ, mô hình có thể thao tác hình ảnh theo thời gian thực như xoay, thu phóng hoặc sử dụng trong quá trình suy luận.
o3 và o4-mini có thể truy cập toàn bộ công cụ trong ChatGPT và sử dụng các công cụ tùy chỉnh của nhà phát triển qua API. OpenAI cho biết các mô hình được huấn luyện để suy luận cách giải quyết vấn đề, chọn khi nào và cách dùng công cụ để trả lời chi tiết, sâu sắc, thường trong chưa đầy một phút.
Ví dụ, khi hỏi “Sử dụng năng lượng mùa hè ở California so với năm ngoái như thế nào?”, mô hình có thể tìm dữ liệu công ích, viết mã Python để dự đoán, tạo biểu đồ hoặc hình ảnh, và giải thích các yếu tố quan trọng, liên kết nhiều công cụ lại với nhau. Khả năng suy luận giúp mô hình phản ứng và điều chỉnh dựa trên thông tin gặp phải, như tìm kiếm nhiều lần trên web với sự hỗ trợ của nhà cung cấp và thử tìm kiếm mới khi cần thêm dữ liệu.
OpenAI khẳng định o3 và o4-mini là mô hình thông minh nhất từng phát hành, đồng thời hiệu quả hơn o1 và o3-mini. Ví dụ, ở cuộc thi toán AIME 2025, o3 có hiệu quả chi phí vượt trội hơn o1; tương tự, o4-mini vượt o3-mini.
Về an toàn, o3 và o4-mini được xây dựng lại dữ liệu huấn luyện an toàn, bổ sung từ chối gợi ý mới trong các lĩnh vực như mối đe dọa sinh học, tạo phần mềm độc hại và vượt ngục, đạt kết quả xuất sắc trong kiểm tra nội bộ (ví dụ, cấu trúc lệnh, vượt ngục). OpenAI phát triển biện pháp giảm thiểu cấp hệ thống để đánh dấu gợi ý nguy hiểm trong các lĩnh vực tiên phong. Tương tự công việc ban đầu với tạo hình ảnh, OpenAI huấn luyện một bộ giám sát LLM suy luận, hoạt động từ các quy tắc an toàn có thể giải thích do con người viết. Khi áp dụng cho rủi ro sinh học, bộ giám sát này đánh dấu khoảng 99% cuộc hội thoại.
Người dùng ChatGPT Plus, Pro và Team có thể thấy o3, o4-mini và o4-mini-high trong bộ chọn mô hình từ hôm nay, thay thế o1, o3-mini và o3-mini-high. Người dùng ChatGPT Enterprise và Edu sẽ được truy cập sau một tuần. Người dùng miễn phí có thể chọn “suy nghĩ” trước khi gửi truy vấn để thử o4-mini. Giới hạn tốc độ giữ nguyên như các mô hình trước. OpenAI dự kiến phát hành o3-pro trong vài tuần tới với hỗ trợ đầy đủ công cụ; hiện tại, người dùng Pro vẫn truy cập o1-pro.
Cập nhật hôm nay phản ánh hướng phát triển của OpenAI, kết hợp khả năng suy luận chuyên sâu của dòng o với hội thoại tự nhiên và sử dụng công cụ của dòng GPT.
Trong thông báo cập nhật về o3-pro, OpenAI cho biết: “Chúng tôi khuyến nghị sử dụng mô hình này cho các vấn đề phức tạp đòi hỏi độ tin cậy cao và chấp nhận chờ đợi vài phút.” Dữ liệu thử nghiệm cho thấy o3-pro vượt trội hơn so với o3 và o1-pro.
Tuy nhiên, hiện o3-pro vẫn có một số hạn chế trên ChatGPT, hiện tại chưa hỗ trợ tạo ảnh và Canvas; người dùng cần chuyển sang các mô hình khác để sử dụng những tính năng này. Mô hình này đã mở cho người dùng ChatGPT Pro và Team, trong khi người dùng doanh nghiệp và giáo dục sẽ được tiếp cận vào tuần tới. OpenAI cũng chính thức phát hành mô hình o3 và o4-mini.
OpenAI giới thiệu đây là kết quả đào tạo mới nhất trong dòng mô hình o, cho phép suy nghĩ lâu hơn trước khi trả lời và được tuyên bố là “mô hình thông minh nhất mà OpenAI từng phát hành”, đánh dấu bước nhảy vọt lớn cho ChatGPT. Từ người dùng tò mò đến nhà nghiên cứu cấp cao đều sẽ được lợi ích. Lần đầu tiên, các mô hình suy luận mới có thể thông minh sử dụng và kết hợp mọi công cụ trong ChatGPT, bao gồm tìm kiếm web, phân tích tệp tải lên bằng Python, suy luận đầu vào hình ảnh và thậm chí tạo hình ảnh.
Điểm cốt lõi là các mô hình này được huấn luyện để suy luận khi nào và cách sử dụng công cụ để đưa ra câu trả lời chi tiết, sâu sắc, thường trong chưa đầy một phút, giúp xử lý các vấn đề phức tạp hiệu quả hơn, tiến gần hơn đến một ChatGPT thông minh và tự hành.
Hiệu suất
o3 là mô hình suy luận mạnh nhất của OpenAI, dẫn đầu trong các lĩnh vực như mã hóa, toán học, khoa học và nhận thức hình ảnh, đạt kỷ lục mới (SOTA) trên các bài kiểm tra như Codeforces, SWE-bench và MMMU. OpenAI cho biết o3 phù hợp với các truy vấn nâng cao đòi hỏi phân tích đa chiều và câu trả lời không rõ ràng, đặc biệt xuất sắc trong xử lý hình ảnh, biểu đồ và đồ thị. Theo đánh giá của chuyên gia bên ngoài, o3 giảm 20% lỗi nghiêm trọng so với o1 trong các nhiệm vụ thực tế khó, đặc biệt trong lập trình, tư vấn/doanh nghiệp và sáng tạo ý tưởng. Người thử nghiệm sớm nhấn mạnh tính nghiêm ngặt trong phân tích của o3 và khả năng tạo, đánh giá giả thuyết mới, đặc biệt trong sinh học, toán học và kỹ thuật.
o4-mini là mô hình nhỏ hơn, được tối ưu cho suy luận nhanh và hiệu quả chi phí, đạt hiệu suất ấn tượng trong toán học, mã hóa và nhiệm vụ hình ảnh. Tại AIME 2025, với trình thông dịch Python, o4-mini đạt 99.5%. Trong đánh giá chuyên gia, nó vượt trội hơn o3-mini trong cả nhiệm vụ phi STEM và khoa học dữ liệu nhờ hiệu suất cao. Nhờ tính hiệu quả, o4-mini có giới hạn sử dụng cao hơn o3, trở thành lựa chọn mạnh mẽ cho các vấn đề đòi hỏi công suất lớn.
So với các mô hình suy luận trước đây, o3 và o4-mini hỗ trợ hội thoại tự nhiên hơn, đặc biệt khi tham chiếu ký ức và cuộc trò chuyện trước để trả lời cá nhân hóa và phù hợp hơn.
Khả năng suy luận hình ảnh
Trong quá trình phát triển o3, OpenAI nhận thấy xu hướng “càng nhiều sức mạnh tính toán = hiệu suất tốt hơn” tương tự như trong quá trình tiền huấn luyện GPT. Bằng cách đi lại con đường mở rộng, OpenAI tăng gấp 10 lần thời gian tính toán và suy luận, vẫn đạt cải tiến đáng kể, chứng minh hiệu suất tăng khi mô hình được suy nghĩ nhiều hơn. So với o1, o3 cung cấp hiệu suất cao hơn với cùng độ trễ và chi phí; nếu cho thời gian suy nghĩ dài hơn, hiệu suất tiếp tục cải thiện.
Ví dụ cho thấy các mô hình này có thể tích hợp hình ảnh trực tiếp vào chuỗi suy nghĩ. Chúng không chỉ xem hình ảnh mà còn suy luận từ hình ảnh, mở ra loại hình giải quyết vấn đề mới kết hợp thị giác và văn bản. Người dùng có thể tải ảnh bảng trắng, biểu đồ sách giáo khoa hoặc phác thảo tay, ngay cả khi mờ, lật ngược hoặc chất lượng thấp, mô hình vẫn diễn giải được. Với công cụ, mô hình có thể thao tác hình ảnh theo thời gian thực như xoay, thu phóng hoặc sử dụng trong quá trình suy luận.
Công cụ và API
o3 và o4-mini có thể truy cập toàn bộ công cụ trong ChatGPT và sử dụng các công cụ tùy chỉnh của nhà phát triển qua API. OpenAI cho biết các mô hình được huấn luyện để suy luận cách giải quyết vấn đề, chọn khi nào và cách dùng công cụ để trả lời chi tiết, sâu sắc, thường trong chưa đầy một phút.
Ví dụ, khi hỏi “Sử dụng năng lượng mùa hè ở California so với năm ngoái như thế nào?”, mô hình có thể tìm dữ liệu công ích, viết mã Python để dự đoán, tạo biểu đồ hoặc hình ảnh, và giải thích các yếu tố quan trọng, liên kết nhiều công cụ lại với nhau. Khả năng suy luận giúp mô hình phản ứng và điều chỉnh dựa trên thông tin gặp phải, như tìm kiếm nhiều lần trên web với sự hỗ trợ của nhà cung cấp và thử tìm kiếm mới khi cần thêm dữ liệu.
Chi phí
OpenAI khẳng định o3 và o4-mini là mô hình thông minh nhất từng phát hành, đồng thời hiệu quả hơn o1 và o3-mini. Ví dụ, ở cuộc thi toán AIME 2025, o3 có hiệu quả chi phí vượt trội hơn o1; tương tự, o4-mini vượt o3-mini.
An toàn
Về an toàn, o3 và o4-mini được xây dựng lại dữ liệu huấn luyện an toàn, bổ sung từ chối gợi ý mới trong các lĩnh vực như mối đe dọa sinh học, tạo phần mềm độc hại và vượt ngục, đạt kết quả xuất sắc trong kiểm tra nội bộ (ví dụ, cấu trúc lệnh, vượt ngục). OpenAI phát triển biện pháp giảm thiểu cấp hệ thống để đánh dấu gợi ý nguy hiểm trong các lĩnh vực tiên phong. Tương tự công việc ban đầu với tạo hình ảnh, OpenAI huấn luyện một bộ giám sát LLM suy luận, hoạt động từ các quy tắc an toàn có thể giải thích do con người viết. Khi áp dụng cho rủi ro sinh học, bộ giám sát này đánh dấu khoảng 99% cuộc hội thoại.
Cách sử dụng
Người dùng ChatGPT Plus, Pro và Team có thể thấy o3, o4-mini và o4-mini-high trong bộ chọn mô hình từ hôm nay, thay thế o1, o3-mini và o3-mini-high. Người dùng ChatGPT Enterprise và Edu sẽ được truy cập sau một tuần. Người dùng miễn phí có thể chọn “suy nghĩ” trước khi gửi truy vấn để thử o4-mini. Giới hạn tốc độ giữ nguyên như các mô hình trước. OpenAI dự kiến phát hành o3-pro trong vài tuần tới với hỗ trợ đầy đủ công cụ; hiện tại, người dùng Pro vẫn truy cập o1-pro.
Cập nhật hôm nay phản ánh hướng phát triển của OpenAI, kết hợp khả năng suy luận chuyên sâu của dòng o với hội thoại tự nhiên và sử dụng công cụ của dòng GPT.
BÀI MỚI ĐANG THẢO LUẬN