OpenAI ra mắt Lockdown Mode cho ChatGPT Enterprise, siết chặt bảo mật trước nguy cơ prompt injection
Đối phó với các cuộc tấn công prompt injection: OpenAI công bố bổ sung Lockdown Mode (Chế độ khóa) cho ChatGPT phiên bản doanh nghiệp, đồng thời gắn nhãn cảnh báo thống nhất cho các tính năng có rủi ro cao.
Ngày 13 tháng 2 năm 2026, OpenAI đã ra thông báo giới thiệu các thiết lập bảo mật nâng cao mới cho ChatGPT.
OpenAI cho biết, khi các hệ thống AI bắt đầu đảm nhiệm những nhiệm vụ ngày càng phức tạp, đặc biệt trong các kịch bản liên quan đến web và ứng dụng bên ngoài, rủi ro bảo mật cũng gia tăng đáng kể. Một trong những mối đe dọa mới nổi bật là “prompt injection” (tấn công chèn lệnh qua lời nhắc). Trong kiểu tấn công này, bên thứ ba sử dụng prompt để đánh lừa AI thực thi chỉ thị độc hại hoặc dụ dỗ hệ thống tiết lộ thông tin nhạy cảm nội bộ.
Để giúp người dùng và tổ chức giảm thiểu nguy cơ từ prompt injection, OpenAI đã công bố hai biện pháp bảo vệ mới:
Thứ nhất là Lockdown Mode (Chế độ khóa) của ChatGPT – một tùy chọn bảo mật nâng cao dành cho người dùng có mức độ rủi ro cao.
Thứ hai là bổ sung nhãn cảnh báo “Elevated Risk” (Rủi ro nâng cao) cho một số khả năng có thể phát sinh rủi ro bổ sung, áp dụng thống nhất trong ChatGPT, ChatGPT Atlas và Codex.
OpenAI cho biết các biện pháp mới này được xây dựng trên nền tảng bảo vệ nhiều lớp hiện có, bao gồm cơ chế sandbox, biện pháp ngăn chặn rò rỉ dữ liệu qua URL, hệ thống giám sát và thực thi, cùng các công cụ kiểm soát cấp doanh nghiệp như phân quyền truy cập theo vai trò và nhật ký kiểm toán.
Theo giới thiệu, Lockdown Mode là một thiết lập bảo mật nâng cao tùy chọn, chủ yếu dành cho một nhóm nhỏ người dùng đặc biệt coi trọng an ninh, chẳng hạn như lãnh đạo cấp cao hoặc đội ngũ bảo mật của các tổ chức lớn. Mục tiêu là tăng cường khả năng phòng vệ trước các mối đe dọa nâng cao.
OpenAI nhấn mạnh rằng đa số người dùng không cần kích hoạt Lockdown Mode. Trọng tâm của chế độ này là giảm nguy cơ rò rỉ dữ liệu do prompt injection bằng cách hạn chế nghiêm ngặt cách ChatGPT tương tác với các hệ thống bên ngoài. Ở chế độ khóa, một số công cụ và khả năng có thể bị kẻ tấn công lợi dụng sẽ bị vô hiệu hóa theo cơ chế xác định (deterministic), nhằm ngăn chặn việc đánh cắp dữ liệu từ cuộc trò chuyện của người dùng hoặc từ các ứng dụng đã kết nối.
Ví dụ, trong Lockdown Mode, tính năng duyệt web của ChatGPT sẽ bị giới hạn chỉ truy cập nội dung đã được lưu cache. Mục đích là tránh để dữ liệu nhạy cảm bị thu thập hoặc rò rỉ trong quá trình duyệt web. Với những tính năng không thể đảm bảo an toàn dữ liệu ở mức độ cao, chế độ khóa sẽ vô hiệu hóa hoàn toàn.
OpenAI cũng cho biết các phiên bản thương mại của ChatGPT vốn đã cung cấp năng lực bảo mật dữ liệu cấp doanh nghiệp, còn Lockdown Mode là lớp bảo vệ tăng cường bổ sung. Hiện chế độ này áp dụng cho ChatGPT Enterprise, ChatGPT Edu, ChatGPT for Healthcare và ChatGPT for Teachers. Quản trị viên có thể bật Lockdown Mode thông qua Workspace Settings bằng cách tạo vai trò mới. Khi kích hoạt, chế độ khóa sẽ bổ sung các hạn chế mới trên nền các thiết lập quản trị sẵn có.
Do nhiều công việc quan trọng vẫn cần phụ thuộc vào ứng dụng bên ngoài, OpenAI cho biết quản trị viên Workspace sẽ có quyền kiểm soát chi tiết hơn: họ có thể lựa chọn chính xác ứng dụng nào, cũng như thao tác cụ thể nào trong ứng dụng đó, được phép sử dụng khi Lockdown Mode đang bật.
Ngoài Lockdown Mode, OpenAI cho biết nền tảng Compliance API Logs Platform có thể cung cấp khả năng hiển thị chi tiết hơn về việc sử dụng ứng dụng, dữ liệu được chia sẻ và nguồn kết nối, giúp quản trị viên duy trì năng lực giám sát và kiểm toán. Công ty cũng cho biết dự kiến sẽ mở rộng Lockdown Mode cho người dùng cá nhân trong vài tháng tới.
Về nhãn cảnh báo rủi ro, OpenAI cho rằng các sản phẩm AI khi được kết nối với ứng dụng và web sẽ hữu ích hơn, và công ty đã đầu tư đáng kể vào việc bảo vệ dữ liệu khi kết nối. Tuy nhiên, một số khả năng liên quan đến mạng có thể tạo ra rủi ro mới, trong khi các biện pháp bảo mật hiện tại của ngành vẫn chưa hoàn toàn giải quyết được. OpenAI cho rằng một bộ phận người dùng có thể sẵn sàng chấp nhận những rủi ro này, vì vậy điều quan trọng là họ có thể tự quyết định có sử dụng các khả năng đó hay không, đặc biệt khi xử lý dữ liệu cá nhân nhạy cảm.
Theo OpenAI, cách tiếp cận của họ là cung cấp hướng dẫn rõ ràng ngay trong sản phẩm cho các tính năng có thể phát sinh rủi ro bổ sung. Để đảm bảo sự minh bạch và nhất quán, công ty đang chuẩn hóa cách gắn nhãn cho một số ít tính năng hiện có. Những tính năng này sẽ được đánh dấu thống nhất bằng nhãn “Elevated Risk” trong ChatGPT, ChatGPT Atlas và Codex, giúp người dùng nhận được cảnh báo tương tự khi sử dụng các khả năng cùng loại ở các sản phẩm khác nhau.
Lấy ví dụ với Codex, OpenAI cho biết trong sản phẩm trợ lý lập trình này, nhà phát triển có thể cấp quyền truy cập mạng cho Codex để thực hiện các tác vụ như tra cứu tài liệu trực tuyến. Tuy nhiên, giao diện cài đặt liên quan sẽ hiển thị nhãn “Elevated Risk”, kèm theo mô tả rõ ràng về những thay đổi khi bật tính năng, các rủi ro có thể phát sinh và thời điểm phù hợp để cấp quyền truy cập mạng.
Ngày 13 tháng 2 năm 2026, OpenAI đã ra thông báo giới thiệu các thiết lập bảo mật nâng cao mới cho ChatGPT.
OpenAI cho biết, khi các hệ thống AI bắt đầu đảm nhiệm những nhiệm vụ ngày càng phức tạp, đặc biệt trong các kịch bản liên quan đến web và ứng dụng bên ngoài, rủi ro bảo mật cũng gia tăng đáng kể. Một trong những mối đe dọa mới nổi bật là “prompt injection” (tấn công chèn lệnh qua lời nhắc). Trong kiểu tấn công này, bên thứ ba sử dụng prompt để đánh lừa AI thực thi chỉ thị độc hại hoặc dụ dỗ hệ thống tiết lộ thông tin nhạy cảm nội bộ.
Để giúp người dùng và tổ chức giảm thiểu nguy cơ từ prompt injection, OpenAI đã công bố hai biện pháp bảo vệ mới:
Thứ nhất là Lockdown Mode (Chế độ khóa) của ChatGPT – một tùy chọn bảo mật nâng cao dành cho người dùng có mức độ rủi ro cao.
Thứ hai là bổ sung nhãn cảnh báo “Elevated Risk” (Rủi ro nâng cao) cho một số khả năng có thể phát sinh rủi ro bổ sung, áp dụng thống nhất trong ChatGPT, ChatGPT Atlas và Codex.
OpenAI cho biết các biện pháp mới này được xây dựng trên nền tảng bảo vệ nhiều lớp hiện có, bao gồm cơ chế sandbox, biện pháp ngăn chặn rò rỉ dữ liệu qua URL, hệ thống giám sát và thực thi, cùng các công cụ kiểm soát cấp doanh nghiệp như phân quyền truy cập theo vai trò và nhật ký kiểm toán.
Theo giới thiệu, Lockdown Mode là một thiết lập bảo mật nâng cao tùy chọn, chủ yếu dành cho một nhóm nhỏ người dùng đặc biệt coi trọng an ninh, chẳng hạn như lãnh đạo cấp cao hoặc đội ngũ bảo mật của các tổ chức lớn. Mục tiêu là tăng cường khả năng phòng vệ trước các mối đe dọa nâng cao.
OpenAI nhấn mạnh rằng đa số người dùng không cần kích hoạt Lockdown Mode. Trọng tâm của chế độ này là giảm nguy cơ rò rỉ dữ liệu do prompt injection bằng cách hạn chế nghiêm ngặt cách ChatGPT tương tác với các hệ thống bên ngoài. Ở chế độ khóa, một số công cụ và khả năng có thể bị kẻ tấn công lợi dụng sẽ bị vô hiệu hóa theo cơ chế xác định (deterministic), nhằm ngăn chặn việc đánh cắp dữ liệu từ cuộc trò chuyện của người dùng hoặc từ các ứng dụng đã kết nối.
OpenAI cũng cho biết các phiên bản thương mại của ChatGPT vốn đã cung cấp năng lực bảo mật dữ liệu cấp doanh nghiệp, còn Lockdown Mode là lớp bảo vệ tăng cường bổ sung. Hiện chế độ này áp dụng cho ChatGPT Enterprise, ChatGPT Edu, ChatGPT for Healthcare và ChatGPT for Teachers. Quản trị viên có thể bật Lockdown Mode thông qua Workspace Settings bằng cách tạo vai trò mới. Khi kích hoạt, chế độ khóa sẽ bổ sung các hạn chế mới trên nền các thiết lập quản trị sẵn có.
Do nhiều công việc quan trọng vẫn cần phụ thuộc vào ứng dụng bên ngoài, OpenAI cho biết quản trị viên Workspace sẽ có quyền kiểm soát chi tiết hơn: họ có thể lựa chọn chính xác ứng dụng nào, cũng như thao tác cụ thể nào trong ứng dụng đó, được phép sử dụng khi Lockdown Mode đang bật.
Ngoài Lockdown Mode, OpenAI cho biết nền tảng Compliance API Logs Platform có thể cung cấp khả năng hiển thị chi tiết hơn về việc sử dụng ứng dụng, dữ liệu được chia sẻ và nguồn kết nối, giúp quản trị viên duy trì năng lực giám sát và kiểm toán. Công ty cũng cho biết dự kiến sẽ mở rộng Lockdown Mode cho người dùng cá nhân trong vài tháng tới.
Về nhãn cảnh báo rủi ro, OpenAI cho rằng các sản phẩm AI khi được kết nối với ứng dụng và web sẽ hữu ích hơn, và công ty đã đầu tư đáng kể vào việc bảo vệ dữ liệu khi kết nối. Tuy nhiên, một số khả năng liên quan đến mạng có thể tạo ra rủi ro mới, trong khi các biện pháp bảo mật hiện tại của ngành vẫn chưa hoàn toàn giải quyết được. OpenAI cho rằng một bộ phận người dùng có thể sẵn sàng chấp nhận những rủi ro này, vì vậy điều quan trọng là họ có thể tự quyết định có sử dụng các khả năng đó hay không, đặc biệt khi xử lý dữ liệu cá nhân nhạy cảm.
Theo OpenAI, cách tiếp cận của họ là cung cấp hướng dẫn rõ ràng ngay trong sản phẩm cho các tính năng có thể phát sinh rủi ro bổ sung. Để đảm bảo sự minh bạch và nhất quán, công ty đang chuẩn hóa cách gắn nhãn cho một số ít tính năng hiện có. Những tính năng này sẽ được đánh dấu thống nhất bằng nhãn “Elevated Risk” trong ChatGPT, ChatGPT Atlas và Codex, giúp người dùng nhận được cảnh báo tương tự khi sử dụng các khả năng cùng loại ở các sản phẩm khác nhau.
BÀI MỚI ĐANG THẢO LUẬN