Tiếng Việt

An toàn không gian mạng

Các biện pháp bảo vệ an ninh mạng và quyền truy cập đáng tin cậy dành cho người dùng Codex

GPT-5.3-Codex là mô hình đầu tiên được chúng tôi xếp vào nhóm có năng lực an ninh mạng Cao theo Khung chuẩn bị, vì vậy cần có thêm các biện pháp bảo vệ. Những biện pháp này bao gồm việc huấn luyện mô hình từ chối các yêu cầu rõ ràng có mục đích xấu, chẳng hạn như đánh cắp thông tin xác thực.

Ngoài quá trình huấn luyện an toàn, các hệ thống giám sát tự động dựa trên bộ phân loại sẽ phát hiện dấu hiệu của hoạt động mạng đáng ngờ và chuyển lưu lượng có rủi ro cao đến một mô hình có năng lực an ninh mạng thấp hơn (GPT-5.2). Chúng tôi dự kiến chỉ một phần rất nhỏ lưu lượng bị ảnh hưởng bởi các biện pháp giảm thiểu này và đang tiếp tục tinh chỉnh chính sách, bộ phân loại cũng như thông báo trong sản phẩm.

Tại sao chúng tôi thực hiện việc này

Trong những tháng gần đây, chúng tôi đã ghi nhận những cải thiện đáng kể về hiệu suất của mô hình trong các tác vụ an ninh mạng, mang lại lợi ích cho cả nhà phát triển lẫn chuyên gia bảo mật. Khi các mô hình ngày càng thực hiện tốt hơn những tác vụ liên quan đến an ninh mạng như phát hiện lỗ hổng, chúng tôi áp dụng cách tiếp cận thận trọng: mở rộng các biện pháp bảo vệ và thực thi để hỗ trợ hoạt động nghiên cứu chính đáng, đồng thời hạn chế việc sử dụng sai mục đích.

Năng lực an ninh mạng vốn có tính lưỡng dụng. Cùng một kiến thức và kỹ thuật làm nền tảng cho các công việc phòng thủ quan trọng — kiểm thử xâm nhập, nghiên cứu lỗ hổng, quét trên quy mô lớn, phân tích phần mềm độc hại và tình báo về mối đe dọa — cũng có thể gây ra thiệt hại trong thế giới thực.

Các năng lực và kỹ thuật này cần được cung cấp và dễ sử dụng hơn trong những bối cảnh mà chúng có thể góp phần cải thiện bảo mật. Chương trình thí điểm Quyền truy cập đáng tin cậy cho an ninh mạng cho phép cá nhân và tổ chức tiếp tục sử dụng các mô hình cho hoạt động an ninh mạng có khả năng mang rủi ro cao mà không bị gián đoạn.

Cách hoạt động

Các nhà phát triển và chuyên gia bảo mật thực hiện công việc liên quan đến an ninh mạng hoặc hoạt động tương tự có thể bị hệ thống phát hiện tự động nhận định nhầm có thể thấy yêu cầu của mình được chuyển sang GPT-5.2 làm phương án dự phòng. Chúng tôi dự kiến chỉ một phần rất nhỏ lưu lượng bị ảnh hưởng bởi các biện pháp giảm thiểu và đang tích cực hiệu chỉnh chính sách cùng các bộ phân loại.

Các tài khoản chịu ảnh hưởng của biện pháp giảm thiểu có thể lấy lại quyền truy cập GPT-5.3-Codex bằng cách tham gia chương trình Quyền truy cập đáng tin cậy bên dưới.

Chúng tôi hiểu rằng việc tham gia Quyền truy cập đáng tin cậy có thể không phù hợp với tất cả mọi người. Vì vậy, trong phần lớn trường hợp, chúng tôi dự định chuyển từ kiểm tra an toàn ở cấp tài khoản sang kiểm tra ở cấp yêu cầu khi mở rộng các biện pháp giảm thiểu này và tăng cường khả năng chống chịu trước rủi ro mạng.

Quyền truy cập đáng tin cậy cho an ninh mạng

Chúng tôi đang thí điểm "quyền truy cập đáng tin cậy", cho phép nhà phát triển duy trì các năng lực nâng cao trong khi chúng tôi tiếp tục hiệu chỉnh chính sách và bộ phân loại để chuẩn bị cung cấp rộng rãi. Mục tiêu của chúng tôi là chỉ có rất ít người dùng cần tham gia Quyền truy cập đáng tin cậy cho an ninh mạng.

Để sử dụng các mô hình cho công việc an ninh mạng có khả năng mang rủi ro cao:

Các nhà nghiên cứu và nhóm bảo mật có thể cần quyền truy cập vào những mô hình có năng lực an ninh mạng cao hơn nữa hoặc ít hạn chế hơn để đẩy nhanh công việc phòng thủ chính đáng có thể đăng ký quan tâm đến chương trình chỉ dành cho người được mời⁠. Người dùng có quyền truy cập đáng tin cậy vẫn phải tuân thủ Chính sách sử dụng⁠Điều khoản sử dụng⁠ của chúng tôi.

Kết quả dương tính giả

Hoạt động chính đáng hoặc không liên quan đến an ninh mạng đôi khi có thể bị gắn cờ. Khi yêu cầu được chuyển hướng, mô hình phản hồi sẽ hiển thị trong nhật ký yêu cầu API và trong thông báo ở Codex CLI; tính năng này sẽ sớm có trên tất cả giao diện. Nếu yêu cầu của bạn bị chuyển hướng mà bạn cho rằng đó là quyết định không chính xác, vui lòng báo cáo kết quả dương tính giả qua /feedback.