網路安全
說明 OpenAI Codex 在高風險網路安全場景下的能力邊界、存取限制與防護策略。
GPT-5.3-Codex 是 OpenAI 按照 Preparedness Framework(準備度框架) 視作“高網路安全能力”的第一個模型,因此需要額外防護。這些防護包括訓練模型拒絕明顯惡意的請求,例如竊取憑據。
除了安全訓練之外,基於分類器的自動監控也會檢測可疑網路安全活動訊號,並把高風險流量切換到網路安全能力更低的模型 GPT-5.2。OpenAI 預計只有極少一部分流量會受到這些緩解措施影響,並正在持續打磨相應的策略、分類器和產品內通知。
為什麼要這樣做
最近幾個月,模型在網路安全任務上的表現出現了明顯提升,這既讓開發者受益,也讓安全專業人員受益。隨著模型在漏洞發現等網路安全相關任務上越來越強,OpenAI 正採取一種預防式做法:在支援正當研究的同時,加強保護和執行,儘量減緩濫用。
網路安全能力天然具有雙重用途。支援重要防禦工作的那些知識和技術,例如滲透測試、漏洞研究、大規模掃描、惡意軟體分析和威脅情報,也同樣可能被用於現實世界中的傷害。
這些能力和技術需要在那些可以真正提升安全性的場景中變得更可用、更易用。OpenAI 的 Trusted Access for Cyber 試點,正是為了讓個人和組織能夠在不被打斷的情況下,繼續把模型用於可能屬於高風險的網路安全活動。
它是如何工作的
從事網路安全相關工作,或進行其他可能被自動檢測系統誤判的活動的開發者和安全專業人員,可能會被切換到 GPT-5.2 作為後備模型。OpenAI 預計只有極少一部分流量會受到緩解措施影響,並正在積極校準相關策略和分類器。
受這些緩解措施影響的賬號,可以通過加入下文的可信存取計劃,恢復對 GPT-5.3-Codex 的存取。
OpenAI 也意識到,加入可信存取並不適合所有人,因此隨著這些緩解措施擴大規模、並繼續加強網路韌性,OpenAI 計劃在多數情況下從賬號級安全檢查遷移到請求級檢查。
網路安全可信存取(Trusted Access for Cyber)
OpenAI 正在試點“可信存取”,以便在繼續校準通用可用階段的策略與分類器期間,讓開發者仍能保留高階能力。OpenAI 的目標是,真正需要加入 Trusted Access for Cyber 的使用者應當非常少。
如果你要把模型用於潛在高風險的網路安全工作:
- 個人使用者可以在 chatgpt.com/cyber 完成身份驗證
- 企業客戶可以通過自己的 OpenAI 代表,為整個團隊預設申請 trusted access
如果安全研究人員和團隊需要存取能力更強、限制更少的模型,以加速正當防禦工作,也可以表達對 OpenAI 邀請制專案 的興趣。獲得可信存取資格的使用者仍然必須遵守 OpenAI 的 使用政策 和 使用條款。
誤報
正當活動,或並非網路安全相關的活動,也有可能偶爾被標記。當發生切換時,響應模型會顯示在 API 請求日誌中,也會在 CLI 中通過產品內提示展示;很快所有客戶端入口都會支援這一提示。如果你認為自己遭遇的是錯誤切換,可以通過 /feedback 報告誤報。
來源:</zh-TW/docs/cyber-safety> 更新時間:2026-04-30(UTC)