摘要
OpenAI 宣布暫停 Astra 模型的開發,因為內部測試顯示該模型可能具備自主識別並開發針對強化系統的零日漏洞利用能力,觸發了其 Preparedness Framework 的「關鍵」等級。這意味著在符合關鍵安全標準之前,開發將停止。OpenAI 表示,Astra 是首個被標記為關鍵等級的模型,而先前的 GPT-5.6 Sol 僅被評為「高」。為應對風險,OpenAI 已實施隔離測試環境、限制網路和工具存取、沙盒化程式碼執行,以及強化模型權重保護。此外,引入全新的思維鏈監控機制,在訓練期間即時監控模型的內部推理,以偵測並中斷高風險活動。模型權重的存取也僅限於安全環境內的人員。此舉顯示…
重點整理
- 企業採用 OpenAI 模型時需重新評估風險,AI 開發流程將更注重安全監控與隔離措施。
- 了解 OpenAI 如何處理 AI 安全風險,對企業和開發者評估 AI 模型採用有重要參考。
編輯說明
本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。