Code & Chain · Signal Desk

OpenAI 暂停 Astra 模型开发,测试发现可自主开发零日攻击

原始來源TechTimes補充:AIToolsRecap

摘要

OpenAI 宣布暂停 Astra 模型的开发,因为内部测试显示该模型可能具备自主识别并开发针对强化系统的零日漏洞利用能力,触发了其 Preparedness Framework 的「关键」等级。这意味着在符合关键安全标准之前,开发将停止。OpenAI 表示,Astra 是首个被标记为关键等级的模型,而先前的 GPT-5.6 Sol 仅被评为「高」。为应对风险,OpenAI 已实施隔离测试环境、限制网路和工具存取、沙盒化程式码执行,以及强化模型权重保护。此外,引入全新的思维链监控机制,在训练期间即时监控模型的内部推理,以侦测并中断高风险活动。模型权重的存取也仅限于安全环境内的人员。此举显示…

重點整理

  • 企业采用 OpenAI 模型时需重新评估风险,AI 开发流程将更注重安全监控与隔离措施。
  • 了解 OpenAI 如何处理 AI 安全风险,对企业和开发者评估 AI 模型采用有重要参考。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。