《人工智能安全治理框架3.0》發布,新增智能體風險管理框架

《人工智能安全治理框架3.0》發布,新增智能體風險管理框架

《人工智能安全治理框架3.0》發布,新增智能體風險管理框架

國家層面的人工智能安全治理框架更新至3.0版,風險分類新增智能體及具身智能兩類。全國網絡安全標準化技術委員會於2026年9月14日發布《人工智能安全治理框架3.0》,並以附件形式加入智能體風險管理框架,綜合治理部分新增沙箱監管。

國家層面的人工智能安全治理框架更新至3.0版,風險分類新增智能體及具身智能兩類。全國網絡安全標準化技術委員會於2026年9月14日發布《人工智能安全治理框架3.0》,並以附件形式加入智能體風險管理框架,綜合治理部分新增沙箱監管。

業界動態

2026年9月14日

機櫃內的網絡交換設備,接駁多條黃色光纖線纜。

機櫃內的網絡交換設備,接駁多條黃色光纖線纜。 圖片來源:Unsplash/Kirill Sh

國家層面的人工智能安全治理框架更新至3.0版,風險分類新增「智能體安全風險」和「具身智能安全風險」兩類,並以附件形式加入智能體風險管理框架。全國網絡安全標準化技術委員會(網安標委)於2026年9月14日在2026年國家網絡安全宣傳周開幕式上發布《人工智能安全治理框架3.0》。文件在國家互聯網信息辦公室指導下編制,是繼2024年1.0版及2025年2.0版後的第三版。

重點一覽

  • 風險分類新增「智能體安全風險」及「具身智能安全風險」兩類,其餘小類重新劃分

  • 新增附件2「智能體風險管理框架」,梳理由設計研發至停用下線的全生命周期風險,並提出風險預防前置、身份與權限管理、加強人工審批等防範措施

  • 綜合治理措施由逐項平列改為分組編排,新增「沙箱監管環境」一組

  • 新增4個專欄,分別說明非預期自主行為、自主實施網絡攻擊、智能體社交平台及GEO投毒的風險

風險分類:新增智能體與具身智能

框架延續「風險分類、技術應對、綜合治理」的核心邏輯,風險仍分為內生、應用及衍生安全風險,各類之下的小類重新劃分如下:

  • 人工智能內生安全風險:模型、算法、數據,以及算力設施與運行環境

  • 人工智能應用安全風險:智能體、具身智能、衝擊網絡安全、信息內容、侵害個人信息權益、現實安全

  • 人工智能衍生安全風險:社會、環境、文化、倫理

2.0版的「認知安全風險」不再單列,「信息繭房」及操縱社會認知等內容分別歸入信息內容及現實安全風險。

技術應對:智能體身份與人工審批

針對智能體,框架提出為每個智能體賦予唯一身份標識,只授予完成任務所需的最小權限,並在關鍵節點設置強制人工審批。針對網絡安全,框架提出在識別到用戶有網絡攻擊意圖或行為時,差異化降低模型能力或採取拒答策略。具身智能方面,框架提出配備安全失效保護和緊急停機等能力。

綜合治理:新增沙箱監管

綜合治理措施新設「構建柔性、動態、可控的沙箱監管環境」一組,內容包括:

  • 結合行業分類與風險分級制定沙箱規則,金融、教育、廣播電視、衞生健康等行業分別制定入箱標準

  • 動態調整測試期限及範圍,准入向初創企業、中小微企業和公共服務項目適當傾斜

  • 探索責任豁免:無主觀過錯且風險可控的行為可探索豁免,危害國家安全、侵犯人身權益、造成重大損害或故意實施的違法行為,不因進入沙箱而免責

  • 建立沙箱測試數據共享平台,完善測試結果跨部門認可規則

框架另新增「完善人工智能驅動的網絡安全防護體系」一項。框架未有說明沙箱監管的主管部門及實施時間表;附件1提及的人工智能應用安全分類分級國家標準,亦未列出發布時間。

本會將持續關注智能體風險管理框架及沙箱監管規則的後續配套標準。

資料來源:國家互聯網信息辦公室網站《人工智能安全治理框架3.0》全文《人工智能安全治理框架2.0》全文