大語言模型“安全體檢”報告為AI治理提供參考
2026年07月04日08:18 | 來源:新華社
222
222
訂閱已訂閱已收藏
收藏點擊播報本文,約
當AI回答一個專業科技問題時,能否確保內容可靠且安全?7月2日發布的全球大語言模型科技安全防范能力測評報告顯示,在某些語境下,部分測試模型仍存在多重安全隱患。
在當天舉行的2026全球數字經濟大會雲智算安全論壇上,東壁科技數據有限責任公司聯合上海財經大學數字經濟學院共同發布了這份測評報告。
據介紹,測評方構建了包含313條問題的測試集,覆蓋生物化學、網絡安全等前沿領域,對全球38個大語言模型進行了全景式掃描。為評估科技內容的可靠性,測評方還從東壁全球科技文獻數據平台選取了近10萬份科技文獻材料作為參考。
上海財經大學數字經濟學院院長趙琳介紹,測評發現,科技內容的可靠性越高,不一定越安全,關鍵在於能否把可靠知識限制在合規范圍內。
我國高度重視完善人工智能治理,近年來不僅將其寫入政府工作報告,還向世界提出《全球人工智能治理倡議》,推動人工智能向善發展。
東壁科技數據創始人吳登生表示,大模型安全測評正從單一的“關鍵詞屏蔽”轉向綜合的風險評價。持續完善測評體系,未來將為全球人工智能的健康發展和精准治理提供借鑒。(記者劉禎)
(責編:趙竹青、申佳平)
關注公眾號:人民網財經
分享讓更多人看到
- 評論
- 關注
推薦閱讀
打開客戶端體驗更多服務
打開































微信掃一掃


第一時間為您推送權威資訊
報道全球 傳播中國
關注人民網,傳播正能量