:17
中國科研團隊發佈《全球大語言模型安全防範能力測評報告(2026)》,首次以統一標準對38個主流大模型開展“體檢”,揭示其在複合攻擊(如場景僞裝+示例誘導)下安全邊界承壓,最高越獄成功率53.8%,
並提出內生化安全嵌入等治理建議。
中新網北京7月4日電 (記者 張素)大語言模型逐漸成爲公衆獲取、理解和使用科技知識的重要工具,其在有用性與安全性之間如何保持穩定邊界?對此,中國科研團隊對全球主要大語言模
本文转载自:中国新闻网
原文链接:http://m.chinanews.com/wap/detail/cht/zw/10652677.shtml
本文由 XZ导师app 自动发布 | 发布时间:2026/7/26 14:34:25