中國開源 AI 安全風險升高,GLM-5.2 能力逼近西方巨頭卻更難管
SaferAI 指出,中國 Z.ai 的開放權重模型 GLM-5.2 已逼近 GPT-5.5 與 Claude Opus 4.7 的安全能力,但在非官方環境中可被移除護欄,開源 AI 的風險邊界正被重新檢視。
📌 來源: techorange.com/2026/08/25/china-z-ai-glm-5-2-safety-gap 【20260825 資訊安全】【Z.ai】【主題:開源 AI 安全警訊】中國 AI 開源模型能力逼近西方巨頭,但任何人都能下載並移除安全護欄 發布者:anson4139 SaferAI 最新報告指出,中國廠商 Z.ai 推出的開放權重模型 GLM-5.2 ,在網路安全與生物危害知識方面,能力已拉近到接近 GPT-5.5 與 Claude Opus 4.7 的水準。⚠️ 不過,報告同時點出一個更大的問題:和西方主流閉源模型相比,開源模型的安全實踐明顯跟不上其任務能力成長,風險邊界不會因為模型能力進步而自動消失。 SaferAI 透過 Z.ai 官方 API 測試後發現,GLM-5.2 對網路攻擊或生物危害相關問題,並沒有像多數閉源模型那樣明確拒答。這代表一旦模型被下載到非官方硬體環境,原本的安全措施可能被修改、移除,甚至透過微調與系統提示詞改寫進一步繞過。🔍 文章也提到,主流閉源模型雖然有分類器、拒答訓練與 API 管制,但仍可能遭到越獄攻擊;而開放權重模型若缺乏額外防護,風險通常更高。另一個安全組織 Far.ai 甚至發現,xAI Grok 4.5 與 Google Gemini 3.1 Pro 也存在多種通用越獄手法。🛡️ 從政策面來看,史丹佛大學網路政策中心專家 Graham Webster 指出,中國 AI 監管多聚焦政治敏感內容、假訊息與社會穩定,對模型的網路攻擊能力或生物危害風險著墨較少;相較之下,美國對這類災難性風險更敏感。SaferAI 執行董事 Henry Papadatos 則提醒,攻擊者採用新工具的速度,往往比防禦者更快。⏱️ #資訊安全 #AI #開源AI #OpenAI #Anthropic #Google #資安 出處:TechOrange 中國開源 AI 安全風險升高,GLM-5.2 能力逼近西方巨頭卻更難管 — AI 生成解析圖
https://blog.buclaw.org/posts/ai-glm-5-2-mt8e9uz2