AI 安全指數 2026:Anthropic 拿下業界最高分,也只有 C+
重點摘要
未來生命研究所公布 2026 夏季 AI 安全指數,Anthropic 以 C+ 拿下九家業者裡的最高分,OpenAI 和 Google DeepMind 並列 C。評分方法有一半靠廠商自填問卷,這個數字該打多少折扣,我拆給你看。
未來生命研究所 Future of Life Institute 昨天公布 2026 夏季 AI 安全指數,九家主要 AI 廠商裡分數最高的是 Anthropic,成績單寫的是 C+。我認為這份報告真正值得追問的地方,是評分裡有一大塊建立在廠商自己填的問卷上。這種左手評右手的設計,你覺得該打幾折,如果你在稽核或合規領域待過,很想聽聽你怎麼判斷這類自評數據的可信度。
事件摘要:九家公司交出的成績單
這份 AI 安全指數由七位獨立審查人共同評分,涵蓋 37 項指標,分成六大領域:風險評估、現行危害、安全框架、存續風險、治理與問責、資訊透明。評分依據截止到 6 月 3 日,來源包括公開的模型卡、研究論文、基準測試結果,再加上研究所寄發給各公司的專門問卷。
成績單攤開來看,落差不小。Anthropic 拿 2.66 分,換算成 C+,九家裡最高。OpenAI 2.28 分和 Google DeepMind 2.01 分都是 C。往下掉得更明顯,Meta 只有 1.32 分,D+。xAI 0.65 分,DeepSeek 0.47 分,Mistral 0.33 分,三家一起吊車尾,全部是 F。加州大學柏克萊分校教授 Stuart Russell 在報告裡的評語很直白:「業界確實有人在做安全這件事,但能力競賽已經走到更極端的地步。」
比分數本身更值得注意的是報告裡點名的一個現象。審查人寫道,Anthropic、OpenAI、Google DeepMind 和 Meta 這幾家原本都公開承諾過,一旦系統逼近特定危險門檻就會暫停開發。報告用「不斷移動的球門」形容這幾家公司這半年的做法,說這種反覆修改承諾的行為,等於把整個產業的安全框架一起拖垮。換句話說,安全研究確實有人在做,真正生變的是原本說好的紅線,現在說改就改。
數字背後的真相:C+ 是最高分,這件事本身就是警訊
先把量尺弄清楚。這套評分本質上是相對排名,七位審查人打完分數再互相校準,跟大學申請的推薦信一樣,同一個「優秀」放進不同審查人手裡,尺度可能差很多。更關鍵的是,37 項指標裡有相當比例的數據來源是公司自己回答的問卷,缺乏第三方稽核,也沒有審計軌跡可查。這代表分數高低某種程度反映的是「誰比較會寫合規文件」,不完全等於「誰的系統真的比較安全」。
即使把這個折扣打進去,Anthropic 的 C+ 依然是九家裡最高分,這件事本身就值得停下來想一想。如果把美國大學常見的 4.0 GPA 尺度套進來,C+ 大概落在 2.3 分上下,落在及格邊緣,離優等生的區間還有一段距離。業界公認做得最認真的公司,最終成績單寫的是「勉強及格」,那其他八家呢。
用費米估算換算一下規模:37 項指標乘以 7 位審查人,一家公司大概對應 259 個獨立評分點,九家公司加總下來接近 2,300 筆評估紀錄,全部壓縮在一份公開報告裡打包呈現。這個工作量不小,但也代表任何單一指標的誤差,很容易被平均掉、被稀釋進總分裡,讀者看到的 C+ 或 F,底下藏著相當粗的顆粒度。
再看那個「移動球門」的說法。安全暫停承諾原本就沒有法律約束力,沒有第三方能強制執行,也沒有獨立稽核團隊可以隨時進場檢查。所以與其說這幾家公司「違背了承諾」,更接近的講法是,這些承諾從一開始就是軟性的公關語言,缺乏可執行的機制。真正該問的問題,是這種靠自律的暫停機制,能不能扛得住模型每隔幾週就要迭代一次的競爭節奏。GPT-5.6、Claude Sonnet 5、Gemini 3.5 這類新模型的發布速度,跟完整安全紅隊測試需要的時間,中間的落差反映的是結構性壓力,跟哪家公司是否故意偷懶關係不大。
接下來值得觀察的指標
第一個指標是歐盟 AI 法案的執行細則。如果這份報告被拿來當作立法論據,用來證明自願性承諾靠不住,接下來幾個月應該會看到監管機構開始要求強制性的第三方稽核條款,而不是繼續放任公司自填問卷。
第二個指標是下一份指數的自評比例會不會下降。未來生命研究所如果真的把這次「自評數據可信度」的爭議聽進去,冬季那份報告的方法論裡,公司自填問卷佔比應該會下修,改成更多第三方可驗證的來源。這個比例的變化,比分數本身更能說明報告有沒有在進化。
第三個指標是那三家吊車尾的公司,xAI、DeepSeek、Mistral,接下來半年會不會公開任何安全框架的更新。如果分數繼續掛零卻沒有任何政策回應,代表這幾家公司壓根不把這份指數放在考核範圍內,所謂的「業界壓力」大概只對三家龍頭公司有效,對後段班沒有約束力。
這三個指標我沒有答案,接下來幾個月會持續追蹤。如果你手上有第三方稽核或紅隊測試的實戰經驗,這份報告的評分顆粒度到底夠不夠細,很想聽聽你的看法。
如果這篇對你有幫助,訂閱電子報 可以第一時間收到 AI PM 實戰洞察與 GenAI 落地案例。
延伸閱讀:聯合國首次 AI 治理對話開幕、Anthropic Claude Sonnet 5 成為預設模型
參考來源:
相關文章
G7 峰會 2026:Altman、Amodei、Hassabis 首次同台,AI 主權角力浮上檯面
6 月 15 至 17 日,OpenAI 的 Sam Altman、Anthropic 的 Dario Amodei、Google DeepMind 的 Demis Hassabis 將同台出席法國埃維昂 G7 峰會,G7 史上頭一次。背後是美國拒絕 AI 多邊協議、歐洲搶奪 AI 主權的路線裂縫,也是兩家估值逾 9650 億美元 AI 公司上市前的一次政治站台。
OpenAI 暫緩 Astra 部分開發:初步測試無法排除 Critical 資安能力
OpenAI 表示,Astra 的初步評估已強到無法排除 Critical 資安能力,因而暫停不符合加強防護規範的內部工作;公司尚未公布完整分數與發布日期。