跳至主要內容
← 返回文章列表

Anthropic 國防禁令獲法院支持:安全限制如何變成可預期的產品行為

AI Anthropic AI Safety Product Design 新聞觀察

重點摘要

美國上訴法院以 2-1 支持把 Claude 排除於國防供應鏈。判決確認政府的採購權限,卻沒有證明移除安全限制能提高可靠度;產品團隊仍須分清楚合理拒絕與誤擋任務。

Anthropic 國防禁令獲法院支持:安全限制如何變成可預期的產品行為

Anthropic 挑戰國防供應鏈排除令遭到駁回,美國哥倫比亞特區巡迴上訴法院以 2-1 支持政府決定。這份判決留下的技術問題仍未解決:移除模型的使用限制,能否減少任務中斷,又不增加有害輸出。法院判斷行政權限是否合法,並未提供兩種設計在相同任務下的可靠度比較。判決 路透報導

裁判日期是 2026-09-25,原文沒有發布時刻。路透這版報導刊於美東 25 日 12:08,即台北 26 日 00:08。本文採台北 26 日出刊,查核截止為 20:25,選用仍在 48 小時範圍內的前一日實質裁判;報導跨過午夜,不代表裁判日期也變了。日期 刊登時間

爭議源於 Anthropic 不願取消 Claude 對致命自主武器及大規模境內監控的限制。多數意見接受國防部的風險判斷,認為模型內建限制與合約分歧,可能使軍事任務無法按預期執行。不同意見則主張,公開而誠實地執行使用限制,不應被解讀成法律所指的供應鏈操控風險。兩方理由

判決也交代了一個容易混淆的機制。模型交付至機密系統後,Anthropic 否認能再存取或修改它;安全訓練仍會影響既有版本的行為,新版本也可能帶入新的限制。這與供應商隨時遙控關閉已部署模型,是不同的能力,不能混寫。交付與訓練

卷宗中的實例包括 Claude 曾拒絕處理美國 CDC 的傳染病防治研究提示。Anthropic 表示,工程師與政府使用者合作後已解決相關問題。這支持拒絕行為確實會影響正當工作,也保留了修正的可能;它沒有提供所有任務的誤擋比例。案例與公司回應

把拒絕條件列入產品承諾

我傾向保留清楚的用途限制,同時要求供應商說明模型如何執行它。若一項工作本來就不在服務範圍內,提早拒絕能讓客戶另作安排;若已接受的工作做到一半才被模型誤判,客戶承擔的是無法預期的中斷。兩者都可能顯示同一句「無法協助」,但需要不同的產品處理。

沿著 CDC 案例,假設研究人員提交一份已獲授權的防疫文件,模型因誤判用途而停止整理。合適的改進應讓這類任務恢復,也要確認原本禁止的用途沒有因此變得可執行。只統計拒絕次數下降,會把修好誤擋與放寬保護混在一起;只強調拒絕得很堅決,也無法回答使用者能否完成合理工作。

這使版本交付多了一項實際責任:供應商除了公布能力提升,也應讓客戶知道原本可做的工作是否改變。當使用者無法辨別是模型能力不足、服務界線不同,還是錯誤攔截,增加一段免責文字不會減少重試。我較支持提供可回報的拒絕原因,並把已確認的誤擋案例納入後續版本檢驗;這是產品建議,並非判決要求或 Anthropic 新宣布的功能。

本次裁判維持的是國防供應鏈排除。加州法院先前對另一法源下的平行措施作出不同裁判,不能把這次結果寫成全面禁止民間使用 Claude。Anthropic 表示正考慮進一步司法審查。法律範圍 平行案件 市場准入的限制已獲這份判決支持;至於哪種安全設計更可靠,仍需要同時交代正當任務被誤擋,以及禁止用途被放行的結果。

封面沿用本站較早的 Anthropic 與五角大廈議題插畫,並非本次法院現場照片;新聞圖片因名稱解析失敗未能下載。

來源:

訂閱最新分享

加入電子報,第一時間獲取關於金融 AI Agent 實戰與架構設計的最新文章。不訂閱你會慢別人一個週期!

絕不發送垃圾信。隨時皆可取消訂閱。