← 返回文章列表

GPT-5.6 全面公開上線:30 天審查關卡成了美國前沿 AI 的新常態

Nils Liu
OpenAI GPT-5.6 AI 政策 AI 模型 CAISI 白宮行政命令 Enterprise AI 新聞觀察

重點摘要

GPT-5.6 三個模型 7 月 9 日全面公開,距離 6 月 26 日限量預覽只隔 13 天。定價與跑分之外,真正值得記住的是白宮這套 30 天前沿模型審查機制,如今已經連續套用在同一個模型家族身上三次。

GPT-5.6 全面公開上線:30 天審查關卡成了美國前沿 AI 的新常態

GPT-5.6 三個模型今天正式對所有人開放。Sol、Terra、Luna 這三層命名的產品線,從 6 月 26 日限量開放給大約 20 家政府審核通過的企業,走到 7 月 9 日全面公開,中間只隔了 13 天。多數報導把重點放在定價表和跑分成績,我認為真正該記進備忘錄的是另一件事:這套讓白宮先審查、企業再上線的流程,已經連續在 OpenAI 身上跑過三輪,代表它已經從一次性行政程序,變成美國前沿 AI 模型發布的固定關卡。

先說我的判斷,歡迎打臉:未來 12 個月內,任何達到「涵蓋前沿模型」門檻的新模型,不管是 OpenAI、Anthropic 還是 Google 的產品,發布前都得預留 2 到 4 週給政府審查,這個窗口不會縮短,只會隨著審查機構經驗累積而變得更制度化。如果你在企業裡負責 AI 供應鏈規劃,過去半年你應該已經被迫為類似的延遲吃過苦頭。你觀察到的實際延遲天數,跟我這個預測對得上嗎?

事件摘要

GPT-5.6 的三個型號定價分層清楚。Sol 是旗艦款,每百萬輸入代幣 5 美元,輸出 30 美元。Terra 主打性價比,輸入 2.5 美元,輸出 15 美元,OpenAI 自己講的目標是「效能接近 GPT-5.5,價格砍半」。Luna 是走量的入門款,輸入 1 美元,輸出 6 美元。

這條產品線第一次露面是 6 月 26 日,當時白宮要求 OpenAI 只開放給約 20 家通過政府審核的機構,一般開發者連 API 文件都看不到。轉折點在 7 月 9 日,Engadget 的報導證實,川普政府在多輪測試與會談後,同意讓三款模型完全公開,商務部底下的 AI 標準與創新中心(CAISI)負責執行這輪額外測試。

這套流程的法源是川普 6 月 2 日簽署的 AI 網路安全行政命令。命令建立了一個「涵蓋前沿模型」的分類標準,符合門檻的模型必須在公開發布前,給政府最多 30 天的存取權限進行審查。白宮官網公布的行政命令原文寫明這套機制屬於自願性質,不構成強制發牌或事前核准。但 OpenAI 自己在系統卡裡的措辭是:「我們不認為這種政府存取流程應該變成長期預設做法。」一邊配合、一邊在文件裡寫下不情願的立場,這種姿態才是這則新聞真正該被記住的地方。

數字背後的真相

先算時間帳。6 月 26 日限量預覽到 7 月 9 日全面公開,中間 13 天。這不是 OpenAI 第一次碰上這種節奏。我在 6 月 30 日的文章裡算過,Sol Ultra 在 Terminal-Bench 2.1 拿下 91.9% 的分數,當時模型一樣卡在「僅限約 20 家夥伴」的階段。同一款模型,光是從「發布」走到「真正能用」,就經過兩次獨立的政府審核節點。

把這套審查窗口放進 OpenAI 自己的發布節奏裡看更有意思。如果前沿模型的大版本更新週期抓一季,也就是 90 天左右,30 天的政府審查上限就佔掉三分之一的週期。每次要推出真正意義上的旗艦升級,工程團隊光是等審核結果,就得騰出相當於一個季度三分之一的時間,這還沒算進審查不通過需要重新調整安全機制的情況。這個比例,比任何一次性的「延遲幾天」都更能說明這套機制對產品節奏的實際拖累。

再看 Terra 的定價邏輯。輸入 2.5 美元、輸出 15 美元,官方說法是效能貼近 GPT-5.5 但價格砍半。這個降價幅度不是單純技術進步能解釋的,中國模型現在已經吃下美國企業 API token 用量的 30% 到 46%,Terra 的價格戰打法,更像是針對這波市場流失做出的直接反應。

至於「30 天審查」是不是真的只是自願,OpenAI 自己的行為給了答案。如果真的可以完全不理會這套流程,最直接的做法就是不提交、不等待,照原訂時程上線。OpenAI 沒有這樣做,選擇把技術專家留在華府持續溝通,換來的是 7 月 9 日這個日期,而不是原本可能提早達成的公開時間。一家公司願意用產品上市時間去交換政府的許可,這個交換本身就說明了這套機制的實際約束力,遠比「自願」兩個字聽起來重。

接下來值得觀察的指標

Google Gemini 下一款旗艦模型的發布節奏我在 7 月 2 日的報導裡提到 Gemini 3.5 Pro 已經延後上市,如果它正式發布時也出現類似「先限量、後公開」的兩段式節奏,這比任何單一公司的個案更能說明這套機制已經制度化,不是 OpenAI 一家的特例。

跨州司法調查會不會意外扯出這套審查紀錄6 月 16 日的文章提到 42 州檢察長對 OpenAI 發出傳票,焦點原本是 ChatGPT 的討好設計與未成年保護。一旦這類跨州證據開示程序往前推進,「自願」這個定性經不經得起檢視,值得追蹤。

Terra 在獨立評測平台的實際排名。7 月 9 日之前,Terra 只有官方數字可以參考。現在 API 公開了,LMSYS Arena 之類的獨立平台會很快跑出真實對戰數據。如果 Terra 真能維持官方宣稱的水準,2.5 美元的輸入定價會直接對 Claude Sonnet 4.6 的採用率造成壓力;如果掉分明顯,這波降價就只是行銷話術。

如果這篇對你有幫助,訂閱電子報 可以第一時間收到 AI PM 實戰洞察與 GenAI 落地案例。

來源

訂閱最新分享

加入電子報,第一時間獲取關於金融 AI Agent 實戰與架構設計的最新文章。不訂閱你會慢別人一個週期!

絕不發送垃圾信。隨時皆可取消訂閱。