文 | 象先志
一覺醒來,全世界 AI 能力退化一萬倍,
只有我還是普通人。
于是人們驚呼我居然會調(diào)用 API 接口,
甚至本地部署了龍蝦,
我成為了這個世界最會使用 AI 的人。
這是一套非常典型的短劇戲碼,大家都知道劇情是如何發(fā)展的。而在當下的美國 AI 發(fā)展的路徑下,這個劇本在未來是有可能成真的:全世界的 AI 能力下降一百倍,普通人再也摸不到前沿模型,只有少數(shù)人還用得起。
如果開機拍攝,編劇欄里應該寫上黃仁勛的名字。7 月 24 日,這位此前從未在 X 發(fā)過帖的英偉達 CEO,發(fā)出了自己的第一條帖子,一封 35 家公司聯(lián)名的公開信,整封信呼吁的就一件事:別讓這個世界成真。

技術殺手 2049
在開源時代下,每個行業(yè)都可以做到低成本部署本地模型:一個小型的律師事務所,打開電腦就能調(diào)一個 2.8 萬億參數(shù)的模型審合同,一個月成本幾十美元;一個縣城醫(yī)院,把影像模型部署在自己的服務器上,數(shù)據(jù)不出院門;跨境電商的小團隊,拿開源模型微調(diào)出自己的翻譯工具,不用看任何一家公司的臉色。Token 便宜到不值得單獨算賬,就像沒人會把消耗的電費一筆筆詳細計入。
把開放權重抽掉,這個世界立刻就變了。前沿模型只剩少數(shù)幾家,都鎖在 API 后面。律所審合同的錢翻幾十倍增加,用之前要先算賬;醫(yī)院想用 AI,要么花大價錢買接口、且無法保證數(shù)據(jù)安全,要么用回歸傳統(tǒng)手作,純靠醫(yī)生人眼審片。就醫(yī)環(huán)境越來越惡劣,醫(yī)院經(jīng)營成本不斷太高。
接下來是結構性的變化:錢只在一個地方掙。通殺的大模型公司收所有的租,行業(yè)里沒有第二層玩家,做不了模型,只能做模型的包裝,利潤率由上游定價表決定。
科研進步的代價甚至會更高。前沿能力集中在少數(shù)幾個黑箱里,外部研究者拆不開、改不動、驗證不了,只能給黑箱做問卷調(diào)查。學術論文從 " 我們發(fā)現(xiàn) " 退化成 " 我們申請到了試用權限 "。一個領域的進步速度,從此由少數(shù)幾家公司的發(fā)版節(jié)奏決定。
當然,這是一個比較粗糙的分析框架。Maas 廠商自然還可以給各個行業(yè)的新業(yè)態(tài)售賣接口,但在利潤的層層加碼下,每個個體用到 AI 的成本仍舊會大幅增加。
模型有多強只是入場券,有多少行業(yè)用得上它,才決定 AI 能不能推動醫(yī)療、制造、科研這些行業(yè)往前走。只剩閉源的世界,等于把這個問題交給少數(shù)頭部模型公司的定價表來回答。而其他行業(yè)的主動性完全喪失,AI 的所謂賦能也將徹底不存在。
閉源模型的唯一出路是,LLM 是真的可以達到 AGI,那么就我們現(xiàn)在所有聊的 AI,就已經(jīng)是所有技術的唯一終點,任何其他的行業(yè)都不需要去加速進化,只要原地等著就好了。
這個假設不需要想象力,2022 年底之前的世界,基本就是這樣。
誰在掌握 AI 話語權
7 月 21 日上午,美國財政部長貝森特在 Fox Business 說,政府正在調(diào)查中國 AI 模型是否竊取美國知識產(chǎn)權,考慮制裁。他給出的理由是美國模型里的某些 " 水印 " 出現(xiàn)在了中國模型里,截至目前,這個說法沒有任何技術證據(jù)公開。

同一天下午,黃仁勛在得州沃斯堡接受了 Axios 專訪。他說:" 這些中國模型非常優(yōu)秀。優(yōu)秀的開源模型就應該被使用。" 蒸餾、向別的模型學習,是智能形成的基礎,監(jiān)管該落在具體違法行為上,籠統(tǒng)禁模型是另一回事。他還順手點了 Anthropic 的名,說它的網(wǎng)絡安全模型 Mythos 應該向所有人開放。
7 月 24 日,這位此前從未在 X 發(fā)過帖的人,發(fā)出了第一條帖子,一封聯(lián)名公開信,《開放權重與美國 AI 領導力》。微軟官網(wǎng)掛出的署名名單有 35 家:英偉達、微軟、Meta、IBM、戴爾、Palantir、Hugging Face、a16z、Y Combinator、Mozilla、Mistral、Perplexity、Replit,納德拉隨后轉(zhuǎn)發(fā)。名單里沒有 Anthropic,也沒有 Google。國內(nèi)媒體最初報道 OpenAI 同樣缺席,但微軟官網(wǎng)名單里出現(xiàn)了 OpenAI,這一處以官網(wǎng)為準。

這封信中提前聲明了所有風險:把先進 AI 集中在少數(shù)閉源模型后面,會制造少量單點故障,削弱競爭,把關鍵技術留在少數(shù)供應商手里。黃仁勛在專訪里說的更白,如果全世界只能用一個模型,整個世界就只剩一個攻擊目標。安全這面旗,過去舉在閉源陣營手里,這次被英偉達搶了過去。
英偉達為什么下場?原因是很明顯的。7 月 16 日 Kimi K3 發(fā)布后一周,費城半導體指數(shù)跌了 12.5%,英偉達短暫丟掉了全球市值第一。黃仁勛的判斷是市場讀反了,更便宜、更開放的 AI 會讓更多人用 AI,用的人多了,芯片和數(shù)據(jù)中心的需求只會漲。他說 DeepSeek 那次市場就誤讀過一回,這次是第二次。開源是英偉達天花板的組成部分,護盤護的是自己的生意,這一點不需要替他掩飾。
把賬再往下算一層,才是他真正坐不住的地方。英偉達的增長故事建立在 AI 向工廠、醫(yī)院、學校、農(nóng)場擴散上,這個擴散一旦只能靠少數(shù)閉源公司的銷售排期來推進,算力需求就從 " 人人都要 " 收縮成 " 少數(shù)人采購 ",產(chǎn)業(yè)鏈跟著見頂。
他在專訪里還有一句判斷:以國家安全的名義禁開源,美國會更脆弱,因為需求不會消失,只會帶著創(chuàng)新一起去別的地方。
真正把 " 那個世界 " 的恐懼說出來的,是近 200 家美國創(chuàng)業(yè)公司和投資機構。K3 發(fā)布后,它們火速組成 " 小科技聯(lián)盟 " 向政府喊話:如果封殺廉價的開源模型,初創(chuàng)公司就得回頭向 OpenAI 和 Anthropic 付高價 API 費,大量資金有限的公司會直接死掉。這 200 家公司喊的,就是第一節(jié)里 " 只能做模型的包裝 " 的處境。截至 7 月 25 日,封禁沒有落地,恐懼卻是真的。
AGI 未必會很早到來
同一周,北京沒有參與這場吵架,它在做另一件事。
7 月 23 日,北京市發(fā)改委等四部門印發(fā)《關于加快智能體引領發(fā)展的若干措施》,里面有一組新名詞:Token 即服務、智能體即服務、結果即服務。政策鼓勵 Token 計費從按量計費轉(zhuǎn)向按可交付結果計費,支持建設 "Token 工廠 ",發(fā)放 Token 券。再往前,7 月 3 日,北京數(shù)據(jù)集團已經(jīng)落地了首家國資 " 京算 Token 工廠 "。配套的說法是,行業(yè)評價指標正在從峰值算力轉(zhuǎn)向 " 每瓦 Token 數(shù) "。

這組政策并不難理解:北京在嘗試給 Token 建立公共計量和服務標準,把 AI 當水電煤來鋪。水電煤的核心屬性只有兩個,用得起,和隨時有。全國日均 Token 調(diào)用量 2024 年初還在千億級,到 2026 年 5 月已經(jīng)突破 170 萬億,兩年漲了一千倍。這個數(shù)字至少說明大規(guī)模使用已經(jīng)發(fā)生了,政策是在事后給它修管道。
再看兩個路線的分岔點。華盛頓在討論要不要限制中國開放權重模型,理由是安全和知識產(chǎn)權;北京在討論 Token 怎么計價、怎么發(fā)券,理由是供給。一邊把外國開放權重模型視作風險,一邊把開源生態(tài)、Token 工廠和服務券寫進產(chǎn)業(yè)政策。
Kimi K3 的權重發(fā)布倒計時頁已經(jīng)掛上 Hugging Face,月之暗面承諾在 7 月 27 日前交付完整權重,2.8 萬億參數(shù),免費下載,誰都可以拆開來改。

閉源陣營最有力的指控是:開源模型站在閉源探路的肩上,沒有 OpenAI 和 Anthropic 燒錢開路,開源無處可抄。這個指控部分成立,探路的錢確實是閉源燒的。另一半正在被改寫,K3 沒有只是把 Transformer 繼續(xù)堆大,它在 KDA、Attention Residuals 和 MoE 稀疏化上走出了自己的路線,開源陣營已經(jīng)開始自己開路。黃仁勛信里的那句 " 世界需要前沿的閉源模型,也需要前沿的開源模型 ",落點其實就是這個分工問題。
這場競爭還遠沒有結束。但顯而易見的是,太平洋這頭的我們,認為每個行業(yè)都還需要被 AI 做一遍,AGI 的實現(xiàn)也未必很快會發(fā)生。但太平洋那頭,OpenAI 和 Anthropic 這兩個閉源劇透的估值如果下來了,可能真的會迎來一場金融海嘯。