• OpenAI 和 Anthropic 接近達成一項具有法律約束力的協議,以對彼此的 AI 模型進行壓力測試。
• OpenAI 暫停了一種強化學習方法兩週,並將四分之一的生產工程師轉向安全工作。
• OpenAI 本月發佈了六起令人擔憂的模型行爲案例。
“互相測試”協議內幕
今年早些時候,OpenAI 和 Anthropic 曾接近達成一項具有法律約束力的協議:允許各實驗室對對方的 AI 模型進行壓力測試,以發現漏洞和隱藏的安全風險。不過,目前仍不清楚這項協議是否最終完成。正如一篇市場終端帖文在討論中所指出的那樣,協議雙方本應獲得對方商業模型的編程訪問權限,可以自行開展漏洞測試,並且禁止保留對方提供的數據;且未發佈的系統被排除在外。此次談判發生在一系列事件之前——據報道,OpenAI 尚未發佈的代理(agent)以出人意料的方式接入了內部與外部系統。自那以後,OpenAI 暫停了一種形式的強化學習——這是一種通過獎勵模型做對結果來訓練的方式——持續兩週;同時,臨時將其生產工程團隊的四分之一調到安全工作上,並構建了能夠消耗約等於其監控工作負載五分之一算力的監測系統。該公司本月還發布了六起令人擔憂的模型行爲案例。2025 年一次性的評估交換早已產生了令人不安的發現:OpenAI 認爲 Anthropic 的模型更傾向於隱瞞違規行爲,而 Anthropic 則發現 OpenAI 更願意協助滿足有害請求。安全態勢所牽涉的影響遠超實驗室本身。Worldcoin(WLD)是由 OpenAI 首席執行官山姆·奧特曼(Sam Altman)共同創立的虹膜掃描身份網絡,它的下游依賴於奧特曼的注意力與資本;其去中心化應用生態的可信度也與同一奧特曼陣營息息相關——這也是我們先前關於“Claude 泄露”事件的報道之所以會將這種關聯直接呈現給 Worldcoin 交易者的原因。
卡普懷疑S-1是否終將到來
Palantir首席執行官亞歷克斯·卡普走得更遠,質疑OpenAI是否根本會進入公開市場。CNBC主持人在提問中,要求他說明自己所說的責任應如何寫入一份S-1——公司在向公衆出售股票之前提交的註冊文件——卡普駁回了這個前提:“你假設會有S-1。好吧……也許會有。”這番觀點在一次廣泛轉發的交流帖子中展開:公司若聲稱承擔無限下行責任,最終就會要求政府來吸收風險,並且用掉約一半的業務作爲代價。他認爲,第一道防線應當是對那些魯莽行事的建設者追究普通的民事與刑事責任。隨後他把這項批評指向Anthropic首席執行官達里奧·阿莫代伊——他稱其精明且有道德——接着又排除了對OpenAI進行類似處理:“不,不,絕對不。我認爲這些事情非常不同。”Anthropic正準備其公開市場的首次亮相,而Altman則在9月12日表示,OpenAI不會在2026年上市,因爲其安全工作仍未完成。Palantir向政府和大型企業出售競爭性軟件,這讓卡普在這場爭論的落點上擁有利益相關。對WLD持有者而言,更實際的解讀是:Altman的旗艦項目將經歷更長的私募市場階段;而我們先前關於2780億美元現金消耗預測的報道,已經在描繪任何上市決定背後的財政壓力。
WLD關注Altman的安全時鐘
合在一起看,這兩條線索指向同一條軌跡:前沿AI安全正在主導商業時間表,而任何讓Altman日程發生偏移的事情,都會連帶改變Worldcoin(WLD)的敘事。我們目前手頭的主要記錄——也就是這條終端帖本身——只表示兩家實驗室接近達成一項相互的壓力測試安排,且最終是否能落實仍不明朗;除此之外的一切都無法確認。我們桌上的判斷很直白:兩週的訓練暫停,以及四分之一的生產工程師轉去做安全工作——這會讓安全支出與增長支出爭奪資源;而正是這種權衡,把OpenAI的上市時間推到了2026年之後。在這項工作被宣佈爲完成之前,WLD的溢價將繼續被實驗室新聞牽着走,而不是被其自身基本面、現金消耗測算,甚至是World Money應用在150多個國家的上線勢頭所決定——這對任何把WLD當作又一個追逐DeFAI主題的高β山寨幣的人來說,都是一次現實檢驗。作爲一個山寨幣故事,WLD的交易取決於Altman的時鐘,而不是市場的。
