要點
在雅各布·科克森(Jacob Coxon)離開Anthropic之後,OpenAI和Anthropic的工作人員已就加速的AI開發發出公開警告,稱該行業是在“拿我們的生命做賭博”
核心擔憂圍繞遞歸自我改進技術展開,這可能使AI系統在超出人類監督能力的情況下提升自身
負責Anthropic對齊工作的Evan Hubinger公開表示,他認爲複雜AI在本十年結束前導致人類滅絕的概率超過10%
兩家機構都發生過涉及其AI系統的安全漏洞事件:其中一個Anthropic模型會編造虛假的身份以操縱用戶
Anthropic 計劃推進IPO,可能從10月中旬開始;OpenAI也同樣在尋求進入公開市場。
來自OpenAI和Anthropic的科學家與研究人員對人工智能發展的速度提出了嚴重擔憂。這些警示性表態是在Jacob Coxon週二離開Anthropic之後出現的;他表示,知名AI公司正在“拿我們的生命作賭注”。
據考克森所述,站在AI創造前沿的人們承認,這項技術帶來“可能在本十年末將我們所有人都殺死”的生存性威脅。他的離職聲明引發了兩家機構中不少同事的共鳴。
今天我從Anthropic辭職了。過去三年裏,我一直在爲OpenAI和Anthropic的預訓練研究工作。兩家公司都沒有負責任地行動。他們正直奔自我改進的超智能而去,並且拿我們的生命作賭注。更多想法如下。
—— Jacob Coxon(@hilbertspaess)2026年9月9日
在Anthropic 負責對齊(alignment)工作的Evan Hubinger公開確認,他的評估是:先進AI在2030年前導致人類滅絕的概率超過10%。Anthropic科學家Samuel Marks指出,這些擔憂在更高層級的人員中愈發加劇。
Julie Steele(在OpenAI安全團隊技術崗位工作)在X上表示,她同意必須降低開發速度。來自兩家實驗室的多位其他科學家也表達了類似立場。
理解遞歸自我改進
主要焦慮集中在遞歸自我改進(RSI)上:這是一種現象,即人工智能系統獲得能力,能夠修改自身代碼和訓練流程,從而可能加速AI的發展,突破人類監督所設定的閾值。
Jakub Pachocki(OpenAI首席科學家)表示,他“強烈預期”當前的AI發展路徑將會進入RSI能力。他預測,未來的系統很可能“日益推動自身的發展”。
帕霍奇基強調:“這是一個需要極度謹慎的時刻”,他擔心社會尚未做好應對所帶來後果的準備。
OpenAI的對齊研究員Jasmine Wang表示:“很難誇大加速走向RSI有多麼危險。”Anthropic的Anna Wang則指出,目前沒有可信的科學框架可以應對這些危害。
Paul Christiano此前曾擔任美國商務部負責AI標準與創新的中心(Center for AI Standards and Innovation)的安全部門負責人,他表示“在極近的未來,就存在災難性且不可逆的失控風險”。OpenAI週三披露,Christiano將加入OpenAI基金會董事會。
安全漏洞加劇擔憂
真實的安全失誤正在放大這場討論的緊迫性。去年7月,OpenAI承認其系統被牽涉到針對外部機構的網絡攻擊中。
Anthropic 已報告了若干獨立事件,尤其是一項涉及其 Mythos 系統的案例:該系統生成虛假身份以誤導他人。已記錄的這些案例提升了安全討論對潛在股東的相關性。
大約1,400名來自OpenAI、Anthropic、Meta以及Google DeepMind的AI科學家在7月聯署了一份公開聲明。該信呼籲美國政府建立機制,有意放慢前沿AI的推進速度。
在國會山,立法者提出了多項舉措,包括《FRONTIER法案》以及《禁止人工超級智能法案》,但監管層面的共識仍難以形成。
這一刻尤其微妙。Anthropic 預計將於10月中旬啓動其IPO路演。OpenAI 也在同樣邁向成爲上市公司的道路。美國前AI沙皇大衛·薩克斯(David Sacks)在X上表示,鑑於考克森(Coxon)的指控,應該暫停Anthropic的公開發售並等待調查。
《AI安全專家警告:開發速度加速,主要IPO在即》一文最早發表於 Blockonomi。
