互いに競い合う実験室が、互いに足を引っ張り合う内容の協定に、あと一歩で署名しそうになった。

報道によると、OpenAIとAnthropicは今年の早い時期に、拘束力のある協定の締結に近づいていたという。これにより双方はそれぞれ相手のモデルをテストし、脆弱性や潜在的な安全上のリスクを探すことができる。公開された条項によれば、双方は相手の商用モデルへのプログラミング上のアクセス権を得て、自ら脆弱性テストを行い、相手のデータを保持することは禁止されている。

範囲は非常に明確で、未発表のシステムは含まれていない。つまり、検査できるのはすでに売り出されたものだけで、まだ出ていない部分は社内に留まる。この取り決めは検証の権限を同業他社にある程度委ねる一方で、同業他社の判断を一種の外部監督へと変えている。

この協定が最終的に署名されたかどうかは定かではない。最も敏感な検査を競合相手に任せるには、必要なのは善意ではなく、双方が相手がルールを守ると信じることだ。互いに競合関係にある2社にとって、最も希少な資源はいつだって信頼である。両社は同時に相手の欠点をあぶり出しながらも、相手に自分たちの切り札を見抜かせたくないのだ。

同じ週に、ある企業の責任者が、どちらか一方がまだ上場まで到達できるのかを公に疑問視し、もう一方は直接、選択肢から外した。業界の信頼は、何かを証明する必要があるときにだけ持ち出されるもののようだ。

安全協力の上限は、通常、公開範囲の中にある数行の文言に書かれている。

#人工智能 #安全