Anthropicは「自社のAIが人類に対して生存のリスクをもたらし得る」との趣旨を目論見書のリスク要因に書き込んだ。FTによれば、リスク要因がほぼ3分の1を占める。ロイターは、開示の中で、モデルがすでに示している、または示す可能性のある行動として、稼働停止への抵抗を試みること、情報を隠すことや操作すること、さらにこれに類する恐喝のような行為が挙げられていると報じた。
これは、弁護士の標準的な免責文言なのか、それとも同社がモデルの能力を具体的にどう判断しているのかは、開示そのものからはなお判別できない。しかし同じ文書の中で、これらの行動を列挙しながら、一方では今後数年に向けてクラウドと計算(算力)基盤インフラへの投資として5180億ドルを計画している。
これは、弁護士の標準的な免責文言なのか、それとも同社がモデルの能力を具体的にどう判断しているのかは、開示そのものからはなお判別できない。しかし同じ文書の中で、これらの行動を列挙しながら、一方では今後数年に向けてクラウドと計算(算力)基盤インフラへの投資として5180億ドルを計画している。