Anthropic 今回は何が「違法蒸留」なのかを😛 最新の「検知とAI濫用の取締りに関するレポート」で、ネット攻撃、監視活動、軍団(サイバーメディア)、「詐欺」、生物の濫用に加えて、中国のAI実験室7社による違法蒸留の詳細も公開されました!まず、蒸留でオープンウェイトのモデルを作って「知能の平等化」を図ろうという善意の取り組みは除外しましょう。中継地点によるプライバシー侵害は本当に恐ろしいので、くれぐれも悪用しないでください。。。
蒸留自体は合法な学習技術です。大規模で強力な「教師」モデルで大量の入力から回答を生成し、そのQ&Aを使って小さな「生徒」モデルを訓練し、より低コストでより高い能力を得るというものです。
レポートが定義する違法蒸留は、産業規模で、こっそりと、無許可で、あるモデルの能力を抽出して別のモデルにコピーすることです。その中核となる特徴は、詐欺によって支えられている点——偽の身分、盗まれた決済/バーチャルクレジットカード、盗難されたログイン認証情報、そしてAPIキーで、数千もの偽アカウントを構築します。
主な3つの経路:
1. 代理サービス/「中継地点」:代理サービスを通してリクエストをルーティングし、偽の身分、偽カードまたは盗まれたカード、盗まれたAPIキーで数千のアカウントを一括登録し、地理的制限を回避します。盗まれるのは、合法な企業や個人のAPI認証情報であることが多く、直接的に実在する顧客を傷つけます;
2. 第三者の転売業者から会話ログを購入
一部の代理サービス運営者は、ユーザーが知らない/同意していないにもかかわらず、ユーザーと米国のモデルとの全会話を保存し、それをまとめて実験室に売ります(たとえば商汤の蒸留パイプラインでは、このように購入した記録が使われたとのことです);
3. 無言の転送で自社ユーザーのリクエストを回す(最も隠密な手口):実験室は自社ユーザーの要求をこっそりClaudeに転送し、Claudeの回答を自社モデルの出力としてユーザーに返すと同時に、そのやり取りを保存して訓練に使います。これはMoonshotやDeepSeekのやり方です!このプロダクトの能力には感心せざるを得ません😆
ユーザーのプライバシーが売り飛ばされることが、最も深刻な結果です。DeepSeek、小米、Moonshotは自社ユーザーの会話をClaudeに食べさせていますが、ユーザーは一切知りません。多くのリクエストは、欧米でよく使われる第三者のモデルルーティングサービス経由で来ており、数百名のエンドユーザー、少なくとも十数種類の言語の氏名やメール、会社データが関わっています。
蒸留自体は合法な学習技術です。大規模で強力な「教師」モデルで大量の入力から回答を生成し、そのQ&Aを使って小さな「生徒」モデルを訓練し、より低コストでより高い能力を得るというものです。
レポートが定義する違法蒸留は、産業規模で、こっそりと、無許可で、あるモデルの能力を抽出して別のモデルにコピーすることです。その中核となる特徴は、詐欺によって支えられている点——偽の身分、盗まれた決済/バーチャルクレジットカード、盗難されたログイン認証情報、そしてAPIキーで、数千もの偽アカウントを構築します。
主な3つの経路:
1. 代理サービス/「中継地点」:代理サービスを通してリクエストをルーティングし、偽の身分、偽カードまたは盗まれたカード、盗まれたAPIキーで数千のアカウントを一括登録し、地理的制限を回避します。盗まれるのは、合法な企業や個人のAPI認証情報であることが多く、直接的に実在する顧客を傷つけます;
2. 第三者の転売業者から会話ログを購入
一部の代理サービス運営者は、ユーザーが知らない/同意していないにもかかわらず、ユーザーと米国のモデルとの全会話を保存し、それをまとめて実験室に売ります(たとえば商汤の蒸留パイプラインでは、このように購入した記録が使われたとのことです);
3. 無言の転送で自社ユーザーのリクエストを回す(最も隠密な手口):実験室は自社ユーザーの要求をこっそりClaudeに転送し、Claudeの回答を自社モデルの出力としてユーザーに返すと同時に、そのやり取りを保存して訓練に使います。これはMoonshotやDeepSeekのやり方です!このプロダクトの能力には感心せざるを得ません😆
ユーザーのプライバシーが売り飛ばされることが、最も深刻な結果です。DeepSeek、小米、Moonshotは自社ユーザーの会話をClaudeに食べさせていますが、ユーザーは一切知りません。多くのリクエストは、欧米でよく使われる第三者のモデルルーティングサービス経由で来ており、数百名のエンドユーザー、少なくとも十数種類の言語の氏名やメール、会社データが関わっています。

