Anthropic、阿里巴巴・Moonshot AI・DeepSeekによる蒸留活動の詳細を報告
概要
Anthropicは、阿里巴巴、Moonshot AI、DeepSeekなど中国のAI企業による持続的で激化する「蒸留攻撃」の詳細を報告するレポートを公開しました。総計2億回に近いやり取りが、AnthropicのClaudeモデルの内部推論(思考連鎖)を抽出し、競合モデルの訓練に利用することを目的とした攻撃に関連付けられました。阿里巴巴のキャンペーンが最大規模で、1億5100万回のやり取りが同社の代理機能、コーディング、論理的推論を標的にしたものでした。Moonshot AIのキャンペーンは、中国軍からの要求を直接ルーティングしている疑いがあります。攻撃者は、モデルの原始的な思考プロセスを隠すAnthropicの防御策を迂回する巧妙な手法を使用しました。
(出典:TechCrunch)