Anthropic 详细披露阿里巴巴、Moonshot AI 和 DeepSeek 的模型蒸馏活动
内容摘要
Anthropic 发布了一份报告,详细阐述了由阿里巴巴、Moonshot AI 和 DeepSeek 等中国 AI 公司发起的持续且不断升级的“蒸馏攻击”。这些攻击总计涉及近 2 亿次交互,旨在提取 Anthropic Claude 模型的内部推理链(思维过程),以用于训练竞争模型。其中,阿里巴巴的活动规模最大,涉及 1.51 亿次交互,针对了 Claude 的代理能力、编码和逻辑推理等核心功能。Moonshot AI 的活动则疑似将请求从中国军方直接路由过来。攻击者使用了精密的技术来绕过 Anthropic 的防御,这些防御措施通常会隐藏模型的原始思考过程。
(来源:TechCrunch)