Anthropic与OpenAI的反蒸馏措施:账户封禁与思维链保护的挑战
Anthropic在2026年9月10日发布的154页报告中指出,已识别出7家中国AI实验室对其Claude模型实施大规模蒸馏。蒸馏是一种模型训练方法,通常由开发者利用强大的模型生成数据并训练自己的模型以模仿。然而,Anthropic将未授权的大规模提取活动称为“不正当蒸馏”。
报告中提到,这些实验室在进行数据提取时采用了诸如使用被盗信用卡和登录凭证创建虚假账户等违规手段。一些中国公司甚至将用户请求直接转发给Claude,或从第三方购买用户对话,以此训练他们的模型。对话中包含个人信息和有效凭证。
这并非Anthropic首次指责蒸馏攻击。在2026年2月,Anthropic称DeepSeek等三家公司通过大约24000个虚假账户与Claude进行了超1600万次交互。为此,Anthropic增强了其防线,OpenAI与Google也在持续监测和采取措施应对类似攻击。 qy球友会官网
但这样的防御措施是否能够有效阻止蒸馏攻击呢?来自澳大利亚格里菲斯大学的助理教授刘艺对此表示怀疑。他长期从事人工智能与网络安全的研究,主攻方向是针对顶尖商用模型的攻击。他的研究显示,蒸馏几乎不可能完全杜绝,现阶段美国公司更务实的目标是增加竞争对手的数据采集成本,从而延缓他们的发展。
刘艺认为,理解美国顶尖模型公司的反蒸馏策略时,必须重视商业逻辑的力量。尽管Anthropic能够识别出可疑行为,但要获得确凿的蒸馏证据却十分困难。
刘艺解释了Anthropic和OpenAI隐藏推理过程的做法,以防止蒸馏攻击,将用户输入、思维链和输出分开。他表示,蒸馏攻击的关键在于提取模型推理过程中产生的高质量数据,传统人工智能模型在参数、数据和计算三者共同决定性能的前提下,优质训练数据变得愈发稀缺,因此一些大模型公司可能采取多种方式提取顶尖模型的思维链。 qy球友会官网
刘艺也提到了一些通过技术手段,如越狱、提示词注入等方式提取思维链的技巧。他还透露,一些数据公司专门销售长程任务的思维链,价格在800到1000元人民币之间。
总体来说,虽然现阶段对于蒸馏攻击的防御正在增强,但在激烈的市场竞争中,保持技术领先和商业价值依然是各大公司的首要目标。
四十多岁,我把存款投资工商银行十五年
与篮球同行,感受每一场比赛的智慧与勇气!...
尼克斯签下五位球员争夺最后名额,怀斯曼面临重返机会
与篮球同行,感受每一场比赛的智慧与勇气!...