• 请不要在回答技术问题时复制粘贴 AI 生成的内容 V2EX › 程序员 Anthropic 点名多家中国公司蒸馏 Claude,包括 Qwen, kimi, deepseek, glm, xiaomi, Minimax ensonfun · 1h 6m ago · 1533 views 还公布了很多细节:“这些公司通过代理服务、大量账号、转发用户请求、提取 Claude 的 reasoning / CoT 等方式获取训练数据,再用于 SFT 、RL 或训练自己的模型” 坦白讲,我并不意外,但这些数据全部被公开,感觉有点难看。 /ai-market-guide/ Anthropic 中国公司 蒸馏 67 replies • 2026-09-11 13:31:17 +08:00 1 sentinelK 1h 0m ago 4 “坦白讲,我并不意外,但这些数据全部被公开,感觉有点难看。
楼主能摘要一下这些厂商的蒸馏数据在哪吗?我怎么没找到。
2 ensonfun OP 55 mins ago @ sentinelK 没有列全部的具体数据,但列了一些例子以及他们蒸馏的方法。例如 Kimi ,用户使用 Kimi 时,实际上部分请求在用户不知情的情况下被转发到了 Claude ,而且没有做数据脱敏,相当于 Claude 拿到了很多敏感数据。
3 sentinelK 55 mins ago @ ensonfun 如果只靠嘴说一些不可证伪的信息也算“数据”的话,那估计华为岂不是世界主宰…… 4 linglongshenghan 54 mins ago 有证据就亮出来,这种总结性的报告还想让人评价什么,让人自证无罪? 5 icanfork 54 mins ago 华为主宰世界 6 SeptApt 53 mins ago A/自己蒸索尼还公开别人呢,自己偷不算偷?
用户信息随意翻看随意公布随便封号,早点倒闭。 7 ensonfun OP 52 mins ago @ sentinelK 这是一篇详细的报告,请问你还需要什么证据呢?
另外蒸馏这个也不是什么秘密了吧? 8 Helsing 52 mins ago via iPhone A/的话信不了一点 9 NanFengxuan 51 mins ago A➗首蒸,再蒸必究 10 sentinelK 50 mins ago 2 @ ensonfun 详细在哪里……这不就跟“王自如有六个私生子”——by 罗永浩,一样的么…… 私生子这种社会形态也不是秘密,不是吗…… 11 ming2050 48 mins ago 话说,如果某个公司有员工用他家的模型就算蒸馏?
12 sampeng 47 mins ago via iPhone 1 看了一下,这个文献是 a➗是傻逼以外没任何作用。你可以偷偷的,但你摆明了告诉全世界你实际监控了所有得操作数据流。
看下面证据,可以看出来,微信都不敢这么摆证据。 13 zencitta 47 mins ago 就感觉 kimi 这事,说大不大,说小不小,毕竟涉及到国安资料 14 emojiiii 45 mins ago (⊙o⊙)… 所以 kimi deepseek 都是大善人?
价格低还可以用到正版 claude ?太爽了, 继续用 15 iixy 43 mins ago 有啥难看的 16 sentinelK 40 mins ago “Alibaba also used Claude to advance its AI R&D efforts. Alibaba used Claude to help develop its internal infrastructure for model development. Claude was used to help develop Alibaba’s reinforcement learning (RL) environments and advance model architecture research.” 这个是我觉得最搞笑的,按照他这个逻辑,BMW 的人坐了一次奔驰车,就再也不干净了……毕竟是蒸馏了奔驰的核心底盘调教。
17 kyochilian 39 mins ago 太恐怖了,涉及严重的安全问题。最重要的是,大多数人没有意识到这个事情多严重 18 sampeng 39 mins ago via iPhone 1 所有都关注的是蒸馏,就没看出来整篇文章都在说我在分析你的数据流,我明确知道所有人做的所有事,不光这样,我还分析他然后自己造一个。
或者产生任何对我有利的事。闭源 ai 太可怕了 19 hitrip 38 mins ago “Project Panama is our effort to destructively scan all the books in the world.” 它先蒸馏全人类的,为什不能反蒸它 20 hubaq 36 mins ago A/ 说的话一句都不可信,整天意淫自己被蒸馏 21 sentinelK 35 mins ago 1 @ sampeng 这就是一个非常典型的任性娇气的学龄前小女孩画像。
站队她必须站第一,谁站她后面还得听她的,老师必须第一个跟她说话,谁跟老师亲近她就给谁上眼药。只能说百度这个体制确实有点东西…… 22 haruhi 34 mins ago via iPhone 看了下楼上的回复,阿 Q 和 Whataboutism 是真的多啊…… 不过,这个是不是在说,豆包至少在这次发现里,没蒸馏…… 23 wenzhoou 33 mins ago 楼主好不容易学会一个词,蒸馏,你不让他说,他会憋死的。
24 hitrip 32 mins ago > 与解放军相关的监控活动。我们评估的一位用户似乎隶属于解放军,他们使用所谓的“Moonshot”的 Kimi 模型来从监控录像中提取关于某个特定个体的数据。
该用户请求 Kimi 分析这些监控录像,以了解被追踪的人是否出现了异常行为。这些监控录像来自成都数百个摄像头,其中包括解放军设施外的摄像头,以及隶属于中国电子科技集团的研究所和一家大型国有企业中的摄像头。
> 一位在大型中国国有企业工作的工程师。这位工程师使用 Kimi 来构建一家大型中国国有企业的内部系统。
在利用 Kimi 的过程中,该用户泄露了多家中国大型企业的内部代码和实时凭证,其中包括一些知名科技公司的信息。用户并没有意识到,他们使用 Kimi 所传输的数据其实被传输到了 Claude 那里。
叹为观止 25 sampeng 31 mins ago via iPhone @ sentinelK 其实没有人关心蒸馏不蒸馏…我关心的是确实这些开源模型再强大也不可靠。他是真的在分析所有数据 26 ntdll 31 mins ago 这份所谓的报告,把 Anthropic 换成任意一家其他公司都成立。
同理把 Qwen, kimi, deepseek, glm, xiaomi, Minimax 等换成其他任意公司也同样成立。本质上是不能证明也不能证伪的东西,人家发出来也许只是给美国政府看的,图一乐就行。
最后,天下文章一大抄,抄的好的,不算抄。 27 ensonfun OP 31 mins ago 1 @ sentinelK 我觉得你有一点杠精。
比如 Kimi 的方法:当用户访问 Kimi 时,在没有告知用户的情况下,将请求路由到 Claude ,并且将 Claude 的回复加入训练数据。这种蒸馏方法,你觉得没问题吗?
这个过程中,它起码: 1. 违背了对用户的承诺。 2. 违背了 Claude 的使用规范。
另外,你举的汽车例子也很搞笑。 Claude 的意思是,它的服务根本不应该在国内被使用;也就是说,人家没有售卖到你的市场,你这不就相当于走私吗?
28 sentinelK 28 mins ago @ ensonfun 是啊,王自如也确实有六个私生子,罗永浩说的。他这样也确实违背公序良俗。
至于说千问的问题,这节的标题叫:GTG 16005: Chain-of-thought distillation and AI R&D campaign by Alibaba (Qwen / Tongyi Lab),剩下的我觉得不需要再讨论。 29 shakaraka 27 mins ago 论卖国,还得是国内 ai 厂商。
30 catazshadow 26 mins ago via Android @ sentinelK 这个世界是需要体面的 用有罪推断来指责出来揭露不体面的人,实际上就是在帮助那些把这个世界变成大型粪坑的龌龊之辈 31 icyalala 26 mins ago 有趣的事豆包没有抓到蒸馏,而且之前也有报道说张一鸣明确说豆包不能走蒸馏的路,虽然豆包模型本身不咋地。 。
。至于说什么”大家都蒸馏,能力好就是好“的看法,这就是明显价值观有问题了 32 ensonfun OP 26 mins ago @ sentinelK you win ,祝你幸福吧 33 litmxs 24 mins ago via iPhone 实时路由到 Claude 就太离谱了。
一般都是拿用户的输入,批量重放给 Claude 拿 Claude 回答 来蒸馏的 34 sentinelK 24 mins ago @ catazshadow 所以体面的定义是什么? 35 gogozs 21 mins ago 2 36 catazshadow 20 mins ago @ sentinelK 体面是公理,不需要定义 37 sentinelK 20 mins ago @ catazshadow 本质是你主观觉得这个人、主体、事体面,就体面,对吧。
所以同样一件事,A 做是体面,B 做是不要脸。 38 catazshadow 17 mins ago @ sentinelK 让全世界看到这个世界上存在的阴暗面,这算不算体面?
把所有阴暗的东西藏起来,不让人知道,顺便制造一种这个世界就是天堂的印象,这又算不算体面?都算体面的话,哪种更体面?
请 39 yxd19 17 mins ago 等于说用 deepseek api 有可能能调到 opus 是吧。那不是好事情吗 40 yxd19 15 mins ago @ catazshadow 你这个人脑子跟浆糊一样。
人家问你什么是体面,你说不需要定义体面,然后你反过来问人家什么是体面。 41 www12222 15 mins ago GTG-15001 反映了现有人工智能模型在欺诈和诈骗活动中的应用范围和局限性。
一家中国应用工作室利用 Claude 构建了一个包含 20 多个约会应用的网络,并为其提供用于与用户对话的人工智能角色——尽管他们宣称其服务完全由真人扮演。在 2026 年 4 月的两周时间内,我们发现了超过 4700 个不同的人工智能角色,它们与至少 25000 名不同的用户进行了对话。
哈哈哈 42 sentinelK 15 mins ago @ catazshadow 阴谋论天天有,为何 A\就体面了呢? 43 js9528 15 mins ago via iPhone 感觉 op 是钓鱼的,一下子屏蔽了很多… 44 zh3256 14 mins ago via Android 大模型的数据哪儿来的?
开源的,爬来的,买来的,正经的,灰色的,有版权没版权的。怎么做成模型就是 a 畜他的了?
这家公司人如其名,把双标体现的淋漓尽致 45 catazshadow 13 mins ago @ yxd19 我问的是什么东西属不属于体面,他问的是什么东西叫体面。该补习逻辑的是你 46 zhaoziling 12 mins ago @ catazshadow 你这样说的前提是,默认他说的都是真的?
47 potatowish 12 mins ago via iPhone 重点不是 A/指责蒸馏的问题,它自己也搞蒸馏。这些国模公司把境内用户数据传到境外模型来训练自己的模型,这问题很严重啊 48 alexluo1 PRO 11 mins ago 我还以为这里是抖音呢,那么多爱国小将 49 catazshadow 11 mins ago @ sentinelK 为什么这就一定是阴谋论呢?
fable 出来之前这个公司敢于对自己提交的安全漏洞的 patch 的哈希值负责,你觉得这是阴谋论公司吗? 50 catazshadow 11 mins ago @ zhaoziling fable 出来之前这个公司敢于对自己提交的安全漏洞的 patch 的哈希值负责 你觉得这种公司的言论可信不可信?
51 alexluo1 PRO 8 mins ago “我们发现并调查了一起持续进行的网络间谍活动,并将其追踪编号定为 GTG-10007 。该行动由中文使用者实施,他们很可能居住在中国湖南省长沙市。
我们确认其中两名操作人员是湖南某所中国高校的本科生,就读于计算机与通信工程学院相关专业。其中一人此前曾在中国网络安全公司深信服( Sangfor )实习,并且当时正在面试另一家中国网络安全公司奇安信( QiAnXin )的职位,该岗位涉及进攻性网络行动。
该团伙中的多名操作人员将 Claude 作为一个协同进攻性项目中的工程与编排层,涉及多种任务,包括:针对生产系统实施入侵尝试;对中东、欧洲和东南亚的外国政府网络开展侦察;持续针对主流终端安全产品进行漏洞研究和漏洞利用开发;开发恶意软件;以及建设情报收集平台。值得注意的是,该团队同时运行多个并行工作流,这些工作流共享工具和基础设施,并通过持久化的行动记录,在不同工作会话之间保留上下文。
此外,其情报收集和漏洞研究能力即使在操作者离开期间,也能够继续自主运行。该行为体大约以 50 家机构为目标,涉及教育、零售、能源、科技、医疗、金融、制造等行业,同时还包括全球多个政府机构。
该行为体成功入侵了一家教育科技公司,并从该公司的云存储中批量提取了数百 MB 的学生个人数据。他们还获得了一家零售公司的生产系统访问权限,进入其内部主机,并展示了修改线上生产环境的能力。
最后,他们还针对东南亚某政府机构发动攻击,并获取了公民记录,其中包括姓名、电话号码和家庭住址。该团伙还维持着一套自主运行的漏洞研究项目。
其核心工作是持续研究一款主流安全产品——这类软件原本就是专门用于检测网络入侵的——并由此发现了多个此前未知的漏洞,这些漏洞随后由该行为体在自己的实验室环境中完成验证。同一套研究工作还针对多个系列的网络设备和安全设备开发出了可实际运行的漏洞利用程序。
在另一套独立工作流中,我们观察到该行为体开展网络攻击行动,尝试利用上述同类设备中的漏洞,而这些设备属于全球多个政府机构。我们已经封禁了与这些行为体相关的账户,并部署了额外的监控措施,以检测并封禁相关活动。
52 shakukansp 8 mins ago 吓哭了,怎么还有公司粉的,我觉得粉马斯克就够弱智了 53 sentinelK 7 mins ago @ catazshadow 确实,A\还说:“we may process personal data in an aggregated or de-identified form to analyze and improve the effectiveness of our Services including to conduct analytics, conduct research, study user behavior, and train our AI models” 所以他这个去标识化看来是相当彻底了,对吧。 54 yxd19 7 mins ago @ catazshadow 比如你要定义红色,不管用什么办法定义,最终只要能让人判断任何一个东西具不具有红色这一属性就行了,也就是让人具备回答任何东西是否属于红色这一能力。
所以什么叫红色跟什么东西属不属于红色是一个问题。或者说后者是前者的一部分。
当然「属于」有另一种含义,比如「这手机属于我」,回答所有「 xx 是否属于我」的问题不等价于定义了我。但这种含义在这里显然是不相干的。
你说「该补习逻辑的是我」,可是我从来没说过你需要补习逻辑,我说你脑子是浆糊。 55 catazshadow 6 mins ago 1 @ zh3256 这是偷换概念,别人指责的是抄作业,你说别人手里的答案来路不正 前者是事实,后者是臆断,熟悉的洼地把水搅浑的味道 56 catazshadow 5 mins ago @ sentinelK 你知道第二个单词 may 的意思吗?
may 等于 will 吗? 57 catazshadow 4 mins ago @ yxd19 来,定义下实数 我说你补习逻辑,不是反驳你说我改补习逻辑。
而是从一个新的角度指出你该补习逻辑 58 sentinelK 4 mins ago @ catazshadow 厉害,可以的。这英语水平我自愧不如。
我输了 59 shakukansp 4 mins ago @ catazshadow 你怎么好意思讲出来 may 不等于 will 的,你信吗 60 lcingOnTheCake 4 mins ago 7. 非法蒸馏:对中国 AI 公司的严重指控 这是报告中最具争议、也最值得注意的一部分。 Anthropic 称,发现七家中国实验室或企业通过虚假账户、代理网络、盗用密钥等方式,大规模获取 Claude 的输出,用于训练自家模型。
报告列出的主要指控包括: 阿里巴巴/通义千问:约 1.51 亿次交互,峰值每天近 300 万次,重点提取 Opus 的推理轨迹; Moonshot/Kimi:约 2300 万次交互,并被指在部分情况下把用户请求暗中转发给 Claude ; DeepSeek:14 天内约 1210 万次交互,也被指暗中把部分用户请求转发给 Claude ; 智谱/ Z.ai :约 340 万次; 小米:超过 40 万次; 另外还涉及商汤、MiniMax 及第三方代理服务网络。其中最严重的不只是模型能力被蒸馏,而是隐私问题:报告声称,部分用户以为自己正在使用 Kimi 、DeepSeek 或其他模型,但提示词实际上被转发给 Claude ,内容包括企业代码、访问密钥、内部文档和监控数据。
61 zhangli2946 4 mins ago 坦白讲,没有实锤都是观点。洋大人的话不用 100%全信。
CoT 本是世间存在之物。 ---- 反驳我观点的想法,被我申请了知识产权。
你动了反驳我的念头就是侵权。你要你相信这套话语体系,我就是概念神。
62 woaipaojiao 3 mins ago 蒸馏是一项技术 63 zhangli2946 3 mins ago @ lcingOnTheCake 如何区分中转站还是公司系统性的使用? 64 yxd19 3 mins ago @ catazshadow 鉴定为水平不如豆包。
65 xuejianxianzun 2 mins ago A/说你就信啊,那你别用国模呗 66 Yukiteru 1 min ago 笑死,连“国安单位要求 Kimi 分析数百个成都的军方和电科集团单位周围的监控视频,分析某特定个人是否行迹可疑;某国企工程师用 Kimi 开发内部系统”这种数据都被 kimi 直接转发给 claude 了,连个加密或脱敏都不做也是真的野鸡 67 lovedebug 1 min ago Claude Code:我没有蒸馏 cursor