@crb1025 在 外网网友对Deepseek API最新被指控中转路由Fable的看法: 中发帖
“经过仔细分析并查阅众多帖子后,我的看法如下:
观察期太短——仅一小时——且证据严重不足。
工业级模型蒸馏需要海量数据;一次一小时的人工测试所产生的 Token 数量远不足以训练一个模型。此外,异常行为在暴露后迅速消失,这更符合临时配置错误或极短期的滚动测试,而非一项长期、隐蔽的计划。
无法排除关键干扰源。
所有测试均通过第三方代理(OpenCode)进行。我们无法排除这种可能性:该中间层在服务器端秘密地将请求重定向至 Claude API(以赚取差价或积分),而这是一个 DeepSeek 官方人员可能并不知晓的场景。
为何这不是官方的工业级蒸馏?
如果这是一次精心策划的蒸馏操作,就不会暴露出诸如思维链(CoT)模式暴露或安全词汇触发质量下降等明显缺陷,也不至于在仅运行一小时后就被紧急回滚(那样做太业余了)。
发生了什么?两种可能性:
I. 短期实验/配置错...