有人调查发现DeepSeek V4与Claude Fable 5代码输出高度相似

有人调查发现DeepSeek V4与Claude Fable 5代码输出高度相似

💡 原文中文,约2800字,阅读约需7分钟。
📝

内容提要

调查发现DeepSeek V4在复杂代码任务中的输出与Claude Fable 5高度相似,引发AI圈讨论。测试显示纯代码请求时生成路径和思维链风格接近Fable,而涉及敏感话题时退回原生状态。事件凸显API服务透明度问题,需建立输出溯源机制,但官方尚未回应。

🔎

延伸解读

API输出溯源:评估体系的盲点

Leo的调查揭示了一个关键问题:如果API返回的内容可能来自其他模型,那么基于API输出进行的性能评估和比较将失去基准。这不仅是针对DeepSeek的疑问,而是整个行业API服务透明度的普遍关注。动态路由是常见工程手段,但关键在于是否透明告知用户,以及在评估和排名场景中是否公允。

思维链风格:模型身份的指纹

思维链风格如同笔迹,具有辨识度。DeepSeek V4在纯代码请求时,思维链风格与Claude Fable 5高度相似,而涉及敏感话题时则退回原生风格。这种同步切换表明,生成路径可能整体被替换,而非仅最终代码相似。这为识别模型身份提供了新的观察维度。

分类器触发:揭示处理路径的差异

Leo设计的实验显示,当代码请求中嵌入敏感关键词时,输出质量显著下降,而纯代码请求则保持高质量。这种差异可能反映了不同处理路径的激活:敏感内容经过分类器审查后能力受限,而纯代码请求则走另一条路径。这为理解模型内部路由提供了线索。

技术趋同还是非正常引用?

代码生成领域存在大量共享开源库,顶尖模型在标准任务上趋同并不罕见。但Leo的调查提供了可复现的步骤和多角度对照,引发了对正常趋同与非正常引用边界的讨论。要确认真实原因,需要更精细的实验设计和第三方独立复现来交叉验证。

Q&A

DeepSeek V4与Claude Fable 5在什么情况下输出高度相似?

根据Leo的调查,当使用DeepSeek官方API处理纯代码类复杂请求(如3D射箭游戏代码)时,DeepSeek V4的输出与Claude Fable 5高度相似,包括代码结构、变量命名和注释风格。

Leo是如何发现DeepSeek V4与Claude Fable 5输出相似的?

Leo在OpenCode平台上用DeepSeek官方API对接V4模型进行对照测试,输入简单数学题或常识问答时输出正常,但加入3D游戏代码需求后,输出与Claude Fable 5高度相似。

DeepSeek V4在涉及敏感话题时表现如何?

当3D游戏代码需求与网络攻击或生物相关的问题捆绑输入时,DeepSeek V4的输出质量显著下降,退回其知识截止日期(2025年5月)的状态,与纯代码请求的高质量输出形成对比。

DeepSeek V4与Claude Fable 5的思维链风格有何不同?

DeepSeek系列模型通常采用分步拆解、语气偏技术文档风格;Claude Fable 5则倾向于一次性规划整体方案,语言更流畅。当V4输出与Fable相似时,其思维链风格也同步变化。

Leo的调查引发了哪些行业讨论?

讨论集中在模型输出真实性验证、API服务透明度、输出溯源机制以及模型身份验证等问题,也涉及正常趋同与非正常引用的区分。

DeepSeek官方对Leo的调查有何回应?

截至讨论发酵时,DeepSeek官方尚未对此事做出公开回应。

🏷️

标签

➡️

继续阅读