Claude Opus 4.8 被曝「认错家门」?AI圈这瓜确实离谱

32 阅读3分钟

2026年5月29日,Anthropic发布新模型Claude Opus 4.8。同天宣布融资650亿美元,估值9650亿美元。牛吧?

结果上线不到几小时,骚操作就来了。有网友测试发现,Opus 4.8被追问身份时,有时候说自己是「通义千问」,有时候说是「DeepSeek」,还能把对应公司的背景讲得头头是道。

自己刚告完别人蒸馏,结果自己的model被发现「认错家门」,这剧情我也是服气的。


先说说什么是「蒸馏」

蒸馏是一种知识迁移技术:大模型(老师)生成一堆输出,用这些数据训练一个小模型(学生)。小模型能力接近大模型,但成本低很多。

通义千问、DeepSeek都是开源模型,允许自由使用和再发布。用它们的输出训练新模型,技术上不违法。

但问题来了:开源协议允许用模型输出做再训练,那大规模混入商业模型训练数据,算不算犯规?目前行业里可没有明确规定。


事情为什么闹这么大

2026年2月,Anthropic发声明,指控DeepSeek、月之暗面、MiniMax三家公司通过约24000个虚假账户,与Claude进行了超过1600万次交互,搞「工业级蒸馏攻击」。措辞很强硬,说这是安全风险,还上升到了服务条款层面。

结果现在Opus 4.8自己在API调用时「认错家门」,这不是自己打脸是什么。


支持者怎么辩解的

他们说:API测试时出现身份混乱,可能是Prompt设计问题,不代表训练数据有问题。网页端(claude.ai)就没有这个异常。

听起来好像有道理?

但仔细想想——如果模型正常运行不出问题,为什么API调用就会「认错」?这更像是模型权重层面留下的痕迹,而不是简单的提示词工程问题。

更何况,Anthropic之前因为蒸馏盗版书籍被法院判赔150亿美元。前科在这儿摆着呢。


「原创性」到底怎么定义

这个瓜背后其实有个更大的问题:当我们在说AI模型「原创」时,到底在说什么?

现在大模型的训练数据来源已经高度混杂:公开网页、书籍、代码、论文、社交媒体对话、合成数据……彼此交织,很难追溯。

AI行业早就进入了「你中有我、我中有你」的阶段。开源模型的能力越来越强,它们的输出渗透到互联网各个角落。任何大规模训练数据,都很难完全避开这些内容。

人类创作者通过学习前人知识来发展能力,最终创作出独特作品,这个过程从来没人说是「非原创」。

为什么AI模型通过学习大量已有文本来提升能力,就要被质疑「原创性」?


说白了就是个行业困局

目前没有标准化的方法来验证大模型的训练数据来源,也缺乏透明机制来评估这些来源对模型行为的影响。

模型有没有问题,主要靠行为测试加社区发现,而不是靠厂商主动披露。

这对于需要合规审查的企业用户来说,是真的头疼。


总结

Opus 4.8认错家门这事,基本可复现,不是偶发问题。是否蒸馏了中国开源模型,没法证实,也没法定性否认。Anthropic的立场矛盾确实存在,但法律层面难以追责。

行业最缺什么?透明审计机制和统一标准。

对于普通用户来说,暂时不用太恐慌——Opus 4.8在各项基准测试里依然领先,资本市场也继续看好。

但有一点是确定的:这场「原创性」争议不会止步于此。建立透明的审计机制,已经是行业刚需了。