游乐游手机版
首页/AI热点日报/热点详情

Kimi否认K3蒸馏美国人模型及未公布传闻

类型:热点整理2026-07-23
KimiK3发布后,美国AnthropicCEO指控其蒸馏了未公开模型。月之暗面否认,称性能提升源于底层原创架构创新。K3参数2 8万亿,采用稀疏混合专家架构,计算效率较K2提升约2 5倍。美方多次以类似指控抹黑中国AI企业,中方强调科技成就不靠偷抢。

Kimi K3一经发布便迅速走红,但热度背后也引来了争议。这款中国开源大模型在全球引发广泛关注后,美国人工智能公司Anthropic的CEO阿莫代伊在国会AI安全听证会上抛出了一项引人注目的指控:K3对Anthropic的模型进行了蒸馏,甚至涉及一款“尚未公开的未来模型”。

K3蒸馏美国人模型?还是未公布的?Kimi否认

月之暗面方面迅速且明确地予以否认。7月21日,公司副总裁黄震昕在接受媒体采访时强调,K3性能的提升源于底层原创架构的创新,而非对现有模型进行蒸馏复刻。

先梳理几个关键信息。K3于7月中旬推出,总参数规模达到2.8万亿,采用稀疏混合专家架构。根据月之暗面公开的技术资料,模型运行时从896个专家模块中激活16个,并引入了Kimi Delta Attention混合线性注意力机制和Attention Residuals注意力残差技术。这些架构调整,配合训练方法和数据配方的优化,使得K3将计算资源转化为模型能力的整体效率相比K2提升了约2.5倍。

K3亮相后,在编程和智能体任务中迅速跻身前列,吸引了大量海外开发者和科技圈的目光。然而,性能差距的快速缩小,也让那个老生常谈的阴谋论再度升温——中国AI企业究竟是否在通过“蒸馏”走捷径?

这里需要厘清一个概念:蒸馏,本质上是一种将大模型能力迁移到小模型的技术,更接近模仿学习,与抄袭或搬运并非同一回事。Anthropic将蒸馏技术污名化,背后意图无非是抹黑中国竞品,为自己争取舆论优势。

这并非首次出现类似情况。去年DeepSeek横空出世,性能足以对标美国头部模型,但成本显著更低,时任特朗普政府AI顾问的萨克斯便暗示DeepSeek蒸馏了美国模型。今年2月,OpenAI又向美国国会致信,鼓动政客们不要允许中国“盗用并包装美国创新成果”。同月,Anthropic更是直接点名DeepSeek、月之暗面和MiniMax,声称它们通过约2.4万个虚假账户,与Claude模型进行了超过1600万次交互,提取模型能力,违反了服务条款和地区访问限制。他们还多次要求美国政府限制中国AI发展。

这类无端指控,美方已经屡试不爽。中方的态度一贯明确:中国的科技成就,一不靠偷,二不靠抢,而是靠智慧和汗水拼搏出来的。美方打着国家安全旗号,渲染所谓“窃取”论调,不过是别有用心。敦促美方个别官员放下冷战思维和零和博弈的老观念,多做有利于中美互信与合作的事。

来源:https://finance.sina.com.cn/roll/2026-07-22/doc-iniispmx1954922.shtml

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。