游乐游手机版
首页/AI热点日报/热点详情

连夜实测Kimi K3:建议改名Kable

类型:热点整理2026-07-20
KimiK3在CodeArena前端编程盲测中以1679分排名第一,超越ClaudeFable5和GPT-5 6Sol。该模型参数规模达2 8万亿,为全球首个开源3万亿级别模型,支持长程编程与视觉理解。官方坦诚其整体表现仍落后于最强闭源模型,但能力已接近前沿水平。

今天凌晨,Arena AI 发布了最新的 Code Arena 榜单,结果令人颇感意外。

刚刚发布的 Kimi K3 以 1679 分高居全球榜首,超越了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。

Code Arena 测试的重点是前端编程能力。模型需根据用户指令生成网页,完成视觉还原、交互设计以及功能实现等任务。

榜单结果源于百万级用户参与的公开盲测。同一任务会分配给两个匿名模型,用户实际体验两个输出结果后投票,待投票结束才公布模型身份。

在结果揭晓前,用户并不知道自己选择的是哪家模型,品牌影响力被削弱,因此结果更具参考价值。换言之,至少在视觉呈现和交互实现的前端编程场景中,K3 已经占据了当前最领先的位置。

谁也没料到,一个刚发布的开源模型,轻松超越了多款闭源旗舰,令人难以置信,甚至有些“好到不真实”。于是我们趁热打铁,连夜对 Kimi K3 进行了实测,验证其真实表现。

冷知识:下面这段视频并非 Kimi 官方发布的宣传短片,而是 APPSO 将原预告片提供给 K3 作为参考,由它独立重新生成的一段动画。

从理解原视频内容、重建网页画面,到处理镜头、动效及交互逻辑,整个流程均由 K3 独立完成。让模型亲手制作一支介绍自己的动画,无疑是极为直观的开场测试。

尤其考虑到近期 Fable 5 和 GPT-5.6 竞争激烈,能力不断提升,同时 Token 消耗也持续攀升。许多人仍在等待 Claude Opus 5,没想到 Kimi 率先推出了一个参数规模高达 2.8 万亿的开源模型。

你没看错,2.8 万亿参数,并且完全开源。

Kimi K3 拥有高达 2.8 万亿参数的巨无霸规模,是全球首个开源的 3 万亿级别大模型。它具备 100 万 token 的上下文窗口,原生支持视觉理解,专注于长程编程、知识工作与推理等任务。

好家伙,闭源旗舰模型还在挤牙膏式升级,而开源阵营这边直接将参数规模推上了新高度。

更有意思的是官方博客中的这句话:「尽管 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol, 但它在我们的全套评测中展现出前沿水平的能力, 并稳定超越了其他所有模型。」

如此坦诚,在国产大模型的发布博客里,属实是一股清流 (doge)。但谦虚归谦虚,K3 此次展现出的能力,分量丝毫不轻。

来源:https://www.bestblogs.dev/article/0715496ddd?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。