游乐游手机版
首页/科技数码/文章详情

快手开源6710亿参数多模态大模型,重塑视觉推理新标杆

时间:2025-11-30 16:33
快手近日正式开源了其最新一代多模态大模型Keye-VL-671B-A37B,这款基于DeepSeek-V3-Terminus架构的模型拥有6710亿参数,在视觉感知、跨模态对齐和复杂推理能力上实现了

快手近期正式开源了新一代多模态大模型 Keye-VL-671B-A37B。这款基于 DeepSeek-V3-Terminus 架构的模型拥有 6710 亿参数,在视觉感知、跨模态对齐和复杂推理能力上实现了显著突破。通过系统化的预训练和后训练策略,该模型在通用视觉理解和视频理解领域展现出超越同类产品的性能表现。

在图像识别测试中,Keye-VL-671B-A37B 展现出惊人的细节捕捉能力。当面对三张票据的识别任务时,模型不仅能准确识别出文字和格式差异,更通过逻辑推理判断出其中仅有两张为电影票,第三张实为食品兑换券。这种超越表面识别的深度理解能力,源于模型对视觉元素与语义信息的精准关联。在视频理解测试中,该模型能精准捕捉"蓝色双层电车"等核心元素,并完整复现镜头运动轨迹和场景转换细节。

性能对比数据显示,在 26 项主流基准测试中,新模型在 18 项指标上取得领先成绩。特别是在 STEM、推理、视频理解等复杂任务领域,其表现超越字节跳动 Seed1.5-VL+think 和阿里 Qwen3-VL+ 235B-A22B 等前沿模型。这种优势得益于其独特的三阶段预训练体系:首阶段冻结视觉与语言模块,专注特征对齐;次阶段全参数训练;末阶段通过退火训练强化细粒度感知。整个过程仅使用 300B 高质量数据,相比其他动辄万亿级的数据规模,展现出更高的训练效率。

后训练阶段采用创新的混合数据策略,将指令数据与长思维链(Long-CoT)数据按特定比例融合。实验表明,这种组合使模型在保持指令响应能力的同时,显著提升复杂推理的稳定性。技术团队开发的严格数据筛选流程,有效过滤了冗余反思内容,确保思维链数据的精炼性。在强化学习环节,模型采用阿里 Qwen3 系列同源的 GSPO 算法,通过序列层建模提升训练稳定性,并配备专用 Verifier 模型验证推理逻辑,使答案准确率提升显著。

该模型现已在 Hugging Face 和 GitHub 平台开放下载,开发者可访问指定链接获取完整代码库。其视觉编码器继承自今年 9 月开源的 Keye-VL-1.5 模型,其 80 亿参数版本已支持 128k tokens 上下文扩展。技术文档显示,新模型在多模态数学数据集上的平均准确率提升达 1.33%,在开源感知基准测试中提升 1.45%,展现出强大的跨领域适应能力。

通过持续优化数据管线,快手构建了覆盖 OCR、图表、表格等复杂格式的自动化处理流程。这种系统化训练方法使模型能准确解析视觉信号中的关键信息,为后续开发多模态 Agent 能力奠定基础。当前版本已具备基础工具调用能力,未来将强化在真实场景中的自主推理与任务执行能力,推动多模态系统向更实用的方向发展。

来源:https://www.itbear.com.cn/html/2025-11/1034297.html
上一篇小米汽车电耗实测:与特斯拉对比,雷军回应关键差异 下一篇海外博主控诉AI食谱泛滥:原创作者生存堪忧
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
理想新车布局预测:L9L与i9上半年发布
科技数码 · 2026-07-04

理想新车布局预测:L9L与i9上半年发布

1月23日消息,综合权威公开信息与行业趋势研判,理想汽车2026年度新车布局规划正式曝光。此番产品线布局,不仅持续深耕SUV市场,同时加速补齐全场景覆盖的拼图。 理想L9旗舰SUV 在增程动力领域,理想L系列将迎来一位新成员——L9L,预计2026年上半年正式上市,预估售价区间为45万至55万元。与

三星消息应用7月停用 部分旧设备可继续使用
科技数码 · 2026-07-04

三星消息应用7月停用 部分旧设备可继续使用

6月29日,多家海外媒体援引三星官方消息证实,三星消息(Samsung Messages)应用将于2026年7月正式终止服务。随着这个截止日期越来越近,依然在使用该应用的Galaxy用户需要尽快迁移到新的默认信息工具。其实过去两年里,三星一直在悄悄引导用户转向谷歌信息(Google Messages

吉利发布2030战略:年销650万辆全面迈向全球前五
科技数码 · 2026-07-04

吉利发布2030战略:年销650万辆全面迈向全球前五

1月22日,吉利控股集团在北京召开战略解析大会,正式发布“一个吉利,全面领先”的2030战略蓝图。战略目标清晰明确:到2030年,全球总销量(含乘用车与商用车)突破650万辆,稳居全球车企前五。其中,新能源车型占比预计达到75%左右,海外销量占比超过三分之一。尤为关键的是,依托全新全球化架构,单车型

OPPO Find X9系列旗舰手机累计销量突破250万部Ultra版超12万部
科技数码 · 2026-07-04

OPPO Find X9系列旗舰手机累计销量突破250万部Ultra版超12万部

OPPO Find X9 Ultra 旗舰机型 回顾产品发布背景:Find X9系列于2025年10月正式登场,作为OPPO年度旗舰产品线,涵盖标准版、Pro版与Ultra版三大版本。该系列的核心竞争力十分明确——影像系统与综合性能的双重显著提升。上市以来,凭借芯片算力、屏幕显示素质、续航表现以及影

IntelliJ IDEA 2025.3.2 版本正式发布
科技数码 · 2026-07-04

IntelliJ IDEA 2025.3.2 版本正式发布

IntelliJ IDEA 2025 3 2 版本现已正式发布。除了常规的漏洞修复与功能完善,本次更新有几个修复点值得格外关注——特别是如果你经常使用终端工具执行命令,或者正在采用远程开发工作流。终端工具窗口的闪烁问题终于得到彻底解决。此前在调用支持同步输出的命令行工具(例如 Claude Code