游乐游手机版
首页/业界动态/文章详情

火山引擎发布豆包大模型1.8,多模态Agent能力全球领先

时间:2025-12-18 18:06
12 月 18 日,火山引擎在 FORCE 原动力大会上正式发布豆包大模型 1 8 及音视频创作模型 Seedance 1 5 pro。权威评测数据显示,豆包大模型在多模态理解、生成能力及 Agen

12月18日,火山引擎在FORCE原动力大会上正式发布了豆包大模型1.8及音视频创作模型Seedance 1.5 pro。多项权威测评数据显示,豆包大模型在多模态理解、生成能力及Agent能力上,均已跻身全球第一梯队。

据火山引擎总裁谭待介绍,截至今年12月,豆包大模型日均token使用量已突破50万亿,较去年同期增长超过10倍;目前已有超过100家企业客户累计token使用量超过一万亿。

火山引擎发布豆包大模型 1.8,多模态 Agent 能力进入全球第一梯队

▲ 图:火山引擎总裁谭待

豆包大模型 1.8:打造更强大的多模态Agent“大脑”

作为豆包家族的最新旗舰模型,豆包大模型 1.8(Doubao-Seed-1.8)专门针对多模态Agent场景进行了深度优化。其工具调用能力、复杂指令遵循能力及操作系统级Agent能力均实现显著提升,增强了模型在处理复杂任务时的规划与执行水平。

在视觉理解方面,豆包 1.8 的单次视频理解帧数从640帧倍增至1280帧。模型支持以低帧率高效理解超长视频,并能自动调用工具对关键片段进行高帧率精准分析。这项能力可广泛应用于在线教育、产品质检、安防监控等多种业务场景。

火山引擎发布豆包大模型 1.8,多模态 Agent 能力进入全球第一梯队

火山引擎发布豆包大模型 1.8,多模态 Agent 能力进入全球第一梯队

图:豆包大模型 1.8 测试表现

在多项公开测评中,豆包 1.8 展现出极具竞争力的全面表现:在视觉推理、通用视觉问答、空间理解及视频理解等任务中,均获得最佳或接近最佳成绩;在通用智能体测评集BrowserComp上表现全球领先;在数学与推理等基础能力维度上,整体水平已接近全球顶尖的通用模型。

Seedance 1.5 pro:音画精准同步,重塑AI视频生产力

为应对日益增长的视频内容创作需求,火山引擎推出了Seedance 1.5 pro音视频创作模型。该模型不仅具备影视级的叙事张力,能够精确捕捉运动细节并细腻呈现人物情绪,更在音画同步技术上取得了突破性进展。

Seedance 1.5 pro采用了创新的原生音视频联合生成架构,支持环境音、背景音乐、人声口型等多种元素的独立控制与融合,实现了毫秒级的音画同步输出。在对白处理上,模型支持多人多语言对话,口型与发音精准对齐,覆盖中文方言(如四川话、粤语等)、英文及多种小语种,极大地提升了视频内容的真实感与全球化创作潜力。

为进一步降低创作门槛与成本,Seedance系列即将上线“Draft样片”功能。创作者可先生成低分辨率样片进行预览,其核心构图、运镜、人物动作等关键元素与最终成片高度一致,真正做到“预览即所得”。数据显示,该功能可帮助创作者提升65%的整体创作效率,并减少60%的无效试错成本。

目前,个人用户已在豆包、即梦AI等App体验该模型;企业用户则从12月23日起,可通过火山引擎API接入Seedance 1.5 pro模型服务。

升级AI云原生架构,构建Agent规模化落地底座

谭待指出,传统的IT架构已无法满足Agent时代的需求,以模型为中心的AI云原生架构正在形成,并围绕Agent的开发与运营进行深度重构。

在Agent开发层面,火山引擎全面升级了企业级AI Agent平台——AgentKit。该平台覆盖了Agent从开发、部署到管控的全生命周期,旨在解决企业在Agent落地中面临的身份权限管理、模型调用确定性及系统集成等核心挑战。

在Agent运营层面,火山引擎推出了HiAgent智能体工作站。该工作站通过构建统一的企业AI任务调度中心、提供一系列开箱即用的通用智能体,以及支持个性化定制智能体应用,帮助企业实现Agent的规模化管理与高效应用,降低运营复杂度。

此外,为降低企业使用门槛,火山引擎推出了业内首个“AI节省计划”。该计划覆盖所有按量付费的大模型产品,通过阶梯式用量折扣,可帮助企业最高节省47%的模型调用成本。

谭待表示,通过对从模型能力到基础设施的全面革新,火山引擎正在推动AI应用从单一的模型调用向复杂的Agent智能体生态系统演进,加速AI能力在各行各业的深度融合与落地。

来源:https://www.ithome.com/0/905/968.htm
上一篇亿维ePOP5x提速100%、体积小32%|AI穿戴设备更轻薄智能 下一篇地平线征程6赋能大众汽车,首款智驾车型2025年底量产
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
诺基亚TA-1619入网:1400mAh电池双卡双待新机
业界动态 · 2026-07-01

诺基亚TA-1619入网:1400mAh电池双卡双待新机

诺基亚又有新动作了。7月1日消息,一款型号为TA-1619的诺基亚新机已经拿到了电信设备进网许可,不过证件照目前还没公布。 从入网信息来看,这是一款TD-LTE数字移动电话机,支持TD-LTE网络,属于LTE单天线终端设备。双卡双待、VoLTE语音模式都支持,终端款式为直板。核心配置方面,电池额定容

芯佰微CBMRF900系列国产射频芯片突破海外壁垒
业界动态 · 2026-07-01

芯佰微CBMRF900系列国产射频芯片突破海外壁垒

芯佰微电子发布CBMRF9002和CBMRF9009两款射频收发芯片,采用直接变频架构,覆盖10MHz至7250MHz频段,支持最大450MHz带宽及JESD204B高速接口,性能对标国际,满足5G基站与卫星通信等高端需求,突破海外技术壁垒。

月起私人充电桩可卖电 每度净赚5毛
业界动态 · 2026-07-01

月起私人充电桩可卖电 每度净赚5毛

近期有一则重大利好消息,值得新能源车主们特别留意——车网互动价格机制改革已正式落地。自7月1日起,湖北武汉的新能源车主,可在家中的私人充电桩上通过“卖电”轻松赚钱。具体而言,就是借助峰谷电价差,实现低买高卖,每度电净收益约5毛钱。过去,车网互动(V2G)基本只局限于特定的公共充电站,受试点规模限制,

谷歌发布Nano Banana 2 Lite 4秒出图1元4张
业界动态 · 2026-07-01

谷歌发布Nano Banana 2 Lite 4秒出图1元4张

先说几个关键信息:谷歌DeepMind又给图像生成赛道添了新选项。7月1日发布的消息,Nano Banana 2 Lite正式亮相。这个名字听起来像是水果命名系列大爆发,实际上它的技术代号是Gemini 3 1 Flash Lite Image,属于Gemini 3 1家族。最大的卖点就两个:快,便

技嘉专业电竞装备助力2025 CFS世界总决赛
业界动态 · 2026-07-01

技嘉专业电竞装备助力2025 CFS世界总决赛

2025CFS世界总决赛将于12月3日至14日在重庆举行,来自四大赛区的16支战队参赛。技嘉AORUS作为赛事设备合作伙伴,以主板、显示器等专业硬件保障比赛稳定流畅,并通过赛事反哺研发的闭环模式支持电竞发展。