首页 游戏 软件 资讯 排行榜 专题
首页
科技数码
阿里云发力物理AI芯片:如何构建多模态硬件生态闭环?

阿里云发力物理AI芯片:如何构建多模态硬件生态闭环?

热心网友
88
转载
2026-01-13

随着多模态大模型的发展,物理AI成为科技巨头角逐的关键阵地。日前在深圳举办的阿里云通义智能硬件展上,阿里云发布多模态交互开发套件,集成了千问、万相、百聆三款通义基础大模型,预置十多款Agent和MCP工具,丰富硬件设备与物理世界的智能交互能力。

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

降低开发门槛

“2026年我们特别看好智能硬件,应该会看到很多新的品类,绝对不光是手机、汽车和眼镜。”阿里云通义大模型业务总经理徐栋在展会期间接受媒体采访时预计,把模型从“云上”向“云下”落地,提高易用性,有利于生态繁荣,商业模式也可能会形成闭环;作为重要趋势,当前一些新型应用围绕小型化、碎片化的刚需开展,厂商通过模型去定义硬件,提高用户黏性,模型能力逐渐提升,品牌效应逐步形成。

但是,AI硬件的普及仍然面临多重障碍。

徐栋指出,很多AI硬件的形态成本仍未达到大众普及水平,而且存在隐私顾虑。另外,开发范式转型滞后,很多厂商还停留在传统Coding(编程)思维,没意识到IDR(需求定义)的价值越来越重要,且模型能力在泛化调用工具等方面仍有提升空间。此外,硬件厂商自建模型面临的延时、效果与安全问题,进一步制约了产业发展。

本次阿里云多模态交互开发套件为硬件企业和解决方案商提供了低开发门槛、响应速度快、场景丰富的平台。其中,突出特点在于计费方式的改变。

“我们把原来的按Token计量计费改变成一个按硬件的终端提供服务。”徐栋介绍,按License收费是精算的过程,通过区分不同类目和等级,比开发者自己搭建ASR(语音转文本)、TTS(文本转语音)、LLM(大语言模型)成本低很多。比如有些语音模型TTS可以稍微降低拟人化的要求,从而大幅降低成本。

专有硬件交互模型

现场,阿里云展示了面向智能穿戴设备、陪伴机器人、具身智能等领域的解决方案。例如,在AI眼镜领域,基于千问VL、百聆CosyVoice等模型,阿里云打造了感知层、规划层、执行层以及长期记忆的完整交互链路,可一站式实现同声传译、拍照翻译、多模态备忘录、录音转写功能,有效解决交互不自然、回答准确率低的难题。

面向家庭陪伴机器人场景,基于千问模型和多模态交互套件,阿里云推出的解决方案不仅可实时监测异常状况,并及时告警信息推送,用户还能基于关键词查找、定位视频,与机器人进行对话交互和控制设备等。

除通义模型家族外,阿里云还针对大量多模态交互场景进行分析,推出适合AI硬件交互的专有模型,全面支持全双工语音、视频、图文等交互方式,端到端语音交互时延低至1秒,视频交互时延低至1.5秒。该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过A2A协议兼容三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。

对于阿里云在手机、智能眼镜等大品类硬件领域的竞争壁垒,徐栋表示,阿里云愿意与开发者合作,降低门槛,也会探索大量的垂直领域的深度合作。

目前AI手机并行GUI(图形界面,GraphicalUserInterface)与A2A(应用间自动化交互,Application-to-Application)两大技术路线。

在徐栋看来,当前两大路线均处于发展早期。技术核心需解决泛化性与速度性能问题,且需依托手机更多权限实现优化。短期来看,A2A路线发展更快,体验更优、响应速度更快且模型消耗成本更低;GUI路线依赖多模态视觉交互,长期使用成本更高,两条路线均具备探索价值。

助力垂直场景应用落地

该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过A2A协议兼容第三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。

“今天的套件其实依托于我们阿里云的MaaS(模型即服务)服务而来的,适合垂直场景。”徐栋介绍,过去很多开发者基于百炼平台自行搭建工具、开发Agent,如今套件做了针对性改造,降低了操作复杂度,支持快速实现多种智能化能力,同时对百炼平台的MCP(模型调用平台)能力进行了封装,开发者可直接快速调取,而且套件通过API(应用程序接口)、SDK(软件开发工具包)与百炼形成通道衔接,实现与各类硬件的深度整合。

另外,套件适配30多款主流ARM、RISC-V和MIPS架构终端芯片平台;未来,通义大模型还将与玄铁RISC-V实现软硬全链路的协同优化,实现通义大模型家族在RISC-V架构上的极致高效部署和推理性能。

“玄铁在RISC-V开源生态贡献很大,我们最早合作是为了让千问与玄铁同频共振,让开发者能自主可控。”徐栋表示,不过与玄铁合作并非目标实现模型硬件化,而是优化通用模型,让端侧速度更快、体验更好。

2026年CES上,芯片巨头重点锚定物理AI以及具身智能等进展趋势,推出系列新品。

“具身智能还处于非常早期的阶段。”徐栋表示,阿里云在具身智能领域一方面是基于千问Omni多模态模型的交互合作。该模型支持“看、听、说”多模态协同,非单路输入输出,而是具备低延时、高拟人性及多语言出海能力,已被头部机器人公司用于交互场景,但受限于机器人市场本身规模,当前应用量不大。另一方面,公司研发探索VLA(视觉—语言—动作)模型,但受数据、模型架构、任务泛化性等因素限制,仍处于早期阶段;预计2026年下半年可看到相关架构成果,但要实现高度泛化的VLA能力还需更多时间。

来源:https://www.163.com/dy/article/KJ3QJFV9053469RG.html
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

相关攻略

OpenClaw是什么?OpenClaw怎么样?OpenClaw 2026年最新部署方法整理
AI
OpenClaw是什么?OpenClaw怎么样?OpenClaw 2026年最新部署方法整理

OpenClaw是什么?2026年最新一键部署方法与实战指南 如果您正在寻找一款功能强大、完全开源的AI智能体框架,那么OpenClaw(曾用名Clawdbot或Moltbot)无疑是当前的优选。它凭借卓越的任务自动化能力与丰富的工具集成生态,已成为个人开发者与企业构建智能助理的首选平台。然而,对于

热心网友
04.02
OpenClaw 赋能 UI自动化
AI
OpenClaw 赋能 UI自动化

目录 一、OpenClaw到底是什么? 二、搭建OpenClaw需要准备什么环境? 三、如何开通阿里云百炼Coding Plan套餐? 1、访问Coding Plan购买页面 2、选择Lite基础套餐(7 9元 月) 3、获取并保管好API Key 四、购买一台阿里云服务器 五、快速部署OpenCl

热心网友
04.01
白嫖阿里云百炼大模型后OpenClaw如何添加更多模型
AI
白嫖阿里云百炼大模型后OpenClaw如何添加更多模型

角色与核心任务 我们共同面对一个极具价值的议题:如何将一段由人工智能生成的文字,打磨成一篇风格鲜明、具有人性温度的专业文稿?这绝不是机械的同义词替换,而是一场关于表达质感与思想深度的全面升级。 任务的目标清晰而坚定:文章的全部事实论据、核心观点、逻辑框架,乃至每一个章节标题和插图嵌入点,都必须保持原

热心网友
04.01
周红伟:随着OpenClaw的爆火,阿里云上线了OpenClaw云端极简部署及全套
AI
周红伟:随着OpenClaw的爆火,阿里云上线了OpenClaw云端极简部署及全套

近日,备受瞩目的开源个人AI助手正式完成第三次品牌升级,最终定名为OpenClaw。在此之前,项目曾历经Clawdbot与Moltbot两个发展阶段。伴随着OpenClaw的迅速走红,阿里云已同步上线云端极简部署方案及全套配套服务,用户无需进行繁琐的本地环境配置,即可快速拥有一个功能强大的专属AI智

热心网友
04.01
阿里集团战略投资高瓴,详解合作动向与深层考量
科技数码
阿里集团战略投资高瓴,详解合作动向与深层考量

【导读】易普集相继完成两轮亿级美元融资,阿里云、高瓴创投押注中国基金报记者 邱德坤3月31日,全球预制化模块数据中心基础设施服务商易普集宣布,已完成逾1亿美元B+轮融资,由Decarbonizat

热心网友
04.01

最新APP

火柴人传奇
火柴人传奇
动作冒险 04-01
街球艺术
街球艺术
体育竞技 04-01
飞行员模拟
飞行员模拟
休闲益智 04-01
史莱姆农场
史莱姆农场
休闲益智 04-01
绝区零
绝区零
角色扮演 04-01

热门推荐

百度网盘app如何切换企业版-百度网盘app切换企业版的具体操作方法介绍
手机教程
百度网盘app如何切换企业版-百度网盘app切换企业版的具体操作方法介绍

百度网盘个人版如何转企业版?完整切换步骤详细指南 当个人网盘难以满足团队文件共享与协作需求时,百度网盘提供的企业版无疑是高效解决方案。本文将为你详细解析如何直接在百度网盘App内,将个人账户一键切换至功能更强大的企业版,快速开启团队文件管理新模式。 第一步:进入个人中心页面 首先,请确保已安装并打开

热心网友
04.02
AI+eSIM落地 中国联通5G AI CPE巴展重磅亮相
科技数码
AI+eSIM落地 中国联通5G AI CPE巴展重磅亮相

“AI+eSIM”云智终端方案正式商用,首批合作项目5G AI CPE成功落地 在MWC 2026世界移动通信大会上,产业合作迎来重大进展。由全球移动通信系统协会(GSMA)与中国联通共同倡导的“‘AI+eSIM’云智终端合作联通方案”正式对外发布,并迅速完成首个商业化项目签约。中国联通联合通则康威

热心网友
04.02
洛克王国世界水泡壳如何搭配技能-洛克王国世界水泡壳技能搭配方法
游戏资讯
洛克王国世界水泡壳如何搭配技能-洛克王国世界水泡壳技能搭配方法

洛克王国世界水泡壳技能搭配完全指南:打造攻防一体的战术核心 世界水泡壳的技能池设计充满了战术深度,完美诠释了攻防一体的战斗哲学。无论是纯粹依靠威力压制对手的技能,还是具备控制、辅助等战略功能的技能,都能在其技能库中找到。掌握其技能搭配的核心思路,是让世界水泡壳在对战中发挥出全部潜力的关键,能够轻松取

热心网友
04.02
现货比特币(BTC)ETF当周吸金14.2亿美元,创10月初以来最强劲一周
web3.0
现货比特币(BTC)ETF当周吸金14.2亿美元,创10月初以来最强劲一周

现货比特币ETF单周吸金14 2亿美元,强势回归背后的市场信号 加密货币市场正迎来关键转折点。近期数据显示,现货比特币ETF资金流入呈现爆发式增长,成为近期最受关注的市场风向标。这不仅反映了机构资金的重新布局,更可能预示着市场供需结构的深层变化。 数据解读:创纪录的资金流入意味着什么? 根据专业追踪

热心网友
04.02
燕云十六声河西竹篮打水奇遇怎么做-燕云十六声河西竹篮打水奇遇的做法介绍
游戏资讯
燕云十六声河西竹篮打水奇遇怎么做-燕云十六声河西竹篮打水奇遇的做法介绍

河西竹篮打水奇遇触发地点指南 想要成功触发《燕云十六声》中颇具趣味的“竹篮打水”奇遇,玩家需要首先前往河西地图的特定区域进行探索。该触发点位置较为隐蔽,建议在河西沿岸的村落与水边场景多番巡视。当你接近正确位置时,可以留意游戏内的环境暗示,例如独特的视觉标识、背景音效的变化或氛围的微妙转变,这些都是系

热心网友
04.02