1月8日,在阿里云通义智能硬件展上,阿里云正式推出多模态交互开发套件。该套件整合了千问、万相、百聆三款通义基础大模型,同时预置十多款覆盖生活休闲、工作效率等场景的Agent和MCP工具,具备听、看、思考及物理世界交互能力,适用于AI眼镜、学习机、陪伴玩具、智能机器人等多种硬件终端。
芯片适配方面,该套件兼容30余种主流ARM、RISC-V及MIPS架构终端芯片平台,可满足多数硬件设备的快速接入需求。未来,通义大模型还将与玄铁RISC-V深化合作,通过软硬全链路协同优化,进一步提升大模型家族在RISC-V架构上的部署效率与推理性能。
模型优化上,除通义系列模型外,阿里云还针对多模态交互场景进行深度分析,开发适配AI硬件的专用模型,全面支持全双工语音、视频、图文等交互形式,端到端语音交互时延压缩至1秒,视频交互时延低至1.5秒。
此外,套件预置的十多款MCP工具与Agent已覆盖生活、工作、娱乐、教育等多场景;同时接入阿里云百炼平台生态,用户可添加其他开发者提供的MCP和Agent模板,并通过A2A协议兼容第三方Agent,从而大幅扩展应用能力边界,助力企业灵活搭建业务场景。
展会上,阿里云同步展示了面向智能穿戴、陪伴机器人、具身智能等领域的解决方案。以AI眼镜为例,依托千问VL、百聆CosyVoice等模型,阿里云构建起包含感知层、规划层、执行层及长期记忆的完整交互链路,可一站式实现同声传译、拍照翻译、多模态备忘录、录音转写等功能,有效解决交互自然度不足、回答准确率低的问题。
据国际权威市场研究机构Gartner发布的GenAI技术创新指南系列报告显示,阿里云在GenAI云基础设施、GenAI工程、GenAI模型及AI知识管理应用四大维度均跻身新兴领导者象限,是该报告中唯一入选全部四项的亚太厂商,与谷歌、OpenAI共同处于该领域第一梯队。
来源:杨翔菲
#沪指逼近4100点 上涨空间还有多少?##2026我的新年投资计划##暖阳创作计划#