近日,华为全联接大会 2026华为云峰会举办,峰会上,隆重举行了“华为云行业AI生态解决方案发布仪式”,Soul张璐团队(上海任意门科技有限公司)与华为云联合发布智能音视频实时交互解决方案。凭借在情绪感知与多模态交互领域的技术积累,Soul打造自然语音合成与实时视频生成能力,带来自然流畅的实时语音交流和沉浸式互动体验,推动AI交互能力在App、智能硬件、产业端等多元场景中的应用。

强强联合,算力与交互能力形成互补优势
当前AI行业快速迭代,基础对话能力已经十分普及,但兼具情绪理解、实时音视频能力、沉浸式互动的产品,依旧面临较高的落地门槛。此次发布的解决方案,将Soul张璐团队的实时交互能力与华为云支持相结合,围绕声音的自然度、交流的流畅度及音视频互动的即时性,打造更具真实感与沉浸感的交互体验,为多模态AI应用落地提供支撑;华为云则提供云基础服务、数据底座、ModelArts 训练推理算力以及高性能存储等支持。
软硬体系互补,解决了情感交互模型训练、推理阶段的算力压力,让声音自然度、对话流畅度、音视频即时性这些关键体验指标得到保障,为多模态 AI 的商业化落地夯实基础。
SoulX 为核心,搭建 “自有应用产业生态” 双层体系
自2016年上线核心产品Soul App,Soul围绕对“人、情绪、关系和交互”的深刻理解,持续通过产品创新和技术迭代,为以Z世代为代表的用户群体提供更优质的体验。过程中,Soul也积累了以自研模型SoulX为代表的解决方案。
现阶段,SoulX 已经建成完整的能力矩阵,覆盖语音生成、歌声生成、语音转换、多说话人转录、全双工实时交互、实时数字人生成等模块,打通语音理解、情感表达、交互控制、多模态呈现全流程,为打造具备共情能力的 AI 产品提供完整技术链路。
Soul张璐团队已搭建起 “自有应用 — 产业生态” 双层应用体系。对内依托 Soul App 真实社交场景持续迭代模型能力;对外面向具身智能、内容演绎赛道输出成熟解决方案。
在打磨自研技术的同时,Soul张璐团队也持续布局开源生态,把垂类能力向全球开发者开放。2025年10月开源的 SoulXPodcast 语音播客生成模型,发布第二天就登顶 HuggingFace TTS 趋势榜,在GitHub平台更是收获 3500+star。后续实时数字人、歌声合成、多人转录等多款模型陆续开源,为行业提供更多元的技术解决方案。
场景验证与安全治理,赋能生态伙伴创新发展
技术落地不只看实验室指标,真实场景检验和风险治理同样不可或缺。团队依托 Soul App 真实社交场景持续迭代模型,同时构建全链路 AI 安全治理体系,覆盖虚拟人、语音互动从输入、生成、输出到风险干预、用户保护的全流程,为产业提供安全参考范本。

结合华为云的云上底座能力,这套经过实战检验的完整方案,能够降低合作伙伴的开发门槛,助力更多企业打造带有情感表达能力的 AI 产品,推动实时交互技术释放更大产业价值。
未经书面授权禁止复制或建立镜像
特别提醒:新报网文章内容、图片、视频出现侵权问题,请与本站联系撤下相关作品 help@cssxw.com。
风险提示:新报网发布的文章、图片、数据等信息来源于互联网,仅供参考、学习分享使用,不构成投资建议。相关侵权责任由信息来源第三方承担。
Copyright@2010-2026 by all rights reserved
举报投诉:Jubao_404@163.com