10月18日,阿里云IoT联合阿里巴巴达摩院正式发布分布式语音交互解决方案,该方案将集成双方的平台连接能力和语音交互技术,以声控的形式完全改造家居环境,只需要简单说上几句话,就能让家里的设备全都“动”起来。
传统语音交互受限于空间,用户只能在智能音箱等单一入口所触达的空间实现声控,而此次发布的分布式语音解决方案,能够将语音交互能力输出到各类家居设备上面,实现“无处不在”的声控体验。
据介绍,该方案包括前端声学模组、语音自学习平台、对话平台以及阿里云IoT智能人居平台,打通了上下游平台串联、端云一体能力,可以大大缩短智能人居环境开发周期,具备很强的扩展能力。
采用该分布式语音解决方案的电器设备,可以通过就近的开关作为智能语音交互入口,即可对全屋智能家居语音控制,通过智能人居平台,家居场景智能设备语音操控将很容易就实现全覆盖,小到开关灯,大到新风系统操控,将完全实现语音触达。
阿里巴巴达摩院语音实验室研究员付强表示,在语音交互前端处理技术和方案的研发上投入了非常大的技术力量,此次和阿里云IoT共同推出的分布式语音交互解决方案,也是一次在声控式人居层面的创新应用。未来,将继续加大在智能语音交互方面的研究和合作,打造更多的全新产品。
当前,语音交互逐渐成为热门领域,特别是在智能家居领域,开始替代以触控为主的交互方式,此次发布的分布式语音交互解决方案,势必为智能智能家居行业带来了新的推动力,未来家居行业也有望迎来全声控时代。
好文章,需要你的鼓励
苹果在iOS 26公开发布两周后推出首个修复更新iOS 26.0.1,建议所有用户安装。由于重大版本发布通常伴随漏洞,许多用户此前选择安装iOS 18.7。尽管iOS 26经过数月测试,但更大用户基数能发现更多问题。新版本与iPhone 17等新机型同期发布,测试范围此前受限。预计苹果将继续发布后续修复版本。
Queen's大学研究团队提出结构化智能体软件工程框架SASE,重新定义人机协作模式。该框架将程序员角色从代码编写者转变为AI团队指挥者,建立双向咨询机制和标准化文档系统,解决AI编程中的质量控制难题,为软件工程向智能化协作时代转型提供系统性解决方案。
据报道,OpenAI正准备发布一款由即将推出的Sora 2视频模型驱动的独立社交应用。该应用与TikTok高度相似,采用垂直视频信息流和滑动滚动导航。不过,该应用仅支持AI生成的内容,用户无法从手机相册上传照片或视频。Sora 2在应用内生成的视频时长限制为10秒或更短。应用还包含身份验证工具,允许用户使用自己的肖像生成视频,其他用户可以标记并在重新混合视频时使用他们的肖像。
西北工业大学与中山大学合作开发了首个超声专用AI视觉语言模型EchoVLM,通过收集15家医院20万病例和147万超声图像,采用专家混合架构,实现了比通用AI模型准确率提升10分以上的突破。该系统能自动生成超声报告、进行诊断分析和回答专业问题,为医生提供智能辅助,推动医疗AI向专业化发展。