至顶网软件频道消息: 1月15日,在北京举办的2019阿里云数字地产峰会上,阿里云发布分布式语音解决方案2.0,赋能硬件合作伙伴,以语音能力为智能空间带来全新交互体验。
据了解,此次发布的分布式语音交互解决方案包括前端声学模组、语音自学习平台、对话平台、阿里云IoT智能人居平台,可实现上下游平台串联、端云一体能力打通,并以标准化能力输出,帮助厂家快速应用,缩短开发周期,具备强扩展能力。
目前,市场上的语音交互设备多以智能音箱单品的形式呈现,往往只能服务到客厅或卧室等单个智能空间。通过分布式语音方案与开关面板,温控器,冰箱等各种设备结合,可将语音交互能力快速与室内场景融合,使屋内处处都具有语音识别能力,让业主只需动嘴,就能轻松享受智能家居生活。
此外,阿里巴巴分布式语音技术不仅能通过对话实现单个智能设备的控制和关联多设备的场景控制,而且还能实现分布式语音控制和流式多意图识别。客厅的语音指令,会精准定向到客厅的智能化设备进行执行。而且每条指令不再是生硬的意图表达,而更多像在和一个你的专属管家聊天,“请帮我关闭灯,拉上窗帘,对了,再把空调调到25度。”这样口语化的表达,将使业主在室内的人机交互体验变得更加轻松有趣。
相关负责人表示,阿里巴巴在语音交互前端处理技术和方案的研发上投入了非常大的技术力量,此次和阿里云共同发布的分布式语音生态能力,旨在赋能合作伙伴,升级智能空间的交互方式。未来,阿里将继续加大在智能语音交互方面的研究和合作,打造更多的全新产品。
好文章,需要你的鼓励
Allen AI研究所联合多家顶尖机构推出SAGE智能视频分析系统,首次实现类人化的"任意时长推理"能力。该系统能根据问题复杂程度灵活调整分析策略,配备六种智能工具进行协同分析,在处理10分钟以上视频时准确率提升8.2%。研究团队创建了包含1744个真实娱乐视频问题的SAGE-Bench评估平台,并采用创新的AI生成训练数据方法,为视频AI技术的实际应用开辟了新路径。
联想推出新一代NVMe存储解决方案DE6600系列,包含全闪存DE6600F和混合存储DE6600H两款型号。该系列产品延迟低于100微秒,支持多种连接协议,2U机架可容纳24块NVMe驱动器。容量可从367TB扩展至1.798PiB全闪存或7.741PiB混合配置,适用于AI、高性能计算、实时分析等场景,并配备双活控制器和XClarity统一管理平台。
中科院团队首次系统评估了AI视觉模型在文本压缩环境下的理解能力,发现虽然AI能准确识别压缩图像中的文字,但在理解深层含义、建立关联推理方面表现不佳。研究通过VTCBench测试系统揭示了AI存在"位置偏差"等问题,为视觉文本压缩技术的改进指明方向。