ZD至顶网软件频道消息: 微软一直在紧锣密鼓地将游戏和Azure服务推至物联网(IOT)设备上。但很少有业界人士注意到,微软同时也在将各种语音功能推至物联网设备。
今年2月,在台北举办的中国WinHEC研讨会上碰巧听了微软的一个名为“用于物联网的自然用户界面技术”的演讲,演讲介绍了微软在物联网语音领域采用的多管齐下策略,目标听众是开发商。
微软为物联网开发商提供各种整合工具,以用于语音和开发商设备的整合:Windows 10有内置的语音应用程序编程接口(API),可完成各种功能,如口述一个简单的消息和网页搜索;微软还提供自然语言服务,全名为语言理解智能服务(缩写为LUIS),LUIS是微软研究院牛津API集合的一部分,可用于非Windows平台。另外,微软还提供Bing翻译、Cortana及微软个人数字助理等工具。
要搞清楚哪个工具是完成某个功能的最佳工具貌似颇为微妙。微软官员在WinHEC研讨会上提供了一个指导框架,框架列出了一些的应用实例,例如如何通过语音控制法式烹饪机(用到LUIS与Windows 10的组合或牛津语音API)或如何用语音控制机器人(用到Windows 10自带语音API)。
微软还展示了一个家庭自动化设备控制的例子,举例说明了用户如何无需使用手机或平板电脑、只利用语音查询自己的车库门是不是关闭妥当。
微软在2016年中国WinHEC会上的演讲,还为物联网开发商提供了利用牛津API进行人脸检测、识别和验证的一些指引。
另外,微软可能会在今年的Build大会上宣布牛津项目(Project Oxford)将结束研究阶段进入商业化之路。微软可能会将牛津项目的一些服务贴上新的Azure认知服务牌子或Azure的智能服务牌子。
好文章,需要你的鼓励
时尚零售巨头维多利亚的秘密因安全事件导致网站和线上订单服务中断,已立即启动应急响应、邀请第三方专家协助恢复运营,实体店仍正常营业。
IBM研究院AI团队开发的POBs基准测试揭示了大型语言模型在主观话题上表现出明显偏好,尤其倾向于进步-集体主义观点。研究发现,增加测试时计算(思考时间)对减少模型偏见效果有限,且更新版本的模型反而表现出更强烈的立场和更低的一致性。这项研究提供了评估AI系统意识形态倾向的工具,帮助用户和企业做出更明智的选择。
Carma Technology 针对 Uber 提起专利侵权诉讼,称其侵犯了涉及拼车系统的五项专利。案情回溯至十年前,凸显专利保护对创新者的重要性,可能对 Uber 及其他公司带来巨大影响。
东京大学研究团队开发的WebChoreArena是一个全新的网页代理评估基准,它包含532个精心设计的任务,专注于测试AI代理处理繁琐、复杂网页任务的能力。研究结果显示,即使是最先进的语言模型(如Gemini 2.5 Pro)在这些挑战性任务上的表现也比常规任务降低了约14个百分点,证明了这一基准有效区分了不同模型的能力。WebChoreArena通过设计海量记忆、计算、长期记忆等类型的任务,为评估AI代理在实际应用场景中的表现提供了更严格的标准。