思科在加利福尼亚州阿纳海姆举行的 WebexOne 活动上表示将应用人工智能确保通话和会议期间音频和视频的清晰,同时提高用户的工作效率。这些新功能在思科Webex人工智能助理推出后将应用到整个产品线,包括Webex套件、Webex联系中心、Webex控制中心和专用的思科协作设备。
思科高级副总裁兼思科协作总经理Javed Khan告诉记者,思科在人工智能方面采取的方法与其他公司略有不同。他表示,“语言智能很棒,但如果把音频和视频智能结合起来就能获得更多的洞察力。”
思科表示,Webex的视频智能是通过实时媒体模型(RMM)实现的,其目的是通过更丰富的实时洞察力提升协作体验。例如,思科的 RMM 可以检测会议参与者的动作和手势,可以知道他们何时离开会议,然后记录他们离开时的讨论内容,在他们返回时就能迅速跟上会议进度。
Webex的新人工智能音频编解码器主要用于改善网络连接差的用户在会议中的音频和视频质量。思科解释说,不流畅的音频和视频仍然是视频会议参与者面临的最大挑战之一,会导致对话中断及令参与者感到沮丧。人工智能音频编解码器可以加入大量传输冗余,确保更快地从网络数据包丢失中恢复及音频流不受影响。
据 Khan 介绍,其工作原理是先对音频流进行数字处理再发送给终端用户,音频的清晰度可以得到提高。人工智能音频编解码器还依靠生成式人工智能来填补缺失的空白,可以这么说。Khan解释说,“一个可能的例子是丢失了数据包,导致某人所说的话丢失了 300 毫秒。而生成式人工智能可以生成这些丢失的数据,填补这些丢失的点。”
人工智能音频编解码器同时还可以通过去噪、去混响和带宽扩展等功能提高音频的清晰度。此外,还有个新的超级分辨率功能,可以提高视频的质量,而且不受带宽条件的影响。
思科表示,除了提高 Webex 通话的质量,人工智能还可以通过多种方式帮助提高会议参与者的工作效率。Webex AI 助手可以执行诸如总结特定会议中的发言内容等任务,还可以帮助用户了解他们可能错过的几个会议中发生的事情。
个人空间内的文本信息可以整合成摘要。这些摘要也可以进行自定义,例如,用户可以要求 Webex人工智能助手在包含多人信息的空间中只关注老板发送的信息。
另一项新功能是“更改消息语气”,该功能可以帮助用户确保在给同事发送消息时使用正确的语气,展现更加专业的形象。Khan表示,“我们在语音语调方面已经取得了很大的成功。我们将采取‘小步子’的方式,但我们希望在联系中心更积极地使用这一功能,例如在呼叫中心员工提高的声音或出现疲劳时进行提示。”
Webex人工智能助手还可以为联系中心代理提供“建议性的回复”,以便联系中心代理可以快速回复客户。思科表示,实际建议将基于客户的历史记录及其请求或查询的上下文。最后还有个功能,Webex人工智能可以在虚拟和混合活动期间为互动问答和投票中分享的共同话题提供 Slido主题摘要,帮助参与者轻松了解热门话题。
据 Khan 介绍,Webex内的各种新人工智能功能处于的可用性阶段各不相同,首批功能预计将在今年年底前推出。他表示,“我们正在将这些功能整合到我们的平台结构中。”
好文章,需要你的鼓励
机器人和自动化工具已成为云环境中最大的安全威胁,网络犯罪分子率先应用自动化决策来窃取凭证和执行恶意活动。自动化攻击显著缩短了攻击者驻留时间,从传统的数天减少到5分钟内即可完成数据泄露。随着大语言模型的发展,"黑客机器人"将变得更加先进。企业面临AI快速采用压力,但多数组织错误地关注模型本身而非基础设施安全。解决方案是将AI工作负载视为普通云工作负载,应用运行时安全最佳实践。
MBZUAI研究团队发布了史上最大的开源数学训练数据集MegaMath,包含3716亿个Token,是现有开源数学数据集的数十倍。该数据集通过创新的数据处理技术,从网页、代码库和AI合成等多个来源收集高质量数学内容。实验显示,使用MegaMath训练的AI模型在数学推理任务上性能显著提升,为AI数学能力发展提供了强大支撑。
面对心理健康专业人士短缺问题,谷歌、麦肯锡和加拿大重大挑战组织联合发布《心理健康与AI现场指南》,提出利用AI辅助任务分担模式。该指南构建了包含项目适应、人员选择、培训、分配、干预和完成六个阶段的任务分担模型,AI可在候选人筛选、培训定制、客户匹配、预约调度和治疗建议等环节发挥作用。该方法通过将部分治疗任务分配给经过培训的非专业人员,并运用AI进行管理支持,有望缓解治疗服务供需失衡问题。
这项由多个知名机构联合开展的研究揭示了AI系统的"隐形思维"——潜在推理。不同于传统的链式思维推理,潜在推理在AI内部连续空间中进行,不受语言表达限制,信息处理能力提升约2700倍。研究将其分为垂直递归和水平递归两类,前者通过重复处理增加思考深度,后者通过状态演化扩展记忆容量。