近日,IBM向其嵌入式AI软件组合新增了三个库,推动AI功能的普及。
此次IBM宣布推出的新产品,让客户可以访问IBM Watson产品使用的AI库。换句话说,这些新产品让开发人员能够将极其复杂的AI功能直接构建到他们的应用中,而无需再重新投入时间和资源。训练AI模型通常需要大量的数据和专业知识,但开发人员使用IBM嵌入的库就可以实现即插即用。
这些新的库包括:IBM Watson Natural Language Processing Library,通过意图和情感获取意义和上下文,构建可以处理人类口语的应用;IBM Watson Speech to Text Library,让应用快速准确地转录人类语音;IBM Watson Text to Speech Library正好相反,它让应用能够将书面文本转换为自然声音形式的音频。
IBM表示,这三个库都是由IBM Research团队精心开发的,旨在为软件开发人员提供一种简单且可扩展的方式,将AI添加到运行在任何云环境中的应用。而且IBM补充说,这些库都是使用一些开源软件组件开发的。
IBM生态系统总经理Kate Woolley表示:“企业必须在构建、部署和管理AI驱动型解决方案所需的专业知识、资源和时间方面进行大量投资。我们通过将支持行业领先的IBM Watson产品的嵌入式AI技术组合推向市场,帮助生态系统合作伙伴更有效地提供AI体验,从而为其客户带来商业价值。”
这三个库的加入显着扩展了IBM现有的嵌入式AI产品组合,包括IBM Watson Assistant、IBM Watson Discovery、IBM Watson Instana Observability、IBM Maximo Visual Inspection和IBM Watson API。
Constellation Research分析师Holger Mueller表示,语音识别是许多下一代应用所需的一项关键功能,从根本上改变了用户体验,使其变得更好。Mueller说:“语音之所以有效,是因为人类说话的速度比打字快,所以任何具有语音识别功能的应用都比具有文本识别功能的应用更有优势。因此,很高兴看到IBM使用此前在Watson中使用的库,将更多选项带给开发者来实现这种基于语音的用户体验。更多的选项和更多的竞争对手,这对所有支持语音的应用来说都是一件好事。”
IBM表示,一些早期采用者已经试用了这些新的AI库,并且看到了立竿见影的效果,其中包括数据库公司SingleStore,该公司使用IBM Watson Natural Language Processing在其产品中实施情感分析。SingleStore产品高级副总裁Yatharth Gupta说:“帮助我们的客户整合和使用情绪分析等功能,这对于推动实时分析从而帮助他们更好地了解、吸引和服务客户来说,是非常宝贵的。”
好文章,需要你的鼓励
继苹果和其他厂商之后,Google正在加大力度推广其在智能手机上的人工智能功能。该公司试图通过展示AI在移动设备上的实用性和创新性来吸引消费者关注,希望说服用户相信手机AI功能的价值。Google面临的挑战是如何让消费者真正体验到AI带来的便利,并将这些技术优势转化为市场竞争力。
麻省理工学院研究团队发现大语言模型"幻觉"现象的新根源:注意力机制存在固有缺陷。研究通过理论分析和实验证明,即使在理想条件下,注意力机制在处理多步推理任务时也会出现系统性错误。这一发现挑战了仅通过扩大模型规模就能解决所有问题的观点,为未来AI架构发展指明新方向,提醒用户在复杂推理任务中谨慎使用AI工具。
Meta为Facebook和Instagram推出全新AI翻译工具,可实时将用户生成内容转换为其他语言。该功能在2024年Meta Connect大会上宣布,旨在打破语言壁垒,让视频和短视频内容触达更广泛的国际受众。目前支持英语和西班牙语互译,后续将增加更多语言。创作者还可使用AI唇形同步功能,创造无缝的口型匹配效果,并可通过创作者控制面板随时关闭该功能。
中科院自动化所等机构联合发布MM-RLHF研究,构建了史上最大的多模态AI对齐数据集,包含12万个精细人工标注样本。研究提出批评式奖励模型和动态奖励缩放算法,显著提升多模态AI的安全性和对话能力,为构建真正符合人类价值观的AI系统提供了突破性解决方案。