近日,IBM向其嵌入式AI软件组合新增了三个库,推动AI功能的普及。
此次IBM宣布推出的新产品,让客户可以访问IBM Watson产品使用的AI库。换句话说,这些新产品让开发人员能够将极其复杂的AI功能直接构建到他们的应用中,而无需再重新投入时间和资源。训练AI模型通常需要大量的数据和专业知识,但开发人员使用IBM嵌入的库就可以实现即插即用。
这些新的库包括:IBM Watson Natural Language Processing Library,通过意图和情感获取意义和上下文,构建可以处理人类口语的应用;IBM Watson Speech to Text Library,让应用快速准确地转录人类语音;IBM Watson Text to Speech Library正好相反,它让应用能够将书面文本转换为自然声音形式的音频。
IBM表示,这三个库都是由IBM Research团队精心开发的,旨在为软件开发人员提供一种简单且可扩展的方式,将AI添加到运行在任何云环境中的应用。而且IBM补充说,这些库都是使用一些开源软件组件开发的。
IBM生态系统总经理Kate Woolley表示:“企业必须在构建、部署和管理AI驱动型解决方案所需的专业知识、资源和时间方面进行大量投资。我们通过将支持行业领先的IBM Watson产品的嵌入式AI技术组合推向市场,帮助生态系统合作伙伴更有效地提供AI体验,从而为其客户带来商业价值。”
这三个库的加入显着扩展了IBM现有的嵌入式AI产品组合,包括IBM Watson Assistant、IBM Watson Discovery、IBM Watson Instana Observability、IBM Maximo Visual Inspection和IBM Watson API。
Constellation Research分析师Holger Mueller表示,语音识别是许多下一代应用所需的一项关键功能,从根本上改变了用户体验,使其变得更好。Mueller说:“语音之所以有效,是因为人类说话的速度比打字快,所以任何具有语音识别功能的应用都比具有文本识别功能的应用更有优势。因此,很高兴看到IBM使用此前在Watson中使用的库,将更多选项带给开发者来实现这种基于语音的用户体验。更多的选项和更多的竞争对手,这对所有支持语音的应用来说都是一件好事。”
IBM表示,一些早期采用者已经试用了这些新的AI库,并且看到了立竿见影的效果,其中包括数据库公司SingleStore,该公司使用IBM Watson Natural Language Processing在其产品中实施情感分析。SingleStore产品高级副总裁Yatharth Gupta说:“帮助我们的客户整合和使用情绪分析等功能,这对于推动实时分析从而帮助他们更好地了解、吸引和服务客户来说,是非常宝贵的。”
好文章,需要你的鼓励
很多人担心被AI取代,陷入无意义感。按照杨元庆的思路,其实无论是模型的打造者,还是模型的使用者,都不该把AI放在人的对立面。
MIT研究团队提出递归语言模型(RLM),通过将长文本存储在外部编程环境中,让AI能够编写代码来探索和分解文本,并递归调用自身处理子任务。该方法成功处理了比传统模型大两个数量级的文本长度,在多项长文本任务上显著优于现有方法,同时保持了相当的成本效率,为AI处理超长文本提供了全新解决方案。
谷歌宣布对Gmail进行重大升级,全面集成Gemini AI功能,将其转变为"个人主动式收件箱助手"。新功能包括AI收件箱视图,可按优先级自动分组邮件;"帮我快速了解"功能提供邮件活动摘要;扩展"帮我写邮件"工具至所有用户;支持复杂问题查询如"我的航班何时降落"。部分功能免费提供,高级功能需付费订阅。谷歌强调用户数据安全,邮件内容不会用于训练公共AI模型。
华为研究团队推出SWE-Lego框架,通过混合数据集、改进监督学习和测试时扩展三大创新,让8B参数AI模型在代码自动修复任务上击败32B对手。该系统在SWE-bench Verified测试中达到42.2%成功率,加上扩展技术后提升至49.6%,证明了精巧方法设计胜过简单规模扩展的技术理念。