近日,IBM向其嵌入式AI软件组合新增了三个库,推动AI功能的普及。
此次IBM宣布推出的新产品,让客户可以访问IBM Watson产品使用的AI库。换句话说,这些新产品让开发人员能够将极其复杂的AI功能直接构建到他们的应用中,而无需再重新投入时间和资源。训练AI模型通常需要大量的数据和专业知识,但开发人员使用IBM嵌入的库就可以实现即插即用。
这些新的库包括:IBM Watson Natural Language Processing Library,通过意图和情感获取意义和上下文,构建可以处理人类口语的应用;IBM Watson Speech to Text Library,让应用快速准确地转录人类语音;IBM Watson Text to Speech Library正好相反,它让应用能够将书面文本转换为自然声音形式的音频。
IBM表示,这三个库都是由IBM Research团队精心开发的,旨在为软件开发人员提供一种简单且可扩展的方式,将AI添加到运行在任何云环境中的应用。而且IBM补充说,这些库都是使用一些开源软件组件开发的。
IBM生态系统总经理Kate Woolley表示:“企业必须在构建、部署和管理AI驱动型解决方案所需的专业知识、资源和时间方面进行大量投资。我们通过将支持行业领先的IBM Watson产品的嵌入式AI技术组合推向市场,帮助生态系统合作伙伴更有效地提供AI体验,从而为其客户带来商业价值。”
这三个库的加入显着扩展了IBM现有的嵌入式AI产品组合,包括IBM Watson Assistant、IBM Watson Discovery、IBM Watson Instana Observability、IBM Maximo Visual Inspection和IBM Watson API。
Constellation Research分析师Holger Mueller表示,语音识别是许多下一代应用所需的一项关键功能,从根本上改变了用户体验,使其变得更好。Mueller说:“语音之所以有效,是因为人类说话的速度比打字快,所以任何具有语音识别功能的应用都比具有文本识别功能的应用更有优势。因此,很高兴看到IBM使用此前在Watson中使用的库,将更多选项带给开发者来实现这种基于语音的用户体验。更多的选项和更多的竞争对手,这对所有支持语音的应用来说都是一件好事。”
IBM表示,一些早期采用者已经试用了这些新的AI库,并且看到了立竿见影的效果,其中包括数据库公司SingleStore,该公司使用IBM Watson Natural Language Processing在其产品中实施情感分析。SingleStore产品高级副总裁Yatharth Gupta说:“帮助我们的客户整合和使用情绪分析等功能,这对于推动实时分析从而帮助他们更好地了解、吸引和服务客户来说,是非常宝贵的。”
好文章,需要你的鼓励
这项研究开发了CaptionQA系统,通过测试AI生成的图片描述能否支持实际任务来评估其真正价值。研究发现即使最先进的AI模型在图片描述实用性方面也存在显著不足,描述质量比直接看图时下降9%-40%。研究涵盖自然、文档、电商、机器人四个领域,为AI技术的实用性评估提供了新标准。
AI改变的远不止一间课堂,而是学生的学习方式、未来的职场场景和社会对工作者能力的要求,整个商业文明中的每一位参与者,都将被推着一起改变。
以色列理工学院研究团队提出了一种将专家混合模型融入YOLOv9目标检测的创新方法。该方法让多个专门化的YOLOv9-T专家分工协作,通过智能路由器动态选择最适合的专家处理不同类型图像。实验显示,在COCO数据集上平均精度提升超过10%,在VisDrone数据集上提升近30%,证明了"分工合作"比单一模型更有效,为AI视觉系统提供了新思路。