近日,IBM向其嵌入式AI软件组合新增了三个库,推动AI功能的普及。
此次IBM宣布推出的新产品,让客户可以访问IBM Watson产品使用的AI库。换句话说,这些新产品让开发人员能够将极其复杂的AI功能直接构建到他们的应用中,而无需再重新投入时间和资源。训练AI模型通常需要大量的数据和专业知识,但开发人员使用IBM嵌入的库就可以实现即插即用。
这些新的库包括:IBM Watson Natural Language Processing Library,通过意图和情感获取意义和上下文,构建可以处理人类口语的应用;IBM Watson Speech to Text Library,让应用快速准确地转录人类语音;IBM Watson Text to Speech Library正好相反,它让应用能够将书面文本转换为自然声音形式的音频。
IBM表示,这三个库都是由IBM Research团队精心开发的,旨在为软件开发人员提供一种简单且可扩展的方式,将AI添加到运行在任何云环境中的应用。而且IBM补充说,这些库都是使用一些开源软件组件开发的。
IBM生态系统总经理Kate Woolley表示:“企业必须在构建、部署和管理AI驱动型解决方案所需的专业知识、资源和时间方面进行大量投资。我们通过将支持行业领先的IBM Watson产品的嵌入式AI技术组合推向市场,帮助生态系统合作伙伴更有效地提供AI体验,从而为其客户带来商业价值。”
这三个库的加入显着扩展了IBM现有的嵌入式AI产品组合,包括IBM Watson Assistant、IBM Watson Discovery、IBM Watson Instana Observability、IBM Maximo Visual Inspection和IBM Watson API。
Constellation Research分析师Holger Mueller表示,语音识别是许多下一代应用所需的一项关键功能,从根本上改变了用户体验,使其变得更好。Mueller说:“语音之所以有效,是因为人类说话的速度比打字快,所以任何具有语音识别功能的应用都比具有文本识别功能的应用更有优势。因此,很高兴看到IBM使用此前在Watson中使用的库,将更多选项带给开发者来实现这种基于语音的用户体验。更多的选项和更多的竞争对手,这对所有支持语音的应用来说都是一件好事。”
IBM表示,一些早期采用者已经试用了这些新的AI库,并且看到了立竿见影的效果,其中包括数据库公司SingleStore,该公司使用IBM Watson Natural Language Processing在其产品中实施情感分析。SingleStore产品高级副总裁Yatharth Gupta说:“帮助我们的客户整合和使用情绪分析等功能,这对于推动实时分析从而帮助他们更好地了解、吸引和服务客户来说,是非常宝贵的。”
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。