谷歌研究人员创建了号称是“学习一切的模型”,可利用多种类型的训练数据在不同的任务里训练人工智能(AI)模型。
谷歌希望旗下的Tensor2Tensor程序库可以加速深度学习的研究
谷歌研究人员和以AI为重点的谷歌大脑团队(Google Brain Team)打造的新Tensor2Tensor程序库里还包括其他工具及模块化组件,简单来说其就是一个程序库包,他们希望该程序库包可以加速深度学习的研究。
另外,该谷歌框架可望减少环境定制的一些工作,令深度学习模型可以处理各种任务。
谷歌研究人员在一篇文章里称此为“学习一切的模型”,到目前为止,尽管深度学习在语音识别、图像分类和翻译方面取得了成功,但每个模型都需针对特定的任务进行微调。
而且,各种模型通常是针对来自相同“域”的任务进行训练的,例如,一种翻译任务的训练用的是其他翻译任务。
这些因素凑在一起将减缓了深度学习的研究,并且也没有遵循人类大脑的工作原理,人类大脑能够从一个挑战中学会一些东西,并将其应用于解决新的任务。
而谷歌创建的模型是针对各种任务训练的,包括图像识别、翻译任务、图像字幕和语音识别等。
谷歌研究人员称该单一模型可以同时从多个领域学习许多的任务,而且该模型还能够传递知识。该模型能够从拥有大量训练数据的任务里学习,并将学习到知识应用到一些数据有限的任务。
Tensor2Tensor程序库由谷歌大脑团队的研究人员和工程师维护,该程序库提供了一套用于训练TensorFlow深入学习模型的开源工具。据Tensor2Tensor的GitHub网页(https://github.com/tensorflow/tensor2tensor)介绍,Tensor2Tensor库“的目标是最大限度地提高想法带宽并最大限度地减少执行延迟”。
谷歌大脑团队高级研究科学家及文章的主要作者Lukasz Kaiser做了如下解释,“Tensor2Tensor库有助于为各种机器学习应用程序创建最先进的模型,例如翻译、解析、图像字幕等等,有了Tensor2Tensor,就能快速探索各种想法。”
另外,Tensor2Tensor库还包括一个从谷歌大脑研究人员最近发表的论文里获取的数据集和模型库。
Kaiser日前还发布了用于机器翻译的BLEU基准测试结果,结果表明,Tensor2Tensor的最佳模式可提供业内最佳结果,而用的GPU数量更少,用的时间比过去未使用Tensor2Tensor的模型少很多。
Kaiser 表示,“用了Tensor2Tensor,就可以在一天内使用单个GPU得到业内最佳结果,这一点很了不起。”
Tensor2Tensor库还包括相关的数据集、模型架构、优化器、学习速率衰减方案、超参数等等,并包含这些组件之间的标准接口。
好文章,需要你的鼓励
Docker公司通过增强的compose框架和新基础设施工具,将自己定位为AI智能体开发的核心编排平台。该平台在compose规范中新增"models"元素,允许开发者在同一YAML文件中定义AI智能体、大语言模型和工具。支持LangGraph、CrewAI等多个AI框架,提供Docker Offload服务访问NVIDIA L4 GPU,并与谷歌云、微软Azure建立合作。通过MCP网关提供企业级安全隔离,解决了企业AI项目从概念验证到生产部署的断层问题。
中科院联合字节跳动开发全新AI评测基准TreeBench,揭示当前最先进模型在复杂视觉推理上的重大缺陷。即使OpenAI o3也仅获得54.87%分数。研究团队同时提出TreeVGR训练方法,通过要求AI同时给出答案和精确定位,实现真正可追溯的视觉推理,为构建更透明可信的AI系统开辟新路径。
马斯克的AI女友"Ani"引爆全球,腾讯RLVER框架突破情感理解边界:AI下半场竞争核心已转向对人性的精准把握。当技术学会共情,虚拟陪伴不再停留于脚本应答,而是通过"心与心的循环"真正理解人类孤独——这背后是强化学习算法与思考模式的化学反应,让AI从解决问题转向拥抱情感。
PyVision是上海AI实验室开发的革命性视觉推理框架,让AI系统能够根据具体问题动态创造Python工具,而非依赖预设工具集。通过多轮交互机制,PyVision在多项基准测试中实现显著性能提升,其中在符号视觉任务上提升达31.1%。该框架展现了从"工具使用者"到"工具创造者"的AI能力跃迁,为通用人工智能的发展开辟了新路径。