至顶网软件频道消息: DeepMind技术公司已经开发出多种人工智能方案,其不仅击败了全球最顶尖的围棋选手,同时亦在数十种传统视频游戏当中创下新纪录。如今,这家由谷歌持有的技术厂商开始着眼于更为复杂的发展方向:指导AI如何行走。

DeepMind公司这一项目的建立思路并非创建一套步行AI,而是立足于动作模拟为机器学习技术开发新的测试工具。根据DeepMind研究团队发表的博文,项目的最终目标在于打造出"灵活自然的动作行为,确保其具有复用能力并适应任务解决过程中的各类需求。"
围棋等项目虽然本身相当复杂,但却具有明确的目标,因此对人工智能方案而言相对易于处理; 在另一方面,DeepMind团队解释称,教导AI如何完成跳跃或者反向翻转等身体动作则要困难得多。该团队指出,"在为人工系统进行运动技能传授时,对复杂行动的准确描述通常是其中最为困难的部分。"
DeepMind公司今天发布了三份研究论文,具体探讨了其用于教导AI处理运动任务的实际方法。其中第一篇论述了如何通过给予"前进"这样一项简单目标帮助AI学习如何超过障碍。其中一部分AI代理采用与人类相似的双足运动模式,但也有一部分模拟简单的四足动物运动模式。
DeepMind团队表示,"具体来讲,我们训练出多种模拟代理方案,以便在不同的地形之上加以改进,保证其能够根据实际情况进行跳跃、转变与蹲伏。结果显示,我们的代理能够在无需接收具体指令的前提下发展出复杂的技能组合。我们利用这种方法训练自己的多部位模拟肢体系统。"
在另一篇论文当中,DeepMind公司则展示了一套可通过观看运动捕捉数据学习人类行动的AI方案。这套AI模型能够完成"与人类非常相近"的运动效果,且已经学会如何完成多种不同的行动类型--具体包括跌倒后起身以及走上楼梯。
而在最后一篇论文中,DeepMind研究团队则拿出一套能够观察多种不同动作并预测身体在两个动作间过渡变化的AI方案。举例来说,该AI能够观察站立的人与屈体的人,并预测肢体在两个动作间过渡时的具体变化(如文首图所示)。
DeepMind公司所展示的每套AI代理方案都仅能模拟相对简单的动作,但其出现确实证明了研究人员正致力于将AI由简单纯粹的数据世界推向更加复杂且多样的现实世界。DeepMind研究团队在其论文中提及的部分技术最终可用于构建更为复杂的AI代理,且确保相关方案无需任何手动调整。
DeepMind研究团队指出,其未来的工作将主要集中在指导以上方案"在更为复杂的情况下协调更为广泛的动作范围"。换句话来说,AI方案将由行走到奔跑逐步完成学习与改进。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。