至顶网软件频道消息:Facebook Inc.今天发布了一个名为Talk the Walk(路在嘴里)的人工智能数据集,目的是帮助计算机在游览纽约市的过程学习如何与人类更自然地互动。
目前人工智能软件的通信能力相当有限。原因在于,人工神经网络是通过分析样本文本得到统计模式学习语言,这种方法不是特别地有效。
Facebook创建 的Talk the Walk数据集能使人工智能模型以更接近人类的方式学习。Facebook研究人员Douwe Kiela和Jason Weston在博文中提到, “要最终通过人类语言理解建立人工智能,一个策略就是用更自然的方式训练这些系统,将语言与特定环境联系起来。”
他们表示,“和婴儿在看到和触摸到东西开始学会这些东西的名字一样,这种方法有时也叫形象化人工智能,这种在系统环境中进行的方法有利于学习,训练不是通过大型文本数据集(如维基百科)进行。”
研究人员利用Talk the Walk可以将纽约市作为学习环境。Talk the Walk数据集含不同街区的地图、每个块360度图片和样本对话,对话是一个人试图将另一个人引导到某个位置。这些文件附有Facebook研究人员创建的“基准线”用法,可以作为人工智能使用这些信息方法的参考。
据Facebook称,Talk the Walk可以创建逼真的训练场景,机器学习模型可以在这样的场景里打磨他们的语言技能。要进行模拟需要两个人工智能程序。一个是可以看到360度照片的“游客”,而另一个是只有地图的“导游”。基本思想是让两个程序相互通信,在交换了足够的细节后弄清楚如何从一个街区去另一个街区。
这不是一件容易的事。根据The Verge网站介绍,Facebook估计,要利用Talk the Walk数据创建能可靠地生成导航指令的人工智能模型可能需要几年的时间。Facebook希望通过该项目开发的新人工智能功能不仅可用于导航,也可用于其他领域。
Kiela和Weston在博文里称,“我们自己的实验搞清了一些本地化和沟通的次要问题,但我们希望其他人可利用这事更好地理解目标导向的对话、导航、视觉感知和其他挑战。”
好文章,需要你的鼓励
Anthropic发布SCONE-bench智能合约漏洞利用基准测试,评估AI代理发现和利用区块链智能合约缺陷的能力。研究显示Claude Opus 4.5等模型可从漏洞中获得460万美元收益。测试2849个合约仅需3476美元成本,发现两个零日漏洞并创造3694美元利润。研究表明AI代理利用安全漏洞的能力快速提升,每1.3个月翻倍增长,强调需要主动采用AI防御技术应对AI攻击威胁。
NVIDIA联合多所高校开发的SpaceTools系统通过双重交互强化学习方法,让AI学会协调使用多种视觉工具进行复杂空间推理。该系统在空间理解基准测试中达到最先进性能,并在真实机器人操作中实现86%成功率,代表了AI从单一功能向工具协调专家的重要转变,为未来更智能实用的AI助手奠定基础。
Spotify年度总结功能回归,在去年AI播客功能遭遇批评后,今年重新专注于用户数据深度分析。新版本引入近十项新功能,包括首个实时多人互动体验"Wrapped Party",最多可邀请9位好友比较听歌数据。此外还新增热门歌曲播放次数显示、互动歌曲测验、听歌年龄分析和听歌俱乐部等功能,让年度总结更具互动性和个性化体验。
这项研究解决了现代智能机器人面临的"行动不稳定"问题,开发出名为TACO的决策优化系统。该系统让机器人在执行任务前生成多个候选方案,然后通过伪计数估计器选择最可靠的行动,就像为机器人配备智能顾问。实验显示,真实环境中机器人成功率平均提升16%,且系统可即插即用无需重新训练,为机器人智能化发展提供了新思路。