至顶网软件频道消息:从Facebook的“AI能够发明自己的语言”误报到微软公司令人诧异的种族主义聊天机器人,在过去的几年时间里,我们目睹了几起表现糟糕的人工智能使用案例。尽管了解AI行为的初衷并非一桩易事,但谷歌公司的DeepMind认为其已经为这一难题提供了解决方案,那就是:心理学。
今天,DeepMind宣布其能够用已经发布的Psychlab——一套开源代码AI平台——研究AI的行为表现,而其所采用的研究方式则与目前心理学家研究人类行为表现的方法类似。
由DeepMind实验室构建的Psychlab采用了模拟的3D环境以在不同的空间任务中训练并测试AI,而这些环境在以AI代理作为主要测试对象的同时也允许Psychlab重建真实世界的心理学实验。
DeepMind团队的研究员Joel Leibo在一篇博客中解释称:“一般来讲,这类测试过程会要求参与者坐在电脑显示器前且用鼠标回应屏幕上显示出的任务。类似的,我们所构建的环境允许虚拟主体在虚拟计算机显示器上执行任务,并将其所注视的方向作为其对于测试任务的回应结果。显然,这需要人类与人工智能代理双方都进行相同的测试,从而最大限度地减少实验差异性,而这也促使其能够更容易地与已有的认知心理学文献建立联系并从中获取一定见解。”
DeepMind方面发布了八项通过Psychlab测试人工智能不同认知能力的经典心理学实验。具体包括:
• 视觉搜索——测试其搜寻目标对象阵列的能力(图片)
• 持续识别——测试其对于增长型项目的记忆能力
• 任意的视觉运动映射——测试其对于刺激-响应配对的再次调动能力
• 变更检测——测试其就对象阵列再次出现延迟后,检测一系列变更设置的能力
• 视力与对比敏感度——测试其对微小且低对比度刺激的识别能力
• 玻璃模型检测——测试其球形感知能力
• 随机点运动判别——测试其感知相干运动的能力
• 多对象追踪——测试其长时间追踪动态对象的能力
Leibo表示由于Psychlab拥有一个“灵活且方便运用的API”,所以研究人员能够在该平台上创建并分享他们自己的实验。除此之外,DeepMind还发布了Psychlab的源代码。对此,Leibo解释是因为谷歌公司希望“更多的研究团队能够在其研究中使用Psychlab,而这也有助于该平台的进一步完善。”
好文章,需要你的鼓励
在“PEC 2025 AI创新者大会暨第二届提示工程峰会”上,一场以“AIGC创作新范式——双脑智能时代:心智驱动的生产力变革”为主题的分论坛,成为现场最具张力的对话空间。
人民大学团队开发了Search-o1框架,让AI在推理时能像侦探一样边查资料边思考。系统通过检测不确定性词汇自动触发搜索,并用知识精炼模块从海量资料中提取关键信息无缝融入推理过程。在博士级科学问题测试中,该系统整体准确率达63.6%,在物理和生物领域甚至超越人类专家水平,为AI推理能力带来突破性提升。
Linux Mint团队计划加快发布周期,在未来几个月推出两个新版本。LMDE 7代号"Gigi"基于Debian 13开发,将包含libAdapta库以支持Gtk4应用的主题功能。新版本将停止提供32位版本支持。同时Cinnamon桌面的Wayland支持持续改进,在菜单、状态小程序和键盘输入处理方面表现更佳,有望成为完整支持Wayland的重要桌面环境之一。
Anthropic研究团队开发的REINFORCE++算法通过采用全局优势标准化解决了AI训练中的"过度拟合"问题。该算法摒弃了传统PPO方法中昂贵的价值网络组件,用统一评价标准替代针对单个问题的局部基准,有效避免了"奖励破解"现象。实验显示,REINFORCE++在处理新问题时表现更稳定,特别是在长文本推理和工具集成场景中展现出优异的泛化能力,为开发更实用可靠的AI系统提供了新思路。