至顶网软件频道消息:从Facebook的“AI能够发明自己的语言”误报到微软公司令人诧异的种族主义聊天机器人,在过去的几年时间里,我们目睹了几起表现糟糕的人工智能使用案例。尽管了解AI行为的初衷并非一桩易事,但谷歌公司的DeepMind认为其已经为这一难题提供了解决方案,那就是:心理学。
今天,DeepMind宣布其能够用已经发布的Psychlab——一套开源代码AI平台——研究AI的行为表现,而其所采用的研究方式则与目前心理学家研究人类行为表现的方法类似。
由DeepMind实验室构建的Psychlab采用了模拟的3D环境以在不同的空间任务中训练并测试AI,而这些环境在以AI代理作为主要测试对象的同时也允许Psychlab重建真实世界的心理学实验。
DeepMind团队的研究员Joel Leibo在一篇博客中解释称:“一般来讲,这类测试过程会要求参与者坐在电脑显示器前且用鼠标回应屏幕上显示出的任务。类似的,我们所构建的环境允许虚拟主体在虚拟计算机显示器上执行任务,并将其所注视的方向作为其对于测试任务的回应结果。显然,这需要人类与人工智能代理双方都进行相同的测试,从而最大限度地减少实验差异性,而这也促使其能够更容易地与已有的认知心理学文献建立联系并从中获取一定见解。”
DeepMind方面发布了八项通过Psychlab测试人工智能不同认知能力的经典心理学实验。具体包括:
• 视觉搜索——测试其搜寻目标对象阵列的能力(图片)
• 持续识别——测试其对于增长型项目的记忆能力
• 任意的视觉运动映射——测试其对于刺激-响应配对的再次调动能力
• 变更检测——测试其就对象阵列再次出现延迟后,检测一系列变更设置的能力
• 视力与对比敏感度——测试其对微小且低对比度刺激的识别能力
• 玻璃模型检测——测试其球形感知能力
• 随机点运动判别——测试其感知相干运动的能力
• 多对象追踪——测试其长时间追踪动态对象的能力
Leibo表示由于Psychlab拥有一个“灵活且方便运用的API”,所以研究人员能够在该平台上创建并分享他们自己的实验。除此之外,DeepMind还发布了Psychlab的源代码。对此,Leibo解释是因为谷歌公司希望“更多的研究团队能够在其研究中使用Psychlab,而这也有助于该平台的进一步完善。”
好文章,需要你的鼓励
还在为渲染一个3D模型等上几小时吗?还在纠结移动办公就得牺牲性能吗?当AI遇上专业工作站,传统设计流程的游戏规则正在被改写。
伊斯法罕大学研究团队通过分析Google Play商店21款AI教育应用的用户评论,发现作业辅导类应用获得超80%正面评价,而语言学习和管理系统类应用表现较差。用户赞赏AI工具的快速响应和个性化指导,但抱怨收费过高、准确性不稳定等问题。研究建议开发者关注自适应个性化,政策制定者建立相关规范,未来发展方向为混合AI-人类模型。
据报道,OpenAI正与亚马逊洽谈至少100亿美元的融资。亚马逊此前已是Anthropic的最大投资者,并为其建设了110亿美元的数据中心园区。若融资达成,OpenAI将采用AWS的Trainium系列AI芯片。Trainium3采用三纳米工艺,配备八核心和32MB SRAM内存。AWS可将数千台服务器连接成拥有百万芯片的集群。报道未透露具体估值,但OpenAI最近一次二次出售估值已达5000亿美元。
这项由伊利诺伊大学香槟分校等四所院校联合完成的研究,提出了名为DaSH的层次化数据选择方法。该方法突破了传统数据选择只关注单个样本的局限,通过建模数据的天然层次结构,实现了更智能高效的数据集选择。在两个公开基准测试中,DaSH相比现有方法提升了高达26.2%的准确率,同时大幅减少了所需的探索步数。