至顶网软件频道消息:从Facebook的“AI能够发明自己的语言”误报到微软公司令人诧异的种族主义聊天机器人,在过去的几年时间里,我们目睹了几起表现糟糕的人工智能使用案例。尽管了解AI行为的初衷并非一桩易事,但谷歌公司的DeepMind认为其已经为这一难题提供了解决方案,那就是:心理学。
今天,DeepMind宣布其能够用已经发布的Psychlab——一套开源代码AI平台——研究AI的行为表现,而其所采用的研究方式则与目前心理学家研究人类行为表现的方法类似。
由DeepMind实验室构建的Psychlab采用了模拟的3D环境以在不同的空间任务中训练并测试AI,而这些环境在以AI代理作为主要测试对象的同时也允许Psychlab重建真实世界的心理学实验。
DeepMind团队的研究员Joel Leibo在一篇博客中解释称:“一般来讲,这类测试过程会要求参与者坐在电脑显示器前且用鼠标回应屏幕上显示出的任务。类似的,我们所构建的环境允许虚拟主体在虚拟计算机显示器上执行任务,并将其所注视的方向作为其对于测试任务的回应结果。显然,这需要人类与人工智能代理双方都进行相同的测试,从而最大限度地减少实验差异性,而这也促使其能够更容易地与已有的认知心理学文献建立联系并从中获取一定见解。”
DeepMind方面发布了八项通过Psychlab测试人工智能不同认知能力的经典心理学实验。具体包括:
• 视觉搜索——测试其搜寻目标对象阵列的能力(图片)
• 持续识别——测试其对于增长型项目的记忆能力
• 任意的视觉运动映射——测试其对于刺激-响应配对的再次调动能力
• 变更检测——测试其就对象阵列再次出现延迟后,检测一系列变更设置的能力
• 视力与对比敏感度——测试其对微小且低对比度刺激的识别能力
• 玻璃模型检测——测试其球形感知能力
• 随机点运动判别——测试其感知相干运动的能力
• 多对象追踪——测试其长时间追踪动态对象的能力
Leibo表示由于Psychlab拥有一个“灵活且方便运用的API”,所以研究人员能够在该平台上创建并分享他们自己的实验。除此之外,DeepMind还发布了Psychlab的源代码。对此,Leibo解释是因为谷歌公司希望“更多的研究团队能够在其研究中使用Psychlab,而这也有助于该平台的进一步完善。”
好文章,需要你的鼓励
IBM Spyre加速器将于本月晚些时候正式推出,为z17大型机、LinuxONE 5和Power11系统等企业级硬件的AI能力提供显著提升。该加速器基于定制芯片的PCIe卡,配备32个独立加速器核心,专为处理AI工作负载需求而设计。系统最多可配置48张Spyre卡,支持多模型AI处理,包括生成式AI和大语言模型,主要应用于金融交易欺诈检测等关键业务场景。
加拿大女王大学研究团队首次对开源AI生态系统进行端到端许可证合规审计,发现35.5%的AI模型在集成到应用时存在许可证违规。他们开发的LicenseRec系统能自动检测冲突并修复86.4%的违规问题,揭示了AI供应链中系统性的"许可证漂移"现象及其法律风险。
意大利初创公司Ganiga开发了AI驱动的智能垃圾分拣机器人Hoooly,能自动识别并分类垃圾和可回收物。该公司产品包括机器人垃圾桶、智能盖子和废物追踪软件,旨在解决全球塑料回收率不足10%的问题。2024年公司收入50万美元,已向谷歌和多个机场销售超120台设备,计划融资300万美元并拓展美国市场。
这项由剑桥大学、清华大学和伊利诺伊大学合作的研究首次将扩散大语言模型引入语音识别领域,开发出Whisper-LLaDA系统。该系统具备双向理解能力,能够同时考虑语音的前后文信息,在LibriSpeech数据集上实现了12.3%的错误率相对改进,同时在大多数配置下提供了更快的推理速度,为语音识别技术开辟了新的发展方向。