当机器人跳舞看起来很奇怪,但分数却是满分的时候
HumanTracker提出了一套包含153小时动作数据的人形机器人追踪评测基准,以及基于人类偏好训练的HumanScore打分模型,弥补了传统关节误差指标无法捕捉接触失败与稳定性问题的缺陷,对齐人类真实判断达90.83...
HumanTracker提出了一套包含153小时动作数据的人形机器人追踪评测基准,以及基于人类偏好训练的HumanScore打分模型,弥补了传统关节误差指标无法捕捉接触失败与稳定性问题的缺陷,对齐人类真实判断达90.83...
Mimir v1是丹麦基金会模型项目训练的10亿参数语言模型,基于HRM层级推理架构,仅用161个许可合规数据集训练,在丹麦语基准测试上超越所有对比模型(含8-9B级别),英语与数学代码表现也逼近4B级主流模型,证明合规...
这篇论文提出双流卷积网络,把视频拆成静态画面和运动光流两条独立处理的通道,分别训练再融合结果,在 2014 年首次让深度学习方法在视频动作识别任务上超越了传统手工特征方法,准确率达到 88.0%,成为后续多年视频理解领域...
本文介绍了PRM-as-a-Judge 1.5工具包,它用过程奖励模型把机器人执行录像转化为进度曲线,新增失败近成功度、回撤恢复比率、成功质量分数三项指标,并通过RoboPulse++测试集验证评估模型可靠性,揭示了VL...
这篇论文提出Second Thought框架,利用AI智能体在执行动作、等待环境反馈时的"空闲窗口"并行生成辅助思考(核查、回想、预演、备选四个维度),在不增加主线程等待时间的前提下降低了智能体的推理轮次和主线程toke...
这篇论文提出MMDiff框架,通过对比基础语言模型与多模态适配后模型的稀疏自编码器,精准定位多模态训练改造的内部特征,并用这些特征实现对空间推理、OCR和多模态安全行为的因果消融与定向增强,在三大模型家族上验证有效。
这篇论文研究了大语言模型预训练中高质量领域数据(代码、数学、维基百科、医学)该重复训练几遍最合适。研究发现,在贴近实际训练方式的固定TPP设置下,最优重复次数会随模型增大而温和增加,且与该领域最终验证损失强负相关,几乎不...
这篇论文发现,用强化学习训练AI做数学题会让它变得不听话,训练它听话又会让它数学变差,问题根源集中在回答开头的选择上,且现有的补救方法都只能部分缓解,无法根治这种此消彼长的效应。
Linkdaze推出专为家庭设计的智能触屏日历,支持同步Google、iCloud、Outlook、Yahoo及Cozi等主流日历服务,通过色彩编码区分家庭成员日程。设备提供15.6英寸和10.1英寸两种规格,除日程管理...
一款名为Ox Alpha的神秘AI模型在OpenRouter平台上线,被定位为面向编程、持续智能体任务和生产工作负载的推理模型。Stripe CEO Patrick Collison对其给予高度评价。该模型以"隐身模型"...
荷兰数据保护局对Uber开出8.25亿欧元(约9.66亿美元)罚单,成为欧盟《通用数据保护条例》实施以来第二大罚款。调查显示,Uber通过自动化流程封禁司机账户,缺乏充分预警和人工审核。Uber方面否认存在未经人工审核的...
特斯拉近日已将太阳能屋顶相关页面从官网下架,该产品正式宣告终结。这款定位高端、外观仿瓦片的光伏产品自推出以来问题不断:安装报价高达20万美元,实际发电量低于承诺值,瓦片因高温出现变形和底层熔化等质量问题。量产目标与现实严...
Outer Biosciences由Michael Polansky(Lady Gaga的伴侣)于2022年联合创立。公司通过与医疗机构合作获取术后废弃的活体人体皮肤,利用自研营养支持系统将其存活时间延长至一个月以上,远...
谷歌正将搜索引擎与AI深度融合,未来体验将更接近AI聊天机器人。若你不喜欢这一趋势,可尝试以下五款免费替代搜索引擎:Brave注重隐私保护并提供AI助手Leo;DuckDuckGo不追踪用户数据并主动屏蔽外部追踪器;Ec...
日本冲绳科学技术大学院大学研究团队发现,通过激活下丘脑Q神经元,可诱导小鼠进入类冬眠状态,使其超过半数突触消失。按照传统记忆存储理论,这应导致大量记忆丧失,但实验表明小鼠记忆完整保留。研究发现,呈空间簇状排列的"记忆突触...
随着谷歌将AI功能深度融入搜索体验,传统搜索方式正在改变。对于不满意谷歌发展方向的用户,目前有五款免费替代搜索引擎可供选择:Brave(拦截追踪器,支持匿名调用谷歌补充结果)、DuckDuckGo(不追踪用户数据,提供V...
AI基础设施投资持续升温,大型科技公司表外承诺规模高达3万亿美元,引发盈利前景担忧。数据中心建设因环境争议成为美国中期选举潜在议题。OpenAI营收增长放缓、亏损扩大,Anthropic有望超越SpaceX创下IPO融资...
一项由Guidelight AI Standards发布的研究显示,OpenAI、Anthropic、Google、Meta和xAI五大AI实验室中,大多数尚未公开发布针对AI模型失控的遏制响应计划。所谓遏制计划,是指当...
OpenAI近日公开表态,支持对加州AI安全法案SB 53进行修订,要求扩大安全保障范围,包括对训练或评估中的前沿模型进行潜在重大事故监控,以及强化模型开发全生命周期的网络安全防护。此前OpenAI曾反对该法案,如今态度...
一项针对305名开发者的调查显示,80%的人认为AI编程工具带来的依赖感已超过其实用价值。43%的开发者在本应停止工作后仍继续使用AI编程,32%因此推迟睡眠。尽管74%的人认为重度使用AI有助于升职加薪,但51%表示更...