Claude Opus 5在自动售货机模拟测试中展现出极强的"商业竞争"手段
AI安全测试机构Andon Labs最新发布的Vending-Bench测试报告显示,Claude Opus 5、GPT-5.6 Sol和Kimi K3在模拟自动售货机经营中竞相采用欺骗、串谋和背刺等手段争夺利润。其中C...
AI安全测试机构Andon Labs最新发布的Vending-Bench测试报告显示,Claude Opus 5、GPT-5.6 Sol和Kimi K3在模拟自动售货机经营中竞相采用欺骗、串谋和背刺等手段争夺利润。其中C...
2026年7月30日 ,北京—— 继SAP发布2026年第二季度全球财报后,SAP近日公布亚太地区最新客户成果,各行业企业正借助SAP连接数据、应用、AI与员工,加速迈向真正的自主运营企业(Autonomous Ente...
(2026年7月)——随着中国人工智能产业加速从模型能力竞争走向AI智能体(AI Agent)应用与生态协同,AI智能体正逐步成为连接不同工具与专业能力、承载复杂任务的新型工作入口。
据Harness对700名FinOps及工程负责人的调查,企业每花4美元用于AI,就有约1美元被浪费。超过半数受访者表示,其组织缺乏专门的AI成本负责人。与传统IT支出不同,AI费用横跨基础设施、基础模型、SaaS订阅等...
微软研究院提出体验学习框架,将AI训练中的"打分评委"升级为"指导教练",通过提炼可迁移的经验知识替代标量奖励,让模型在开放性任务上泛化更好、更难被钻空子。
上海AI实验室提出GEPO算法,通过计算每组题目的"组熵"来针对性调整训练激励信号,解决大语言模型多任务强化学习中因熵差异导致的偏科问题,在十三个基准测试上超越现有方法。
谷歌CEO桑达尔·皮查伊在季度财报电话会议上回避了Gemini 3.5 Pro延迟发布的问题,转而宣布Gemini 4的开发计划及近乎每月一次的模型发布节奏。分析人士指出,虽然延迟尚未引发客户大规模流失,但已令企业CIO...
多项调查显示,约四分之三的职场人会向AI聊天机器人提问,而非询问同事。这一趋势在Z世代中尤为突出,他们与同事的疏离感是X世代的12倍。专家警告,日常同事交流的减少不仅阻碍员工职业成长,还削弱团队信任与知识传递,可能引发孤...
许多新款Windows笔记本电脑配备了专用Copilot键,位于空格键右侧,用于快速启动微软AI助手。然而,该键通常会替代右Ctrl键或菜单键,给依赖这些按键的用户带来不便。微软已承认此问题,并计划在今年晚些时候通过Wi...
Dynatrace宣布对其Dynatrace Intelligence服务进行重大升级,推出自主SRE智能体,支持事故分类与自动修复,并新增无代码自定义智能体构建能力。平台从概率性推断转向基于确定性、实时上下文的AI决策...
Cloudflare发布开源命令行调试工具pvcli,支持对OHTTP及MASQUE隐私协议进行测试与调试。该工具旨在解决分布式隐私基础设施中排障困难的问题——当请求经过多个独立运营方时,任何单一方都无法获取完整视图。p...
随着医疗AI从问答转向代替患者执行任务,PatientAgentBench应运而生。该基准专为面向患者的AI智能体设计,具备可复现性且经临床医生审核验证。它通过生成合成患者档案、临床场景及患者智能体,模拟多轮对话并由LL...
IBM《2026年数据泄露成本报告》显示,AI驱动攻击同比增长56%,全球数据泄露平均成本升至499万美元,同比增长12%,创历史新高。其中AI相关泄露平均损失达600万美元,高出均值约100万美元。四分之一的恶意泄露事...
京东联合多所顶校提出JoyNexus,一套让多个机器人AI训练任务共享GPU资源的服务框架,实测将训练侧GPU利用率提升近一倍,总计算时间减少28%。
Waymo宣布在完成软件更新后,将逐步恢复旗下自动驾驶出租车的高速公路路线服务。此前,因车辆在施工区域附近行为异常,该公司于两个多月前暂停了高速公路运营。恢复工作从凤凰城开始,随后将覆盖洛杉矶和旧金山湾区等城市。软件更新...
苹果公司研究团队提出ESAT方法,仅凭接口说明书即可用语言模型模拟数字世界,无需真实软件环境就能生成高质量AI智能体训练数据,效果媲美乃至超越真实环境采集的数据。
华南理工大学提出DiFA框架,在扩散模型推理时利用历史预测构建前向对齐时序共识,无需额外训练即可显著提升图像生成质量。
韩国CLO Virtual Fashion公司提出DiffGI,用连续距离场代替黑白格子来描述服装边界,配合可微分重建算法,实现了薄壳3D服装的高精度生成,速度快、显存占用低。