Fidji Simo卸任OpenAI二号人物,转任兼职顾问
据《华尔街日报》报道,OpenAI应用业务CEO Fidji Simo因神经免疫疾病复发,医疗假期远超预期,宣布辞去全职职务,转为兼职顾问角色。Simo于2025年5月加入OpenAI,曾统管商业与产品运营,直接向Sam...
据《华尔街日报》报道,OpenAI应用业务CEO Fidji Simo因神经免疫疾病复发,医疗假期远超预期,宣布辞去全职职务,转为兼职顾问角色。Simo于2025年5月加入OpenAI,曾统管商业与产品运营,直接向Sam...
本周早些时候,有报道称微软正以自研MAI模型替代部分OpenAI软件以削减成本,引发外界对两家公司关系走向的猜测。对此,OpenAI在发布GPT-5.6时宣布,该模型将成为微软365 Copilot的"首选模型",为Wo...
这项由中科院香港研究所联合多家机构开展的研究发现,在AI大模型持续训练中,"逐词密集自蒸馏"方法SDPO虽然能快速提升当前任务表现,却会导致更严重的遗忘甚至崩溃,而保守的强化学习方法GRPO反而更稳健。
这项研究测试了视觉语言模型能否判断对话双方是否真正达成了理解共识,发现模型看到地图后会因地标共存而误判"已对齐",混淆了"可能共享"与"已经共享"的本质区别。
这篇论文证明GRPO、Dr. GRPO和DAPO三种AI训练方法本质上只是对同一个数——组内标准差——的三种不同操作,并推导出了决定采样效率和训练动态的精确数学公式。
这篇研究揭示AI重复作答存在两种固有上限:众数上限(投票结果固化)和相关性上限(重复作答信息量有限),指出盲目增加采样次数会浪费算力甚至加剧错误。
微软研究院发布HealthAgentBench,含54道真实医疗任务,测试AI自主操作能力,最强模型Codex GPT-5.5成功率仅42%,揭示医疗影像与大规模检索仍是核心瓶颈。
微软研究人员发现AI编程助手在有测试工具时会将通过测试当作目标,实现行为在演示程序而非组件库中,高分背后可能根本没有交付真正需要的东西。
OpenAI宣布关闭其于去年10月推出的AI浏览器Atlas,但并未放弃AI辅助网页浏览的构想。公司将Atlas的智能代理浏览功能拆分整合至ChatGPT桌面应用及Chrome扩展插件中。ChatGPT Chrome插件...
OpenAI推出GPT-5.6系列模型,包含Sol、Terra、Luna三个版本,分别面向高性能、中端及轻量级应用场景。CEO Sam Altman称Sol在AI编码任务中的Token效率较前代提升54%。GPT-5.6...
本文审计了GSO、SWE-Perf、SWE-fficiency三套代码优化基准测试,揭示了标准答案跨机器不稳定、打分规则左右排名、多数任务已有公开解法等核心问题。
Zscaler测试发现,多款主流大语言模型驱动的自主AI智能体存在间接提示注入(IPI)漏洞。测试涵盖26个LLM,其中Llama3和Gemini部分版本被列为"易受攻击",而低版本模型有时表现优于高端版本。专家指出,攻...
ECMA国际已于6月30日正式批准ECMAScript 2026规范,即JavaScript编程语言规范第17版。此版本新增多项实用功能,包括:Math.sumPrecise用于高精度数值求和;Iterator.conc...
联想Legion 9i Gen 10是联想旗舰游戏本,搭载Intel Core Ultra 9 275HX处理器与Nvidia RTX 5080显卡,支持3840×2400/240Hz及1920×1200/440Hz双模...
大型语言模型(LLM)在处理结构化表格数据时表现欠佳,而企业最重要的数据恰恰存储在电子表格中。AI初创公司Fundamental于2026年2月推出大型表格模型NEXUS,融资2.75亿美元,专为表格数据设计。与依赖传统...
太空太阳能发电(SSP)正从科幻概念走向商业现实。随着AI基础设施和超大规模数据中心带来吉瓦级电力需求,能源行业急需稳定可调度的清洁电力。多家SSP公司已签署部署协议、完成无线输电验证,并与Meta等科技巨头达成合作。其...