人民大学与蚂蚁集团联手,将AI推理模型扩展到一万亿参数:当大模型开始"自学成才"
人民大学与蚂蚁集团联合将零强化学习扩展至一万亿参数模型Ring-2.5-1T-Zero,无需人工标注数据,模型自发涌现分步推理、自我验证等高级思维策略,数学竞赛成绩媲美顶尖商业模型。
人民大学与蚂蚁集团联合将零强化学习扩展至一万亿参数模型Ring-2.5-1T-Zero,无需人工标注数据,模型自发涌现分步推理、自我验证等高级思维策略,数学竞赛成绩媲美顶尖商业模型。
哈工深团队提出KnowAct-GUIClaw,通过经验记忆与可进化技能库,让AI助手能跨App完成复杂任务,且越用越智能,开源模型性能超越GPT-5.5。
这项研究提出了ShortOPD方法,通过让受损大语言模型在自身生成的内容上实时向原始模型学习,并智能管理生成长度,有效恢复了结构化剪枝后模型的写作能力,训练效率提升约4倍。
7月24日,小艺Claw上线100天之际,推出“新用户首次订阅连续包月享7天免费体验”活动,带来多重专享权益体验,新用户千万别错过
大家知道,通算数据中心机柜采用交流分散架构,服务器搭载内置PSU电源,单机功率从几kW到十几kW很常见,服务器多一点的机柜,20~30kW单机柜功率已经是较高负载场景。
腾讯混元等团队提出Harness Handbook,将代码仓库按运行行为重组为三层地图,配合BGPD导航帮助AI助手精准定位改动位置,规划质量提升同时token消耗下降。
香港科技大学研究团队提出ChartCynics框架,通过双路径侦探式推理让AI同时检查图表视觉结构与数值内容,使8B小模型识别骗人图表的准确率提升近29%,超越顶尖商业大模型。
Oracle联合CultRepo、JetBrains、IBM和Azul出品的纪录片《The Java Story》正式发布,通过对Java创始人James Gosling等核心工程师的采访,回顾了Java从Sun Mic...
Anaconda宣布收购开源编程智能体Kilo。Kilo由GitLab联合创始人Sid Sijbrandij于2025年3月创立,支持接入OpenAI、Anthropic、Google等60余家供应商的500多个模型,月...
东南大学等机构推出SDABench基准测试,从六种科学推理能力评测15个主流大模型,发现AI擅长描述数据却在因果推断和机制解释上严重拉胯。
2026年,住宅代理与AI零日漏洞检测成为网络安全两大主要威胁。住宅代理通过家庭网络IP伪装流量,难以检测和封锁;而AI模型已能快速识别各大平台未知漏洞,仅Firefox一例就涉及271个漏洞。传统封锁手段对这两类威胁均...
NetworkManager 1.58本周正式发布,距上一版本历经五个月开发、407次代码提交。此版本重点涵盖三大方向:一是扩展IPv6-only网络支持,新增RFC 8925自动信令及CLAT客户端转换层,助力IPv4...
施耐德电气对其Charge Pro商用二级电动车充电桩进行了升级,新增NACS接口支持,兼容J1772与NACS两种连接器,最高支持80安培配置。用户无需下载应用,扫描二维码即可开始充电。产品内置EV Connect S...
AMD在旧金山"Advancing AI"大会上发布Helios机架级AI系统,CEO苏姿丰称其为业界"最高性能AI机架",专为大规模训练前沿模型而设计。OpenAI、Meta、微软、Anthropic等头部AI企业均已...
今年WAIC上,大模型依然是绝对主角。但相比去年,今年还有一个变化开始变得越来越明显。越来越多企业,不再讨论"模型有多大",而开始讨论"算力还能不能继续这样堆下去"。GPU、HBM、Chiplet、3D封装、近存计算……
香港中文大学提出MAGIC系统,用一句自然语言描述即可自动生成多场景互联的3D游戏项目,解决跨场景传送门一致性、导航可达性和评估缺失三大难题。
这篇论文提出在代码模型的预训练和智能体后训练之间插入"函数感知填中间"中间训练阶段,利用程序依赖图分析和复杂度-可推断性双标准选择掩码目标,在SWE-Bench系列测试上稳定提升3到5个百分点,同时缓解后训练导致的通用能...