给语言模型装一个"纠错外挂",能不伤原有能力吗?
论文提出CRN v2,一个约3400万参数的轻量纠错模块,安装在完全冻结的Gemma 4 E2B之上,通过logits修正结合KL锚定,在纠正53.3%错误的同时实现能力零损耗,对比LoRA基线揭示了纠错与能力保留之间的...
NVIDIA DGX Spark推出64GB版本, 4999美元,让本地AI多一个选择
NVIDIA近日推出DGX Spark 64GB版本,10月23日起通过宏碁、华硕、戴尔、技嘉、惠普、微星等OEM合作伙伴上市,起售价4999美元。
当模型学会了"读心术",我们还需要教它做人吗?
先说说这场比试的起点。 AI安全这件事,拆开来看其实是两码事。一是**控制**,也就是想办法让模型少说坏话,少干坏事;二是**监控**,也就是在模型说话干事的过程中,能不能及时发现"这里不对劲"。 这两件事,...
飞利浦专业声波洁牙科技:电动牙刷“功能内卷”之后,谁还在认真把牙刷干净?
今年9月,某跨界品牌推出可视化电动牙刷,集微距摄像头、AI识别等功能于一体,以新奇功能赚足眼球,也让“电动牙刷到底该关注什么”再度成为行业热议的话题。
苹果的M5 Ultra本地AI真能跑出“4倍提升”?
256GB甚至未来512GB统一内存里,可以放下超大模型、代码、文档和长上下文,再让多个Agent一起工作。这时候,衡量一台本地AI机器的体验,一秒能吐出多少Token,已经只是其中一个数字。
一个模型跑一整天,GPU却在偷偷睡觉:阿里通义团队怎么解决超长智能体训练的浪费问题
阿里通义团队提出QWENGYRE框架,通过弹性调度器和轨迹处理器解决超长horizon智能体强化学习训练中GPU空闲和轨迹冗余两大难题,在旗舰模型上实现显著加速与效果提升。
多模态大模型还需要视觉编码器吗?一份来自腾讯的缩放定律研究
腾讯团队系统对比了编码器无关与编码器based多模态大模型的缩放规律,发现前者在多模态任务上虽起步落后,但损失下降更快,预计在10的22次方FLOPs量级实现反超,且解码器会自发承担起视觉编码功能。
水印能被偷走吗?一场关于图片"隐形签名"的攻防战
这篇论文研究AI图片水印为何会被伪造转移到无关图片上,提出RT指标量化这一风险,发现关键在架构设计而非训练配置,并提出无需重构模型的CoverLock插件,大幅降低伪造成功率同时保持鲁棒性。
AI模型之间悄悄传递的"小纸条",可能什么都没说
论文发现现有模型间潜在通信方法存在"信息使用鸿沟",涨分未必来自真实内容传递。作者提出Draft-KV,通过传递发送方答题草稿的键值状态并渐进式训练,使接收方准确率从37.45%提升至78.04%,且效果确实依赖正确配对...
Wabi从App生成器转型为AI消息助手
AI应用创业公司Wabi发布2.0版本,从应用构建工具转型为AI消息平台,支持用户在对话中按需生成界面,将聊天与生产力任务整合于一处,目前仅限邀请码用户体验。
OpenAI发布Dots智能体,萨姆·奥特曼展示拟人化新助手
OpenAI在Dev Day上发布Dots智能体助手,由GPT-6 Astra驱动,可在后台持续执行用户任务,支持通过Slack、Teams等平台交互。首批面向Pro和Business Premium用户开放,支持从Ch...
OpenAI推出GPT-6.1 Sol,性能接近GPT-6 Astra但成本更低
OpenAI在DevDay活动上推出GPT-6.1 Sol,性能接近GPT-6 Astra,但输入输出Token价格仅为其五分之一。该模型在编程调试、文档理解及多步骤工作流等复杂任务上较GPT-6 Sol有显著提升,并改...
OpenAI为Codex推出可跨设备使用的可复用云端环境
OpenAI在Dev Day上为旗下软件工程智能体Codex推出多项新功能,包括可跨设备访问的持久化云端开发环境、语音指令Codex CLI、新代码审查体验及Codex Security Cloud安全工具集,后者可自动...
运营偏移正成为发电企业的风险隐患
随着AI训练负载推动电力需求激增,电力运营商面临劳动力转型与运维复杂度同步上升的双重压力。文章指出,"操作漂移"(即日常作业逐渐偏离标准流程)是当前的核心风险,建议通过数字化工作流、执行验证和闭环反馈机制,将现场经验系统...














