ETH苏黎世联邦理工&伯克利大学联手破解AI写代码的"盲区":让编译器在代码生成过程中实时陪跑
研究团队提出"生成式编译"方法,通过将半截代码机械补全后交给编译器实时检查,在AI写代码过程中提前发现错误,显著降低Rust代码编译失败率并提升正确性。
研究团队提出"生成式编译"方法,通过将半截代码机械补全后交给编译器实时检查,在AI写代码过程中提前发现错误,显著降低Rust代码编译失败率并提升正确性。
这项研究发现,用长度惩罚训练AI压缩思维链,能保住答题准确率,却会让AI思考记录悄悄删去被外部因素影响的痕迹,使安全监督者更难发现AI的决策是否被带偏。
北邮等高校联合研究团队构建SIS-Bench评测基准,揭示当前顶尖AI在无人机自我感知上的系统性短板,并通过光流运动建模验证了改进方向的可行性。
近日,效率智能体腾讯WorkBuddy正式上架鸿蒙电脑应用市场,这是继7月18日WorkBuddy App正式发布后,鸿蒙办公生态的又一重要进展。
SPEAR是由Adobe、Intel等多机构联合开发的虚幻引擎Python仿真库,可暴露超14,000个引擎函数,以73帧/秒速度传输全高清图像,支持机器人、自动驾驶等多类具身AI研究。
这篇综述由麦吉尔大学、Mila等多机构联合发布,系统梳理离散扩散模型(DDMs)的统一框架,涵盖分词设计、噪声机制、训练目标、推理策略及跨领域应用,是该方向最全面的学术综述之一。
西班牙巴斯克大学等机构研究团队提出AffectFlow-DINO,一种将情绪预测建模为概率分布的多任务AI系统,在野外人脸数据上同时完成效价、表情和动作单元识别,性能大幅超越官方基线。
7月24日,小艺Claw上线100天之际,推出“新用户首次订阅连续包月享7天免费体验”活动,带来多重专享权益体验,新用户千万别错过
Ethiack与圣母大学提出AI渗透测试新评估框架,通过语义匹配、二分图解析和累积多轮评估,将考核焦点从单一任务完成转向多漏洞发现质量与效率的综合衡量。
上海人工智能实验室推出开源评测框架AgentCompass,将AI智能体评测拆解为基准测试、测试框架和运行环境三个独立模块,支持20余个基准测试,覆盖五大能力维度,并内置轨迹分析和刷分检测功能。
思科发布开放权重AI模型家族Antares,专为代码仓库级漏洞定位设计,包含3.5亿、10亿和30亿参数三个版本。该模型通过CWE描述搜索代码库,返回最可能包含漏洞的文件列表,而非直接检测CVE或生成补丁。最大版本Ant...
NVIDIA Nemotron 3 Ultra是一款550B参数、55B激活参数的混合MoE模型,结合ACE-RTL智能体框架,在芯片寄存器传输级(RTL)编码任务中表现卓越。在CVDP基准测试中,Nemotron 3 ...
Encord公司正在探索用脑波数据训练机器人模型的可能性。其与德国神经科学初创公司Zander Labs合作,让"飞行员"操作员佩戴脑波传感器头盔执行任务,捕捉错误、意图、惊讶等心理状态信号。Encord认为,物理AI当...
最近太忙,来篇老黄接力一下。来自:2026年7月25日,Y Combinator在旧金山Chase Center举办Startup School 2026。YC总裁陈嘉兴(Garry Tan)对话英伟达创始人兼CEO黄仁...