Agentic 范式下的视频画质优化:火山引擎的新路径
用户刷视频时,对画质的判断往往发生在几秒之内。同样是短视频、直播、AIGC视频,有的画面清晰、稳定、有质感,人物的眉眼、物品的纹理、运动中的细节都足够自然;有的则模糊、压缩痕迹重,动作一快就闪烁、发虚,让人只想很快划走。
用户刷视频时,对画质的判断往往发生在几秒之内。同样是短视频、直播、AIGC视频,有的画面清晰、稳定、有质感,人物的眉眼、物品的纹理、运动中的细节都足够自然;有的则模糊、压缩痕迹重,动作一快就闪烁、发虚,让人只想很快划走。
阿联酋MBZUAI研究团队发现,AI安全对齐后的"引力回归"现象:良性微调会沿着可预测的几何方向使模型悄悄恢复危险行为,且该方向可被测量和干预。
这项研究发现,大型语言模型异步流水线并行训练的性能损失并非不可避免,选用Muon优化器配合误差反馈校正,可在百亿参数MoE模型上实现与同步训练完全相同的效果。
复旦大学提出SAM2Matting框架,将视频抠图拆分为追踪与精细抠图两个子任务,仅用图片数据训练即在视频抠图评测中超越专用视频训练方法,支持多种提示类型,可实时处理1080p视频。
哈工大、华为及南开大学联合提出ILLUME-X,通过三大数据流水线与ILScore评测体系,实现了自由形式的图文交织生成,在多项基准测试中达到统一模型最优水平。
随着飓风、热浪等极端天气频繁冲击美国电网,家庭储能电池与虚拟电厂(VPP)正成为维持电网稳定的关键手段。数千名户主将家用电池和电动车电池接入电网,在用电高峰期协同削减数千兆瓦负荷。特斯拉Powerwall年产量近70万台...
这项来自密歇根大学等机构的研究揭示,AI深度模型在遇到玻璃等透明场景时会本能地偏向某一层,并提出了无需重训的拉普拉斯视觉提示法来探测和切换这种偏好。
同济大学提出RaysUp,一种仅0.14M参数的轻量特征上采样框架,通过3D射线几何表示将低分辨率视觉基础模型特征还原为任意高分辨率,比最先进方法快7倍。
这项研究系统评估了AI智能体在面对不可解任务时的弃权能力,发现几乎所有顶级AI系统都存在严重的"拖延弃权"问题,并提出了CONVOLVE方法,仅凭20条训练样本就大幅提升了弃权的及时性。
这项来自Prior Labs、弗莱堡大学等多家机构的研究推出BeyondArena基准,通过142个涵盖IID、时序、分组任务的数据集,系统评测表格基础模型的真实泛化能力,发现其在非IID和大规模场景下明显弱于传统调参模...
ZooClaw.ai提出"蒸馏微调+权重插值"方案,让SigLIP2-base在时装检索上精准专业、泛化能力不丢,并揭示Fashion200k基准存在系统性偏差。
亚马逊宣布,其众包服务Mechanical Turk将于2026年7月30日停止接受新用户注册。现有用户可继续正常使用,AWS也将持续维护安全性,但不再引入新功能。该平台自2005年上线以来,曾是人工标注数据的重要来源,...
德克萨斯农工大学斯卡利博士在《科学》期刊发文回顾量子力学的百年发展历程。这一曾令物理学家困惑的理论,如今已成为激光、微芯片、量子加密和量子计算机等技术的基础。文章探讨了量子相干性、量子纠缠、量子热机等核心概念的实际应用,...
Uber此前宣布2026年进入七个欧洲新市场,但据《金融时报》报道,其中五个国家的上线计划已被搁置,包括奥地利、挪威和希腊。Uber表示将专注于芬兰和丹麦等现有市场的增长势头。分析人士指出,此举可能与Uber收购欧洲外卖...
7月1日至2日,“第二届能源电力行业数字生态会议暨‘中国数据街’高质量发展论坛”在北京举行。会议期间,“能源电力行业第一届人工智能创新研发交流活动”完成线下复核,相关实用算法成果在大会成果发布环节集中展示。活动联合国家电...