微软用3.8B小模型打败6B大模型?Lens如何用"以小博大"重新定义AI图像生成效率
微软发布3.8B参数文字转图像模型Lens,通过密集图文描述、多分辨率训练及精选架构,训练算力仅为同类6B模型的19.3%,多项基准测试得分超越更大规模竞品。
微软发布3.8B参数文字转图像模型Lens,通过密集图文描述、多分辨率训练及精选架构,训练算力仅为同类6B模型的19.3%,多项基准测试得分超越更大规模竞品。
Spotify正在为移动应用推出重要更新,安卓版本将支持播放列表文件夹功能,并新增"重新随机播放"队列功能。用户现在可以通过"+"菜单在移动端创建和管理文件夹来整理播放列表和专辑。此外,播放列表和队列支持批量选择曲目进行...
Anthropic今日发布Claude Opus 4.8,重点提升智能体能力。新版本在多项基准测试中表现改进,尤其在智能体任务方面。新增功能包括用户可控的任务投入力度、动态工作流以应对大规模问题,以及快速模式成本降低至原...
电动汽车充电公司Voltera和Revel宣布合并,将打造美国最大的快充平台之一,专注服务车队、网约车司机和自动驾驶出租车。合并后公司将使用Voltera名称,由现任Revel首席执行官Frank Reig领导。合并业务...
半导体公司Cerebras联合创始人Jean-Philippe Fricker表示,打造盘子大小的硅晶圆芯片需要创始团队每个成员的巨大信心。该公司最近完成55.5亿美元IPO,创下年度最大规模。他强调,要打破传统半导体智...
影子IT指员工未经IT部门批准而使用的工具和服务。调查显示57%的中小企业存在此现象。这类工具可能绕过安全审查,导致数据泄露、访问失控和合规风险。企业可通过发现梳理、策略管控和企业浏览器等手段,在不阻碍工作效率的前提下,...
IBM与旗下红帽公司宣布启动"Project Lightwell"开源安全计划,承诺投入50亿美元,并调派逾2万名工程师参与。该项目将利用AI技术扫描开源项目中的漏洞,为企业使用的特定版本开源组件开发并回移补丁,使企业无...
成均馆大学与延世大学联合构建VGenST-Bench,用AI生成视频主动制造测试场景,系统评估15个顶尖大模型的时空推理能力,发现模型在高阶推理上表现远落后于人类。
论文揭示当前主流视觉语言模型存在"功能性失明",提出模态翻译协议与三项新指标,系统量化AI视觉理解的真实能力缺口。
就在YouTube关闭Clips功能数周后,Spotify推出了全新的"播客片段"分享功能。用户可通过分享按钮选择分享完整剧集、特定章节或自定义时间段的片段,分享后该片段将自动保存至个人资料库,方便日后再次访问。此功能面...
密歇根州立大学等机构提出Pion优化器,通过将NS迭代改造为高通滤波器,解决Muon在VLA机器人训练和RLVR强化学习中因均匀谱白化导致的噪声放大问题,计算成本不变但效果显著提升。
Geo-Align是首个将强化学习引入相机控制视频重渲染的框架,通过度量几何奖励机制和真实+合成数据混合策略,在无需配对多视角数据的情况下显著提升了AI换镜头视频的轨迹精度与画面质量。
牛津、斯坦福等机构发布CUSP基准,测试AI预测科学进展的能力,发现当前顶级模型在可行性判断上接近随机猜测,时间预测系统性滞后,且知识增加无法弥合预测鸿沟。
这篇论文提出了Live Music Diffusion Models(LMDMs),通过路由机制与注意力遮罩让音频扩散模型支持KV缓存,并设计ARC-Forcing后训练方案抑制误差累积,实现在消费级设备上的低延迟实时交...
据希腊科技媒体Techmaniacs报道,三星计划于6月对多款Galaxy设备进行提价,涉及整个Galaxy S系列(预计包括Galaxy S26)、Fold 7、Flip 7及FE机型。涨幅预计在100至200欧元之间...
剑桥大学等联合团队提出SAM 3D Animal,首个可交互多动物三维重建框架,支持关键点和遮罩提示,同时发布Herd3D多动物三维数据集。
首尔国立大学与三星电子联合提出Rule2DRC基准和SplitTester方法,将芯片设计规则的自然语言描述自动转换为可执行验证脚本,并用执行结果而非代码相似度进行评估。
亚马逊近日推出多项苹果产品优惠:16GB和24GB版M5 MacBook Air均降价199美元,其中24GB/1TB配置降至1299.99美元,创历史新低;AirPods 4降至99美元,接近75折;Apple Mag...
韩国科学技术院提出HINT-SD框架,通过分析完整失败轨迹精准定位关键失误步骤,仅对这些步骤施加纠正训练,在提升AI智能体任务完成率的同时将训练速度提高2.26倍。
SkillOpt是微软等机构联合提出的一种文本空间技能优化方法,通过验证门控和有界编辑让AI代理的技能手册越用越好,无需修改模型权重,52个测试场景全部最优。