在迎来其 50 周年之际,Microsoft 一次性为 Copilot 更新了大量新功能,使其更加接近 ChatGPT 或 Claude 等竞品。这款使用多个 OpenAI 模型的 AI 助手现在支持记忆功能、个性化定制、网络操作、播客创作、相机和屏幕分析、深度研究等更多功能。
通过记忆功能,Copilot 现在能够追踪用户的偏好、兴趣和生日等个人信息,并利用这些信息来定制回答、建议或主动提供建议。Microsoft 表示,用户可以选择让 Copilot 记住哪些信息,也可以完全选择退出。
这是使 Copilot 更个性化的持续努力的一部分。Microsoft 表示公司"正处于这一思路的早期阶段",但"很快"用户就能够为 Copilot 定制个性化外观——是的,这包括带回 Clippy 的选项。
Microsoft AI 首席执行官 Mustafa Suleyman 表示:"Copilot 不仅仅是一个 AI,它是属于你的。每个 Copilot 都将拥有独特的风格和属性组合,完全适合每个人的需求。"
除了个性化之外,Copilot 变得更加强大。新的操作功能赋予了 AI 使用网络浏览器执行任务的能力,类似于 OpenAI 的 Operator agent 或 Amazon 最近发布的 Nova Act 模型。Microsoft 表示,它可以用于订购演出票、预订餐厅和购物,特别是当与新的购物功能结合使用时,Copilot 可以研究产品并寻找折扣和促销信息。
Copilot Vision 于 2024 年 12 月开始在网页工具中推出,现在扩展到 Windows 和移动应用程序。在 Windows 上,Copilot 能够"看到"其他应用程序和文件中的屏幕内容,以回答问题或与文件和内容进行交互,而在 iOS 和 Android 上,它可以讨论手机相机可见的任何内容或相机胶卷中的照片。
深度研究功能允许 Copilot 分析大量文档或在线资源用于复杂项目,其研究能力正被整合到 Bing 中,以在搜索引擎中提供 AI 驱动的响应。与其他 AI 工具一样,Copilot 现在也可以使用其研究成果生成播客风格的音频来解释主题,而新的 Pages 功能允许它将跨文档的笔记和研究整理到单一画布中。
Microsoft 表示,许多新功能从今天开始以"初始版本"推出,并将在"未来几周和几个月内"改进,具体可用性因功能、平台和市场而异。这些功能都不是首创——ChatGPT 去年就添加了记忆功能,Google Gemini 有视觉模式,而且每个 AI 公司都想打造个性化 AI 代理——但一次性添加所有这些功能表明 Microsoft 致力于跟上竞争步伐,更不用说充分利用其在 OpenAI 的投资。
更新(4 月 4 日):确认 Clippy 将作为 Copilot 个性化选项。
好文章,需要你的鼓励
谷歌发布新的AI学术搜索工具Scholar Labs,旨在回答详细研究问题。该工具使用AI识别查询中的主要话题和关系,目前仅对部分登录用户开放。与传统学术搜索不同,Scholar Labs不依赖引用次数或期刊影响因子等传统指标来筛选研究质量,而是通过分析文档全文、发表位置、作者信息及引用频次来排序。科学界对这种忽略传统质量评估方式的新方法持谨慎态度,认为研究者仍需保持对文献质量的最终判断权。
武汉大学研究团队提出DITING网络小说翻译评估框架,首次系统评估大型语言模型在网络小说翻译方面的表现。该研究构建了六维评估体系和AgentEval多智能体评估方法,发现中国训练的模型在文化理解方面具有优势,DeepSeek-V3表现最佳。研究揭示了AI翻译在文化适应和创意表达方面的挑战,为未来发展指明方向。
Meta发布第三代SAM(分割一切模型)系列AI模型,专注于视觉智能而非语言处理。该模型擅长物体检测,能够精确识别图像和视频中的特定对象。SAM 3在海量图像视频数据集上训练,可通过点击或文本描述准确标识目标物体。Meta将其应用于Instagram编辑工具和Facebook市场功能改进。在野生动物保护方面,SAM 3与保护组织合作分析超万台摄像头捕获的动物视频,成功识别百余种物种,为生态研究提供重要技术支持。
参数实验室等机构联合发布的Dr.LLM技术,通过为大型语言模型配备智能路由器,让AI能根据问题复杂度动态选择计算路径。该系统仅用4000个训练样本和极少参数,就实现了准确率提升3.4%同时节省计算资源的突破,在多个任务上表现出色且具有强泛化能力,为AI效率优化开辟新方向。