Meta Platforms开发了一种人工智能(AI)系统,可以扫描维基百科的文章,分析文章引用来源,确定其中一些是否需要更改。
Meta今天详细介绍了这个AI系统,此外还根据开源许可发布了该系统的代码。
维基百科的编辑们通过检查检索信息的来源,来确保维基百科文章中某些信息是否准确,而检查文章所有引用来源是一个非常耗时的过程。维基百科有数百万页,其中一些页面包含多达数百条引文。
Meta此次发布的AI系统旨在通过对一部分论文引文审查工作实施自动化,来简化维基百科编辑们的工作。该系统可以扫描一篇文章并识别文章中是否存在有可疑引文的信息片段,此外还能够推荐相关性更高的来源,用这些来源替换有问题的引用。
例如,一篇关于某款Apple产品的维基百科文章,可能会意外引用Apple网站上讨论另外一个产品的页面,而Meta的这个新IA系统可以发现该引用是错误的,还可以推荐文章应该引用Apple网站上的准确页面。
Meta利用来自维基百科的400万条信息文本片段对该系统进行训练,使其可以检测出错误的引用。此外,Meta还创建了一个名为Sphere的数据集,其中包含来自开放网络的1.34亿个文档。当系统在维基百科文章中发现引用有问题的时候,系统就会搜索Sphere数据集中的文档,找到相关性更高的来源。
该系统找到可替换有问题的引用的新来源,这个过程涉及到多个步骤。
由于Sphere数据集包含1.34亿份文档,因此搜索相关引用可能需要大量时间。Meta研究人员开发了一系列专业指数加快了这个过程。在数据管理过程中,索引是快捷方式的集合,可以更快速地找到特定信息。
Meta的AI系统使用Meta开发的索引加快搜索Sphere数据集以查找引用,这比其他方法速度更快。当系统找到可能被引用为来源的文档时,就会从文档中提取出相关性最高的段落,还能够确定是否有多个文档可能被作为引用来源。
据Meta称,该系统可创建两个文本片段的数学表示,来确定来自Sphere的文档是否能够支持维基百科文章中的某个信息片段,然后对比这些数据表示以确定是否相关性最高。
“我们设计了一系列工具来对比这些数学表示,以确定一段陈述是支持还是反驳另一段陈述,”Meta研究人员在今天发表的一篇博客文章中详细说明称。如果该系统找到了多个可以作为来源引用的文档,就会根据相关可能性对这些文档进行排名。
研究人员详细介绍说:“该模型使用细粒度的语言理解,根据相关可能性对这些引用来源和检索到的替代方案进行排名。在现实部署环境中,该模型将提供相关性最高的链接作为预期引用来源,供编辑们进行审批。”
除了这个系统之外,Meta还开源了Sphere数据库,以及让该数据库更易于搜索的索引。此外,Meta还将公布一个名为distributed-faiss的内部工具代码,该工具可以跨多个服务器而不是在单个设备上运行索引,从而简化处理过程。
Meta相信这个AI系统、Sphere数据集等其他一系列Meta工程师开发的组件,未来可用于支持多个应用场景。Meta详细说明称:“未来可能还会推出一系列可以实时验证文档的编辑,而这次推出的模型将成为这些编辑器的首批组件。除了提出引文之外,该系统还可以根据网络上相关文件提供的信息,对自动完成文本提供建议,以及校对更正。”
好文章,需要你的鼓励
当前软件工程团队正在试验基于AI代理的编码工具和大语言模型,以提高开发速度和质量。然而,AI编码工具的效果很大程度上取决于使用方式。开发者需要提供结构化的问题描述、明确的执行要求和相关上下文,同时建立适当的防护机制。AI不仅能处理重复性任务,还能识别和评估替代方案,从被动助手演进为工作流程推进器。成功的关键在于将AI视为合作伙伴而非快捷工具,并将其整合到软件交付的全生命周期中。
NVIDIA研究团队开发出名为Lyra的AI系统,能够仅凭单张照片生成完整3D场景,用户可自由切换观察角度。该技术采用创新的"自蒸馏"学习方法,让视频生成模型指导3D重建模块工作。系统还支持动态4D场景生成,在多项测试中表现优异。这项技术将大大降低3D内容创作门槛,为游戏开发、电影制作、VR/AR应用等领域带来重大突破。
Salesforce发布企业级AI智能体平台Agentforce 360,将AI智能体融入几乎所有应用中。该平台采用混合推理引擎Atlas,结合大语言模型的概率思维和业务规则的精确性,支持语音交互和深度集成。以Slack为主要界面,提供Agentforce Builder开发环境,能将非结构化文档转换为可查询记录。Salesforce内部已部署该系统,每周处理180万次对话,主动服务活动增长40%。
谷歌DeepMind团队创新性地让Gemini 2.5模型在无需训练的情况下学会理解卫星多光谱图像。他们将复杂的12波段卫星数据转换为6张可理解的伪彩色图像,配以详细文字说明,使通用AI模型能够准确分析遥感数据。在多个基准测试中超越现有模型,为遥感领域AI应用开辟了全新道路。