谷歌正在向全球更多开发者推出其 Gemini 2.0 Flash AI 模型的最新"实验性"功能,人们发现它具有一些令人担忧的能力,包括从照片中删除水印。
该公司的轻量级本地设备 AI 模型现在配备了原生图像生成功能,不仅可以根据文字提示生成图片,还可以让用户以对话方式编辑图片。据 TechCrunch 报道,在周末期间,用户们发现它还能精确地移除水印。
像 Watermark Remover.io 这样的工具已经可以清除来自 Shutterstock 等公司的水印,而谷歌的一个研究团队在 2017 年就开发了一个水印移除算法,以强调需要更安全的保护措施。相反,一些 AI 工具(如 OpenAI 的 GPT-4)会拒绝移除水印的请求。
然而,Gemini 2.0 Flash 似乎在移除复杂水印(如 Getty Images 标记)并填充图像方面表现得比其他选择更好。在移除水印后,它会添加一个 SynthID 标记,实际上是用"AI 编辑"标记替换了版权标记。但正如我们之前在三星的对象擦除工具中看到的那样,使用 AI 也可以移除 AI 标记。
用户还注意到,Gemini 2.0 Flash 显然可以将真实人物(如 Elon Musk)的可识别图像添加到照片中,这是完整版 Gemini 模型所不允许的。
目前,Flash 的最新图像功能仅通过 AI Studio 向开发者开放——因此其明显缺乏保护机制的特性并未对所有人开放使用(或滥用)。我们已经询问谷歌是否有相关保护措施来阻止水印移除等行为,但尚未收到回复。
好文章,需要你的鼓励
Rivian分拆公司Also与亚马逊达成多年合作协议,将为这家电商巨头提供数千辆新型踏板助力四轮货运车TM-Q。该车辆载重超过400磅,体积小巧可使用自行车道。双方将合作定制车辆以满足亚马逊在欧美的配送需求,预计2026年春季投入使用。Also从Rivian内部项目发展而来,今年独立融资1.05亿美元,将利用可拆卸电池技术和专业物流软件为密集城区提供最后一公里配送解决方案。
Character AI联合耶鲁大学开发的OVI系统实现了音视频的统一生成,通过"孪生塔"架构让音频和视频从生成之初就完美同步。该系统在5秒高清内容生成上显著超越现有方法,为多模态AI和内容创作领域带来突破性进展。
知名投资机构Accel和Prosus宣布建立新的投资合作伙伴关系,专门支持印度初创企业从零开始发展,重点关注那些能够为南亚地区大众提供大规模解决方案的创始人。这是Prosus首次在企业成立阶段进行投资。双方将从创业公司最早期开始共同投资,专注于解决自动化、能源转型、互联网服务和制造业等领域的系统性挑战,初始投资金额从10万到100万美元不等。
这项由南洋理工大学研究团队开发的DragFlow技术,首次实现了在先进AI模型FLUX上的高质量区域级图像编辑。通过创新的区域监督、硬约束背景保护和适配器增强等技术,将传统点对点编辑升级为更自然的区域编辑模式,在多项基准测试中显著超越现有方法,为图像编辑技术带来革命性突破。