9月9日,字节跳动 Seed 团队宣布推出豆包图像创作模型 Seedream 4.0。该模型支持文生图、图像编辑及多图参考等功能,多模态生图效果、速度和可用性在专业评测中达到业界领先水平。
目前,Seedream 4.0 已在豆包App、即梦AI、扣子等产品正式上线,用户可以免费体验。该模型也已通过火山引擎开放给企业客户。
Seed 团队表示,“Seedream 4.0 不仅仅是一个图像生成模型,更是一个具备知识和思考能力的多模态创意引擎。”
测试案例显示,Seedream 4.0 不仅能理解物理规律与时间约束、三维空间等复杂语境,还能在解谜、填字、续写漫画等任务中保持风格一致与细节精致,逻辑推理和创意生成能力表现出色。
Seedream 4.0 测试效果(Prompt:六个小时后这个图片的场景是什么样子)
据介绍,Seedream 4.0 可灵活支持文本、图像的组合输入,抽取不同图片元素进行创作,还可一次生成角色连贯、风格统一的组图,实现表情包、连环画等各类创意玩法。
同时,该模型支持高度自由的艺术风格迁移,最高可生成 4K 分辨率的商用级图像,并具备出色的文字渲染能力,还可处理基础的公式、表格、统计图等复杂排版,广泛适用于教育、电商、广告设计、影视后期等应用场景。
Seedream 4.0测试效果(Prompt:参考图2的风格,将图1做风格转换)
基于高效的模型架构和多层推理加速,Seedream 4.0 实现了高质量和高效生成的平衡。Seed 官网显示,Seedream 4.0 在各维度专业评测的综合表现排名业界前列,视觉美感、速度等关键指标成绩突出,并展现出较强的可靠性。
图:MagicBench “文生图”及“单图编辑”人工评测基准(数据来源:Seed官网)
Seed 团队表示,图像创作正在从文生图进入多模态交互的新阶段,Seedream 4.0 已具备通用多模态创意引擎的雏形。团队将继续探索更实时的交互式生成体验,进一步深度融合多模态推理与世界知识,更好地帮助用户激发灵感、实现创意。
好文章,需要你的鼓励
美国网络安全和基础设施安全局指示联邦机构修补影响思科ASA 5500-X系列防火墙设备的两个零日漏洞CVE-2025-20362和CVE-2025-20333。这些漏洞可绕过VPN身份验证并获取root访问权限,已被黑客积极利用。攻击与国家支持的ArcaneDoor黑客活动有关,黑客通过漏洞安装bootkit恶意软件并操控只读存储器实现持久化。思科已发布补丁,CISA要求机构清点易受攻击系统并在今日前完成修补。
康考迪亚大学研究团队通过对比混合量子-经典神经网络与传统模型在三个基准数据集上的表现,发现量子增强模型在准确率、训练速度和资源效率方面均显著优于传统方法。研究显示混合模型的优势随数据集复杂度提升而增强,在CIFAR100上准确率提升9.44%,训练速度提升5-12倍,且参数更少。该成果为实用化量子增强人工智能铺平道路。
TimeWave是一款功能全面的计时器应用,超越了苹果自带时钟应用的功能。它支持创建流式计时器,让用户可以设置连续的任务计时,帮助专注工作。应用采用简洁的黑白设计,融入了Liquid Glass元素。内置冥想、番茄工作法、20-20-20护眼等多种计时模式,支持实时活动显示和Siri快捷指令。免费版提供基础功能,高级版需付费订阅。
沙特KAUST大学团队开发了专门针对阿拉伯语的AI模型家族"Hala",通过创新的"翻译再调优"技术路线,将高质量英语指令数据转化为450万规模的阿拉伯语语料库,训练出350M到9B参数的多个模型。在阿拉伯语专项测试中,Hala在同规模模型中表现最佳,证明了语言专门化策略的有效性,为阿拉伯语AI发展和其他语言的专门化模型提供了可复制的技术方案。