9月9日,字节跳动 Seed 团队宣布推出豆包图像创作模型 Seedream 4.0。该模型支持文生图、图像编辑及多图参考等功能,多模态生图效果、速度和可用性在专业评测中达到业界领先水平。
目前,Seedream 4.0 已在豆包App、即梦AI、扣子等产品正式上线,用户可以免费体验。该模型也已通过火山引擎开放给企业客户。
Seed 团队表示,“Seedream 4.0 不仅仅是一个图像生成模型,更是一个具备知识和思考能力的多模态创意引擎。”
测试案例显示,Seedream 4.0 不仅能理解物理规律与时间约束、三维空间等复杂语境,还能在解谜、填字、续写漫画等任务中保持风格一致与细节精致,逻辑推理和创意生成能力表现出色。

Seedream 4.0 测试效果(Prompt:六个小时后这个图片的场景是什么样子)
据介绍,Seedream 4.0 可灵活支持文本、图像的组合输入,抽取不同图片元素进行创作,还可一次生成角色连贯、风格统一的组图,实现表情包、连环画等各类创意玩法。
同时,该模型支持高度自由的艺术风格迁移,最高可生成 4K 分辨率的商用级图像,并具备出色的文字渲染能力,还可处理基础的公式、表格、统计图等复杂排版,广泛适用于教育、电商、广告设计、影视后期等应用场景。

Seedream 4.0测试效果(Prompt:参考图2的风格,将图1做风格转换)
基于高效的模型架构和多层推理加速,Seedream 4.0 实现了高质量和高效生成的平衡。Seed 官网显示,Seedream 4.0 在各维度专业评测的综合表现排名业界前列,视觉美感、速度等关键指标成绩突出,并展现出较强的可靠性。

图:MagicBench “文生图”及“单图编辑”人工评测基准(数据来源:Seed官网)
Seed 团队表示,图像创作正在从文生图进入多模态交互的新阶段,Seedream 4.0 已具备通用多模态创意引擎的雏形。团队将继续探索更实时的交互式生成体验,进一步深度融合多模态推理与世界知识,更好地帮助用户激发灵感、实现创意。
好文章,需要你的鼓励
Anthropic发布SCONE-bench智能合约漏洞利用基准测试,评估AI代理发现和利用区块链智能合约缺陷的能力。研究显示Claude Opus 4.5等模型可从漏洞中获得460万美元收益。测试2849个合约仅需3476美元成本,发现两个零日漏洞并创造3694美元利润。研究表明AI代理利用安全漏洞的能力快速提升,每1.3个月翻倍增长,强调需要主动采用AI防御技术应对AI攻击威胁。
NVIDIA联合多所高校开发的SpaceTools系统通过双重交互强化学习方法,让AI学会协调使用多种视觉工具进行复杂空间推理。该系统在空间理解基准测试中达到最先进性能,并在真实机器人操作中实现86%成功率,代表了AI从单一功能向工具协调专家的重要转变,为未来更智能实用的AI助手奠定基础。
Spotify年度总结功能回归,在去年AI播客功能遭遇批评后,今年重新专注于用户数据深度分析。新版本引入近十项新功能,包括首个实时多人互动体验"Wrapped Party",最多可邀请9位好友比较听歌数据。此外还新增热门歌曲播放次数显示、互动歌曲测验、听歌年龄分析和听歌俱乐部等功能,让年度总结更具互动性和个性化体验。
这项研究解决了现代智能机器人面临的"行动不稳定"问题,开发出名为TACO的决策优化系统。该系统让机器人在执行任务前生成多个候选方案,然后通过伪计数估计器选择最可靠的行动,就像为机器人配备智能顾问。实验显示,真实环境中机器人成功率平均提升16%,且系统可即插即用无需重新训练,为机器人智能化发展提供了新思路。