
Image: OpenAI
OpenAI宣布了其生成型AI视觉艺术平台DALL-E的第三个版本,该平台现在允许用户使用ChatGPT创建提示,并包括更多安全选项。
相较于前代产品,DALL-E3有着显著的提升,并实现了与ChatGPT的无缝集成。其突出特点在于面对详细而冗长的提示时,它能够更好地理解和解读用户的意图;即使用户难以准确表达自己的想法,ChatGPT也能够介入,协助生成全面的提示。
在The Verge的演示中,首席研究员兼DALL-E团队负责人Aditya Ramesh促使ChatGPT帮助他为山区的一家拉面餐厅设计一个标志。然后,ChatGPT写了一个更长的提示,DALL-E给出了四个选项。OpenAI表示,这种与聊天机器人的连接可以让更多的人创作人工智能艺术。虽然目前的DALL-E版本可以模仿在世艺术家的风格,但即将推出的DALL-E3在设计上将拒绝复制其版权作品的请求。艺术家们可以通过OpenAI网站上的专用表格提交他们的原创作品,以便在必要时请求删除。
DALL-E于2021年1月首次发布,先于Stability AI和Midtravel的其他文本到图像生成AI艺术平台。到2022年DALL-E 2发布时,OpenAI打开了一个等待名单,以控制谁可以使用该平台,因为有人批评DALL-E可以生成真实感的露骨图像,并在生成照片时显示出偏见。该公司于去年9月取消了候补名单,并向公众开放了DALL-E 2。
这个新版本的DALL-E将于10月首次向ChatGPT Plus和ChatGPT Enterprise用户发布,随后研究实验室及其API服务将于秋季发布。OpenAI计划错开DALL-E 3的发布时间,但没有承诺何时发布免费的公共版本。
好文章,需要你的鼓励
随着AI技术不断发展,交通运输行业正迎来重大变革。MIT研究显示,AI将很快自动化价值650亿美元的交通工作,大幅提升运输效率。从陆地到海空,AI正在推动全方位的交通创新。斯坦福专家强调,AI将通过基础模型、合成数据和数字孪生等技术,实现从单一车辆自动化到整个交通网络优化的跨越式发展,同时解决可持续性、安全性和公平性等关键挑战。
香港科技大学团队发表重要研究,开发GIR-Bench测试基准评估统一多模态AI模型的推理与生成能力。研究发现即使最先进的AI模型在理解与生成之间也存在显著差距,无法有效将推理过程转化为准确的视觉生成,为AI行业发展提供重要警示。
波兰研究团队开发ORCA数学基准测试,对五个主流大语言模型进行评估。结果显示ChatGPT-5、Gemini 2.5 Flash、Claude Sonnet 4.5、Grok 4和DeepSeek V3.2的准确率均低于63%。测试涵盖生物化学、工程建筑、金融经济等七个领域的500道数学题目。研究发现模型主要在四舍五入和计算错误方面存在问题,表明自然语言推理进步并未直接转化为可靠的计算能力。
Meta超级智能实验室联合麻省理工学院开发了SPG三明治策略梯度方法,专门解决扩散语言模型强化学习训练中的技术难题。该方法通过上下界策略为AI模型提供精确的奖惩反馈机制,在数学和逻辑推理任务上实现了显著性能提升,为AI写作助手的智能化发展提供了新的技术路径。