Signal Desk
Simon Willison's WeblogAI 中文译文 · 待人工复核

介绍 ChatGPT Images 2.5

英文标题:Simon Willison’s Weblog

OpenAI 发布 ChatGPT Images 2.5,提升了多轮对话遵循指令能力、响应速度,并改善了参考照片主体保留效果。

正文研究价值 63 / 100

英文原文我的研究区

为什么值得关注

图像生成模型正变得更强大且易于使用,ChatGPT Images 2.5 的改进意味着用户可以通过多轮对话更精确地控制图像编辑,同时保持参考照片中的主体一致性。这对设计师、内容创作者和开发者来说,意味着更高效的工作流程和更高质量的视觉内容生成。

核心要点

  1. OpenAI 发布 ChatGPT Images 2.5,已生成超 30 亿张图像。
  2. 新版本在多轮对话指令遵循、响应速度和参考照片主体保留方面有提升。
  3. API 提供两个新模型:gpt-image-2.5-sunburst(编辑精度)和 gpt-image-2.5-flare(快速生成)。
  4. Simon Willison 升级了命令行工具,支持传入参考图像进行编辑。
  5. 演示示例:通过提示词在现有图表中添加一只浣熊科学家。

2026年9月8日 - 链接博客

介绍 ChatGPT Images 2.5。OpenAI 的图像生成模型显然被用于“在 ChatGPT Images 和 API 中的 GPT-Image 模型之间生成了超过 30 亿张图像”。这个最新版本提升了它们在多轮对话中遵循指令的能力,响应速度更快,并且“在保留参考照片中的主体方面表现更好”。

API 中有两个新的模型 ID:gpt-image-2.5-sunburstgpt-image-2.5-flare。根据这个说明,我认为 Sunburst 是更强的选择:

对于编辑精度最重要的场景,选择 Sunburst;对于快速、高质量的日常图像生成,选择 Flare。

升级了我的 openai_image.py 命令行工具,使其支持传入一个或多个参考图像,所以现在可以这样操作:

uv run https://tools.simonwillison.net/python/openai_image.py \
  '添加一只正在认真研究图表的浣熊科学家' \
  -i https://static.simonwillison.net/static/2026/openai-agent-usage.webp \
  -m gpt-image-2.5-sunburst

这是原始图像,以下是我根据“添加一只正在认真研究图表的浣熊科学家”这个提示得到的结果:

近期文章

这是 Simon Willison 发布的一篇链接帖子,发布于 2026年9月8日

月度简报

每月赞助我 10 美元,即可获得一封精选的电子邮件摘要,汇总当月最重要的大语言模型(LLM)发展动态。

付钱让我少给你发邮件!

术语表

ChatGPT Images
OpenAI 的图像生成模型,集成在 ChatGPT 中,可根据文本提示生成或编辑图像。
API
应用程序编程接口,允许开发者通过代码调用模型功能。
模型 ID
用于在 API 中区分不同模型版本的唯一标识符。
多轮对话
指与 AI 进行连续多轮交互,AI 能记住上下文并据此调整输出。
参考照片
用户提供的图像,用于指导 AI 在生成或编辑时保留其中的主体或风格。

生产区

使用这篇文章

复制包含 frontmatter、中文正文和英文来源的 Markdown。

我的研究区

记录自己的判断,不会写回原文或公开页面。

一句话说清这篇材料能支撑什么角度。

每行一个,最多 20 个。

支持 Markdown。要核对的数据、可复用的方法、反方观点或补充来源。