介绍 ChatGPT Images 2.5
英文标题:Simon Willison’s Weblog
OpenAI 发布 ChatGPT Images 2.5,提升了多轮对话遵循指令能力、响应速度,并改善了参考照片主体保留效果。
为什么值得关注
图像生成模型正变得更强大且易于使用,ChatGPT Images 2.5 的改进意味着用户可以通过多轮对话更精确地控制图像编辑,同时保持参考照片中的主体一致性。这对设计师、内容创作者和开发者来说,意味着更高效的工作流程和更高质量的视觉内容生成。
核心要点
- OpenAI 发布 ChatGPT Images 2.5,已生成超 30 亿张图像。
- 新版本在多轮对话指令遵循、响应速度和参考照片主体保留方面有提升。
- API 提供两个新模型:gpt-image-2.5-sunburst(编辑精度)和 gpt-image-2.5-flare(快速生成)。
- Simon Willison 升级了命令行工具,支持传入参考图像进行编辑。
- 演示示例:通过提示词在现有图表中添加一只浣熊科学家。
2026年9月8日 - 链接博客
介绍 ChatGPT Images 2.5。OpenAI 的图像生成模型显然被用于“在 ChatGPT Images 和 API 中的 GPT-Image 模型之间生成了超过 30 亿张图像”。这个最新版本提升了它们在多轮对话中遵循指令的能力,响应速度更快,并且“在保留参考照片中的主体方面表现更好”。
API 中有两个新的模型 ID:gpt-image-2.5-sunburst 和 gpt-image-2.5-flare。根据这个说明,我认为 Sunburst 是更强的选择:
对于编辑精度最重要的场景,选择 Sunburst;对于快速、高质量的日常图像生成,选择 Flare。
我升级了我的 openai_image.py 命令行工具,使其支持传入一个或多个参考图像,所以现在可以这样操作:
uv run https://tools.simonwillison.net/python/openai_image.py \
'添加一只正在认真研究图表的浣熊科学家' \
-i https://static.simonwillison.net/static/2026/openai-agent-usage.webp \
-m gpt-image-2.5-sunburst
这是原始图像,以下是我根据“添加一只正在认真研究图表的浣熊科学家”这个提示得到的结果:
近期文章
-
Astra 的 Pelican 对比网格相当有趣 - 2026年9月4日
-
OpenAI 的失控代理被发现通过公共维基进行通信 - 2026年9月4日
-
Claude 的新系统提示真的不想复制歌词 - 2026年9月2日
这是 Simon Willison 发布的一篇链接帖子,发布于 2026年9月8日。
月度简报
每月赞助我 10 美元,即可获得一封精选的电子邮件摘要,汇总当月最重要的大语言模型(LLM)发展动态。
付钱让我少给你发邮件!
术语表
- ChatGPT Images
- OpenAI 的图像生成模型,集成在 ChatGPT 中,可根据文本提示生成或编辑图像。
- API
- 应用程序编程接口,允许开发者通过代码调用模型功能。
- 模型 ID
- 用于在 API 中区分不同模型版本的唯一标识符。
- 多轮对话
- 指与 AI 进行连续多轮交互,AI 能记住上下文并据此调整输出。
- 参考照片
- 用户提供的图像,用于指导 AI 在生成或编辑时保留其中的主体或风格。
生产区
使用这篇文章
复制包含 frontmatter、中文正文和英文来源的 Markdown。
我的研究区
记录自己的判断,不会写回原文或公开页面。
一句话说清这篇材料能支撑什么角度。
每行一个,最多 20 个。
支持 Markdown。要核对的数据、可复用的方法、反方观点或补充来源。