OpenAI发布ChatGPT Images 2.5,新增Sketch手绘输入
ChatGPT Images 2.5 发布
Images 2.5 是 ChatGPT 图像能力的重大迭代,特别是 Sketch 手绘输入和局部重绘精度的提升,直接改变了 AI 绘图的工作流,做创意工作的同学值得重点关注。
ChatGPT Images 2.5 发布
速度、保真度、编辑精度、多轮一致性四个方面相比 Images 2.0 有提升,并新增 Sketch 手绘输入和模板两种使用方式 https://openai.com/index/introducing-chatgpt-images-2-5/
核心改进:四个维度 1. 速度。 延迟最多降低 50%。对交互式产品来说这不只是体验优化,图像生成从“提交后等待”变成可以连续迭代的对话流,这是生成式工具从演示走向日常生产工具的关键一步。
2. 保真度。 光照更自然、纹理更丰富,更重要的是“参考照片中的主体保留更好”。原文特别指出:主体在不同场景、风格、构图下“更显眼、更易辨认”,对 API 用户而言这意味着“参考引导的工作流”可靠,生成的变体不会偏离原始素材。这直指商业场景中最痛的问题:用产品图、品牌素材做生成时,产品本身不能变形。
3. 精准编辑。 只改指定的部分,其余细节(包括复杂主体和背景)保持不变。API 场景下可以只更新一个元素,换产品、换背景、改文案,而保留主体、构图和品牌风格。这实际上是把“局部重绘”从碰运气变成可依赖的能力。
4. 多轮编辑一致性。 长对话中经过多次编辑后,此前的修改依然保持,质量不随轮次衰减。开发者可以在生产环境做针对性改动而无需每次重建整个素材。这一点对真实工作流的意义可能超过前三项,以往多轮编辑“越改越崩”是所有图像模型的通病。
两个降低门槛的新入口 1. Sketch 是这次最有产品想象力的一项:在 ChatGPT 里直接画草图作为视觉参考,系统将其转化为完整图像,还可以叠加文字描述风格。输入方式是输入 “@ Sketch”。它的定位很明确——“有些想法画出来比描述更容易”。用户不需要会画画,一根线条勾勒出的布局和构图,往往比一段精密的提示词更准确地传达意图。这本质上是给图像模型增加了一条空间/构图先验的输入通道。
2. 模板 则面向“有想法但不知道从哪开始”的用户:海报、周边商品、传单、产品照等热门格式提供起始模板,填入自己的信息、设计元素和风格即可。配合新增的评论式编辑(直接在图片上标注要改哪里)和分享提示词(分享图片时附上所用 prompt,他人可用自己的素材复用同一创意),整个链路从“空白画布”到“传播复用”都被覆盖了。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力