做平面最头疼的就是让 AI 在图里排字,以前不管什么模型,稍微密一点的文字全给你画成鬼画符。GPT Image 2 我试下来最大的不同,是它出图前有个"思考"步骤,先规划构图、检查、再迭代,不是一枪出。
效果就是那些历来翻车的东西——密集文字、小的 UI 元素、图标、信息图、地图、幻灯片甚至漫画分格——都能干净渲染出来。我拿它测了一句挺刁的 prompt:一张海报,居中放一个七项的项目符号列表,11pt Helvetica,出来是真能用的排版,不是一堆糊字母。
还有两点对我很实在。一是局部编辑,改动区域外的像素能保持稳定,不会你只想调个天色它顺手把人脸也重画了,最高到 2K。二是一个 prompt 能出八张、角色和物件还能保持连贯,做角色三视图、产品变体不用再死磕锁种子。它的定位就是混合流水线里那个啃文字的主力,重文字的主视觉交给它,升频和风格化再交回本地模型。