GPT-Image 2 相信大家都在使用吧?生图效果确实炸裂,很多图片极其逼真,肉眼根本分不清是虚拟还是现实,我愿称之为当前最强文生图模型。但很多人包括我自己有时候用起来还是不那么顺手,比如写了一大堆长篇大段的提示词,画面排版和文字还是偶尔崩坏,想集成到自己的自动化工作流里更是有些头疼。
刚刷到有博主分享的开源项目 awesome-gpt-image-2,他把300+个高质量提示词案例全给逆向整理成了工业级模板。看了下思路确实有点东西,分享给同样在折腾 AI 文生图或工作流的小伙伴们。
几个核心亮点
Prompt-as-Code 理念:不再用自然语言写“小作文”,而是把主体、光影、材质、排版全部降维成结构化的 JSON/YAML 格式。这样不仅解析更稳定,而且非常适合直接喂给 Claude Code 或 Codex 等 Agent 批量调用。
解决排版与文字痛点:引入了精确的空间坐标约束,配合 GPT-Image 2 本身对中文的超高支持度,几乎做到了文字零乱码、长卷图直出。
覆盖场景丰富:除了常规的海报、插画,还包含了超逼真的直播间画面、朋友圈截图、爆炸拆解图、技术架构图以及诗词长卷等。
几个实用的模板示例
手绘城市地图:生成一张手绘水彩风格的「城市名」城市地图,包含当地特色美食、地标建筑及城市特色
爆炸拆解图:生成一张 AI 眼镜的爆炸视图,包含每个组件的名称以及这款产品的几大核心卖点
技术详解图:帮我生成一张【技术名词】技术的详细讲解图
诗词意境长卷:帮我生成一张《赤壁怀古》的长卷图,带整篇《赤壁赋》文字
强烈推荐的工作流
博主分享了他目前效率极高的封面图生产流程:Codex / Claude Code + GPT-Image 2 + Obsidian。
在 Obsidian 写完文章后,直接让 Codex 调用 GPT-Image 2 生图,不到一分钟就能自动出图并填入文章字段,完全不需要额外的复杂插件。
如果你也在折腾 Agent 自动化生图,或者厌倦了无休止地调整自然语言 Prompt,强烈建议去 GitHub 开源仓库 看看!
项目地址: