gpt-image-2-prompt-engine skill
面向电商设计师、海报美工、品牌视觉、UI设计师、信息图编辑、商业摄影师、内容创作者等需要高质量可控出图的角色,在需要用 GPT-Image-2 生成电商主图、电影海报、信息图、品牌视觉、UI截图、古籍国风、角色IP等场景时,通过「Prompt as Code」原子化Schema+20+工业JSON模板+四步工作流,产出结构化、可复用、可批量的生图提示词,再调用 image_generation 出图。不适用于随意生图或简单风景照。
Is the gpt-image-2-prompt-engine skill safe?
Clean: nothing in its files matched our rules. We read 3 files in the folder on 2026-09-28.
No findings.
Install the gpt-image-2-prompt-engine skill
A skill is a folder. Copy it into your agent's skills folder and the agent loads it when the task matches its description.
git clone --depth 1 https://github.com/anbeime/skill.git /tmp/skill mkdir -p ~/.claude/skills cp -r /tmp/skill/skills/gpt-image-2-prompt-engine ~/.claude/skills/gpt-image-2-prompt-engine
In the Claude apps, zip the folder and upload it from the Skills settings. The folder on GitHub
The instructions your agent would load
SKILL.md as published, without the frontmatter. Read it on GitHub
GPT-Image-2 Prompt Engine
基于 freestylefly/awesome-gpt-image-2(⭐18k+,MIT)工业级提示词引擎方法论,沉淀为可执行的生图提示词构造工作流。
任务目标
- 本技能用于:将模糊的出图需求转化为 GPT-Image-2 可稳定执行的结构化提示词
- 能力包含:
- 原子化 Schema 拆解:Subject / Composition / Material / Typography / Lighting / Style / Constraints 七大维度
- 20+ 工业级 JSON 模板:覆盖 UI截图、信息图、海报、电商主图、品牌视觉、商业摄影、角色IP、古籍国风、叙事插画等场景
- 四步工作流:选类别 → 检索案例(抄结构)→ 套模板填变量 → 生成与图生图迭代
- 5 个稳定性实测技巧:文字锁定、比例前置、模块限量、平台特征区分、负向约束
- 触发条件:
- ✅ 电商主图/详情页、电影/活动海报、信息图/知识图谱、品牌视觉、UI截图、商业摄影、角色/IP设计、叙事插画、古籍国风、3D渲染
- ❌ 随意生图、简单风景照、不需要精确控制的随手画 → 走基础 image_generation
核心方法论:Prompt as Code
万能结构公式
[主体与任务] + [构图与布局] + [视觉风格与材质] + [文字与标签要求] + [比例与输出格式] + [约束与负向细节]原子化 Schema
四步工作流
Step 1:选类别
根据用户需求匹配模板类别:
Step 2:检索案例(抄结构)
使用 scripts/query_templates.py 检索本地克隆仓库的模板与案例:
python3 scripts/query_templates.py --category ecommerce
python3 scripts/query_templates.py --keyword "香水 海报"未克隆仓库时,脚本会优雅降级,输出在线 raw 链接:
- 模板库:https://raw.githubusercontent.com/freestylefly/awesome-gpt-image-2/main/docs/templates.md
- 画廊Part1:https://raw.githubusercontent.com/freestylefly/awesome-gpt-image-2/main/docs/gallery-part-1.md
- 画廊Part2:https://raw.githubusercontent.com/freestylefly/awesome-gpt-image-2/main/docs/gallery-part-2.md
也可直接 web_fetch 上述链接获取最新案例。
Step 3:套模板填变量
选择匹配的 JSON 模板,将用户需求填入变量。以下为 3 个核心模板示例:
模板A:信息图
{
"type": "Infographic",
"topic": "<主题,明确具体>",
"audience": "<目标读者>",
"structure": {
"title_area": "<主标题>",
"layout": "<布局描述,如:等距切角,N个编号面板>",
"modules": [
{"title": "<模块1>", "icon": "<图标名>", "text": "<1-2句说明>"},
{"title": "<模块2>", "icon": "<图标名>", "text": "<1-2句说明>"}
]
},
"style": {
"aesthetic": "<风格,如:科学图鉴/扁平插画/商务报告>",
"colors": "<配色方案>",
"background": "<背景>"
},
"constraints": "No gibberish text, strict structural layout, <比例>"
}模板B:电影/活动海报
{
"type": "Poster",
"subject": "<主体描述>",
"title": {
"text": "<标题,必须精确显示>",
"style": "<字体风格,如:粗黑体/书法体/衬线体>",
"position": "<位置,如:居中/底部/对角>"
},
"composition": "<构图描述>",
"visual_style": "<视觉风格,如:赛博朋克/复古胶片/极简>",
"color_palette": ["<主色>", "<辅色>", "<点缀色>"],
"mood": "<情绪关键词>",
"constraints": "Title must be spelled exactly, readable text, <比例>, no random text"
}模板C:电商主图
{
"type": "Ecommerce",
"product": {
"name": "<产品名>",
"material": "<材质>",
"color": "<颜色>",
"key_feature": "<核心卖点>"
},
"scene": "<使用场景/背景>",
"composition": "<构图,如:居中45度俯拍>",
"lighting": "<光线描述>",
"style": "<风格,如:高端商业摄影/极简白底/生活方式>",
"text_overlay": {
"headline": "<主文案>",
"subtext": "<副文案>",
"position": "<位置>"
},
"constraints": "Product must be accurate, readable text, <比例>, no watermark"
}Step 4:生成与迭代
- 将填好变量的 JSON 转为自然语言提示词
- 调用 image_generation 出图(中文需求用中文提示词,英文需求用英文)
- 检查出图结果:文字是否准确、构图是否符合、比例是否正确
- 不满足则调整对应 Schema 维度后重新生成(图生图模式可传入参考图)
5 个稳定性实测技巧
- 文字锁定:凡是画面中有文字,必须写"文字必须准确显示指定内容,禁止乱码和占位文本",并把原文逐字写出
- 比例前置:宽高比写在提示词最前面或 constraints 第一条,否则模型默认出 1:1 或 9:16
- 模块限量:信息图先锁定 3-5 个模块再补细节,模块过多必然混乱
- 平台特征区分:UI截图必须指定平台(iOS/Android/小红书/抖音),各平台状态栏、Tab、交互元素差异大
- 负向约束具体化:不要只写"no artifacts",要写"禁止多余手指""禁止乱码按钮""禁止产品变形"
使用方式
输入
输出
- 一份结构化的 GPT-Image-2 提示词(可直接复制使用)
- 对应的 JSON Schema(可复用/批量修改)
- 选中的模板名称和参考案例ID
- 负向约束清单
资源引用
- 上游项目:freestylefly/awesome-gpt-image-2(⭐18k+,MIT License)
- 在线画廊:https://gpt-image2.canghe.ai
- npm 包:gpt-image-2-style-library
- 完整模板库:references/style-library.md(20+ 模板详细索引)
- 案例库:530+ 逆向工程案例,见上游 docs/gallery.md
⚠️ 第三方案例商用授权提示:本技能引用的案例仅供学习参考,商用前请确认对应案例的授权范围。
注意事项
- 本技能不新增生图工具,出图仍需调用 image_generation 技能
- 中文需求默认输出中文提示词,英文需求输出英文提示词
- 批量生成时复用同一模板,仅变更 subject / composition / palette
- 仓库克隆被 403 拦截时,以在线 raw 链接检索为主路径
More skills from anbeime/skill
- APDF Processing Pro综合办公文员与软件开发工程师当需要批量处理PDF表单、提取表格或进行OCR识别时,使用内置脚本一键完成自动化提取与数据校验,彻底告别繁琐的手动录入,让复杂文档工作流高效、稳健落地。
- Aagent-team产品经理与项目管理专家在应对复杂项目时,使用此技能可动态组建包含“执行、指挥、评审”的专属AI团队。实时查看多智能体辩论与决策全过程,共享统一上下文记忆,一键完成从会议决策到系统构建的全流程高效协同!
- Aagentkit-multimedia-shopping电商运营与内容创作者在需要制作带货短视频时,用此技能一键生成9:16竖屏数字人成片。自动编排AI绘画、语音合成与视频生成,快速产出“小省导购员”专属形象与专业配音,让多模态视频制作省时省力。
- Aantinet-doc-parse软件开发工程师与数据科学家在构建RAG系统时,当需处理PDF/Word/Excel等多格式复杂文档,用此技能可自动触发三级解析降级,一键输出高置信度结构化Markdown与元数据,免去繁琐清洗,直接夯实企业知识库数据底座!
- Aantinet-four-color-cards财务和投资分析师、律师助理与法律助手在撰写金融研报或分析法律文档时,必用此技能!基于解析文档一键生成事实蓝卡、解释绿卡、风险黄卡与行动红卡。自动完成深度剖析与风险排查,产出100%可溯源的结构化四色报告,让复杂分析高效且严谨。
- Aantinet-provenance软件开发工程师与信息安全分析师在构建多智能体系统时,当需全链路可观测与安全审计,请用此技能。它自动收集操作日志,生成可追溯证据链与向量索引,开箱即用实现系统审计与精准回放,让Agent运行安全透明。
- Aantinet-security-scan信息安全分析师与软件开发工程师在搭建文档处理流水线时,当需要拦截违规文件或外部URL,请挂载此技能作为强制前置安检,自动输出 pass/reject 判定与详细合规扫描报告,一键守住零信任安全底线。
- AarchifyCreate polished, validated architecture, workflow, sequence, data-flow, and lifecycle/state diagrams as explorable standalone HTML with inline SVG, dark/light themes, optional trace motion, and PNG/JPEG/WebP/SVG/WebM export. Accept plain-language requirements or pasted Mermaid flowchart, sequenceDiagram, and stateDiagram input; inspect repository evidence when the diagram must reflect real code. Use when the user asks to visualize system architecture, infrastructure, cloud/security/network topology, technical workflows, API call sequences, request lifecycles, data pipelines, ETL/ELT, data lineage, state machines, or to convert/beautify Mermaid.
- Aarticle-illustrator内容创作者与自媒体创作者在撰写长文缺乏视觉辅助时,当需要给文章配图或生成插图请使用。自动分析文章结构,精准识别位置并生成插画插入段落,将抽象概念具象化。一键完成智能图文排版,省去手动找图时间,大幅提升阅读体验!
- Aarticle-illustrator内容创作者和自媒体创作者在撰写长文时,当需要“给文章配图”或“添加插图”时使用。自动分析文章结构,精准识别需要视觉辅助的位置,生成并插入契合语境的插画,将抽象概念具象化,一键完成高质量图文排版,大幅提升阅读体验。
- Aatutun-xhs-cover阿囤囤风格小红书封面提示词生成。用于AI工具、效率方法、产品测评、教程部署、个人经验、播客推荐、职场认知类内容的爆款竖版封面设计。特点是真人出镜、超大柔和浅黄(#FDFFA7)/白色中文标题、粗黑描边、人物抠图描边、绿色勾选清单、emoji贴纸、箭头标注、高对比高密度构图。关键词:小红书封面、爆款封面、阿囤囤风格、AI教程封面、产品测评封面、封面提示词。
- Abaoyu-format-markdown技术写作员与内容创作者在处理纯文本或 Markdown 稿件时,若需优化文章结构、添加 frontmatter 或自动修正中英文排版间距,使用此技能可一键生成专业美观的 {filename}-formatted.md 文件,让文档排版更完美。