资讯详情

garden-skills gpt-image-2 技能实战:用结构化 JSON 模板生成动漫 Key Visual 主视觉图

📅 2026/10/3 2:21:42 | 华诺云谱 👁 阅读
garden-skills gpt-image-2 技能实战:用结构化 JSON 模板生成动漫 Key Visual 主视觉图
人工智能AI 技能/插件提示工程【免费下载链接】garden-skillsConardLis open-source Skills collection, featuring web design, knowledge retrieval, image generation, and more.项目地址https://gitcode.com/GitHub_Trending/we/garden-skills点击查看免费下载导读本文围绕garden-skills仓库中gpt-image-2技能的分镜叙事模板 anime-key-visual.md 展开系统讲解如何用一张图承载整部作品的动漫主视觉Key Visual从适用场景判定、缺失信息提问顺序、主模板 JSON 结构、参数策略到三种实用变体并延伸到仓库源码层的渲染与执行链路。读完本文你将掌握一套可直接复制运行的动漫 KV / 轻小说封面 / 游戏卡面提示词工程方法以及它在 Garden 本地生图Mode A与宿主委托Mode B / C两种工作流中的落地方式。一、模板定位什么是动漫 Key Visual 单图在gpt-image-2技能的分层模板体系中anime-key-visual.md 属于references/storyboards-and-sequences/分镜与叙事序列分类下的一个单模板文件。它的核心哲学是一张图代表整部作品——把所有世界观、角色关系、氛围浓缩进一个强叙事的单画面里。它面向的具体产出物包括动漫 KV / 主视觉轻小说封面同人志封面动漫海报游戏卡牌主图不含 UI该模板的典型视觉特征可以概括为五条特征说明画面密度一张图聚集多个角色或单角色 极强氛围构图与灯光戏剧性构图、戏剧性灯光画风anime / 半写实风格比例通常竖版3:4或4:5版面必须预留 title 位标题安全区值得注意的是整个references/体系由方法论总文档 prompt-writing.md 统摄它定义了一级分类目录 二级单模板 Markdown 文件的目录规则并规定每个模板文件必须包含「适用范围 / 何时使用 / 提问顺序 / 主模板 / 参数策略 / 自动补全策略 / 变体 / 避免事项」。anime-key-visual.md 正是这一标准的忠实实现也是理解整套模板体系的最佳样本之一。二、何时使用与相邻模板的边界判定模板明确给出了使用与不要使用两条判定线这也是做模板路由template routing时的关键决策依据。使用条件满足其一即可命中本模板用户提到动漫 KV / anime 主视觉 / 轻小说封面 / IP 海报用户希望一张图就能讲完世界观用户希望 anime 风格的高完成度大图不要使用需改路由到同分类或相邻分类的其它模板场景应改用模板多分镜叙事一页多格讲故事manga-spread-page.md4 格段子 / 反转漫画four-panel-comic.md真实人物大片founder-portrait.md电影级概念大场景无角色主角化、重场景concept-scene.md这一边界表设计在技能层面非常重要SKILL.md 要求 Agent「按任务类型只读取最贴近的具体模板文件不要一次性全读整个 references/」因此正确的路由判定直接决定了出图质量。三、信息采集缺失信息优先提问顺序KV 是信息高度浓缩的产物缺任何一个关键维度都会让画面失真。模板给出了严格的提问优先级Agent 在渲染 prompt 之前必须按此顺序澄清作品 / 主题——这是 KV 的灵魂缺失时画面没有叙事锚点主角形象数量 关系——决定构图的角色权重分配世界观 / 时代 / 氛围——决定场景、色调与情绪基调风格现代 anime / 90s anime / 半写实是否需要 title 位——决定是否预留标题安全区比例——竖版 KV 通常3:4/4:5这里遵循 prompt-writing.md 的提问总原则精准、少量、只围绕模板关键字段不要泛泛而问。例如不要问你想要什么感觉而应直接问作品主题是什么主角有几位、彼此是什么关系。同时要遵循「能合并的问题尽量一次问完」的用户输入工具规则见 SKILL.md 的用户输入工具章节避免反复打断用户。四、主模板拆解动漫 Key Visual 单图的 JSON 结构模板的核心是一份完整的 JSON 提示词结构模板。需要强调这份 JSON 是提示词结构模板不是 API 请求体模板SKILL.md 的重要约束明确说明最终交给图像模型的始终是渲染后的 prompt 字符串。它本质上把 KV 的所有决定因素显式声明出来让模型没有自由发挥的空间。完整主模板如下含默认值可直接运行{ type: 动漫 Key Visual, goal: 生成一张可作为动漫 / 轻小说 / IP 主视觉的单图, ip: { title: {argument name\ip title\ default\霜白幻想曲\}, tagline: {argument name\tagline\ default\这场雪下了一千年\} }, characters: { count: {argument name\character count\ default\3\}, items: [ {argument name\character 1\ default\少女主角银白长发蓝瞳雪白连衣裙\}, {argument name\character 2\ default\剑士同伴黑发战甲\}, {argument name\character 3\ default\小动物伙伴雪白狐狸\} ], composition_relationship: {argument name\composition\ default\主角居中同伴左右护卫动物在脚边\} }, world: { scene: {argument name\scene\ default\冰封城市远景城堡飘落雪花\}, lighting: {argument name\lighting\ default\冷蓝主光 暖金边缘光\}, atmosphere: {argument name\atmosphere\ default\史诗、孤独、坚定\} }, style: { art_style: {argument name\art style\ default\现代 anime 半写实 厚涂背景\}, color_palette: {argument name\color palette\ default\冰蓝 月白 暖金\} }, title_block: { enabled: {argument name\title block enabled\ default\true\}, main_title: {argument name\main title\ default\霜白幻想曲\}, sub_title: {argument name\sub title\ default\FROZEN FANTASIA\}, position: {argument name\title position\ default\画面顶部居中\} }, aspect_ratio: {argument name\aspect ratio\ default\3:4\}, constraints: { must_keep: [ 主角作为绝对视觉中心, 灯光方向统一, 色板严格统一, 标题与主角不重叠 ], avoid: [ 角色塞太多导致脸部小到不可识别, 背景过亮淹没角色, 色板出现额外鲜艳色, 标题字体过多种类 ] } }4.1 字段职责与设计意图对照 prompt-writing.md 推荐的通用骨架type / goal / subject / scene / layout / style / details / constraintsKV 模板把subject细化成了ip characters把scene细化成了world并新增了 KV 专属的title_block。各字段职责如下type模板类型名动漫 Key Visual用于模型理解这是一张 KV 而非其它类型画面。goal图像用途声明直接写明可作为动漫 / 轻小说 / IP 主视觉避免模型画出插图感而非海报感的画面。ip作品名 宣传语tagline。tagline 是 KV 情绪浓度的重要来源如默认的这场雪下了一千年。characters角色数量、逐个形象清单与构图关系。composition_relationship是 KV 与普通插画的关键分野——它把谁在画面什么位置、谁是谁的衬托显式写死。world场景 灯光 氛围三段式。注意灯光被单列为一个字段这是 KV戏剧性灯光特征的直接落实。style画风 色板。KV 的色板要求严格统一通常控制在 34 种主色以内。title_block是否启用 title 位、主标题、副标题、位置。这是 KV 区别于概念插画的功能性标志。aspect_ratio竖版 KV 默认3:4。constraintsmust_keep必须出现与avoid必须避免双列表是通用骨架中constraints字段职责的具体实现。4.2 参数策略必问 / 可默认 / 可随机模板把每个字段按 prompt-writing.md 的参数三分法标注类别本模板字段说明必问缺失显著影响结果作品名、主角、世界观信息不足时按缺失信息优先提问顺序主动澄清可默认缺失可用默认值风格、配色、标题位默认值已给出可直接工作的参数可随机可自动补全背景细节仅在风格范围内合理生成不破坏主体一致性4.3 自动补全策略当用户明确表示你来补全 / 随机生成 / 先给我一个 demo时prompt-writing.md 第九节的触发条件模板允许只问最关键的 12 个问题其余走默认主角数默认 13 人——超过 3 人自动切换群像构图思路世界观 → 自动决定配色冷世界 蓝白 / 末世 焦土棕 / 校园 暖橙。这条主题 → 配色映射与 concept-scene.md 的自动补全策略赛博 霓虹 / 武侠 水墨 / 末世 焦土棕 / 太空 深紫是同一套设计语言默认竖版3:4五、三个变体从单角色强氛围到群像与自动补全主模板覆盖大多数场景变体则在主模板结构上做少量字段调整prompt-writing.md 第十节规定变体不应完全脱离主模板。5.1 变体 1单角色 极强氛围 KV适合个人主角、情绪浓度极高的主视觉如角色个人 PV、小说单行本封面。核心是把角色压到 1 个把氛围词提到最高优先级{ type: 单角色 强氛围 KV, characters: { count: 1, items: [{argument name\character\ default\长发少女逆光\}] }, world: { atmosphere: 孤独 神秘 }, constraints: { must_feel: 电影海报感 } }注意这里使用了must_feel而非主模板的must_keep——变体可以按需引入额外约束键只要不推翻主模板的骨架。5.2 变体 2群像 KV5 角色适合动画首播主图、团队 IP 集结海报。构图上采用金字塔式层级{ type: 群像 KV, characters: { count: 6, composition_relationship: 金字塔构图主角顶 配角围绕 }, constraints: { must_feel: 团队感、史诗、可作为动画首播主图 } }5.3 变体 3自动补全模式用户只给一句作品概念其余全部自动决定{ type: 动漫 KV 自动补全, mode: auto-fill, rule: 用户给一句作品概念自动决定主角、构图、世界观、标题, constraints: { must_feel: 可直接首发 } }mode: auto-fill是整套模板体系统一的自动补全标记同类用法也出现在 four-panel-comic.md、manga-spread-page.md 等模板中属于可跨模板复用的约定。六、避免事项KV 最常见的翻车点模板末尾给出了一份失败模式清单这些是渲染 KV 时必须写进avoid约束或人工把关的红线不要让角色数量超过 7——超过 7 个角色画面中个体脸部会小到无法识别主视觉立刻失去主角感不要让灯光方向不统一——多光源、方向混乱会毁掉 KV 的戏剧性不要让标题盖在主角脸上——title 位必须与主角错开不要使用超过 4 种主色——色板一旦突破 4 色统一感就会被稀释不要让背景细节超过角色细节量——背景是衬托不是主角细节量必须让位给角色这五条与主模板constraints.avoid中的角色塞太多 / 背景过亮 / 额外鲜艳色 / 标题字体过多互为补充构成 KV 出图质量的硬性校验标准。七、源码级落地从 JSON 模板到最终图片的执行链路模板本身是提示词工程资产真正的出图能力由gpt-image-2技能的脚本层承担。理解这条链路KV 模板才能真正跑起来。7.1 三种运行模式做任何任务前先判定SKILL.md 明确要求第一步必须先确定当前运行模式用轻量探测脚本node skills/gpt-image-2/scripts/check-mode.js # 拿结构化结果给上层程序用 node skills/gpt-image-2/scripts/check-mode.js --json三种模式的判定条件与行为差异条件模式是否调用脚本prompt 落盘图片落盘ENABLE_GARDEN_IMAGEGEN为真且有OPENAI_API_KEYAGarden 本地生图✅generate.js/edit.js✅ 自动✅ 自动ENABLE_GARDEN_IMAGEGEN1但没 KEYA?❌先要 KEY——未启用 Garden且宿主有图像工具BHost-Native 委托❌用宿主工具可选由宿主决定未启用 Garden且宿主无图像工具CAdvisor 顾问❌✅ 必须❌无法Mode A完整跑通选模板 → 填字段 → 渲染 prompt → 调脚本 → 出图落盘是唯一真正持有图像工具的端到端模式。Mode B技能退化为提示词工程指引把渲染好的 prompt 直接传给宿主自带的image_generation/dalle/nano_banana/ 图像 MCP 等工具。Mode C技能退化为高质量 prompt 顾问只产出可复用的 prompt 文本不能假装出图成功。7.2 Mode A 下的生图命令在 Mode A 下渲染好的 KV prompt 可以通过以下两种方式喂给生成脚本方式一直接传文本 prompt适用于短 promptnode skills/gpt-image-2/scripts/generate.js \ --prompt 动漫 Key Visual冰蓝月白色调竖版 3:4预留顶部标题位…… \ --size 1024x1536 \ --quality high方式二用提示词文件推荐KV prompt 较长且需版本管理node skills/gpt-image-2/scripts/generate.js \ --promptfile garden-gpt-image-2/prompt/anime-kv-20260424-153045.md脚本的完整参数可见 generate.js 的 help 输出--model、--size、--n、--qualityauto | high | medium | low、--backgroundtransparent | opaque | auto、--moderationlow | auto、--output-formatpng | jpeg | webp、--output-compression0100等。从 generate.js 的run()可以看到完整调用链loadAmbientEnv()按process.env→cwd/.env→cwd/.gateway.env→~/.gateway.env的顺序加载环境变量shared.jsreadPromptInput()读取--prompt或--promptfile内容savePrompt()把最终 prompt 落盘到garden-gpt-image-2/prompt/task-slug-timestamp.mdbuildPayload()组装请求体其中model优先级为 CLI 参数 OPENAI_IMAGE_MODEL 默认gpt-image-2shared.jspostJson()向{OPENAI_BASE_URL 或 https://api.openai.com/v1}/images/generations发起 POSTshared.jsextractGeneratedBytes()优先解析data[0].b64_json兼容data[0].urlshared.jssaveImage()落盘到garden-gpt-image-2/image/task-slug-timestamp.png7.3 环境变量KV 生图前需要配好的东西变量是否必需说明ENABLE_GARDEN_IMAGEGENMode A模式开关取1/true/yes/on时启用 Mode AOPENAI_API_KEYMode A实际调用图像 API 必需OPENAI_BASE_URL可选默认https://api.openai.com/v1可指向任意 OpenAI 兼容网关OPENAI_IMAGE_MODEL可选默认gpt-image-2可换成gpt-image-1/dall-e-3等网关支持的型号值得注意的是整个技能默认实现按 OpenAI 兼容接口工作不写死任何第三方网关SKILL.mdKV prompt 的渲染与模型选择因此完全解耦。7.4 输出约定与命名规则除非用户显式指定所有产物按以下约定落盘提示词garden-gpt-image-2/prompt/task-slug-timestamp.md图片garden-gpt-image-2/image/task-slug-timestamp.png其中task-slug由任务语义自动提取如anime-kvtimestamp形如20260424-153045。命名与目录创建逻辑实现在 shared.js 的buildDefaultImagePath/buildDefaultPromptPath/savePrompt中。KV 任务跑完后Agent 应按 SKILL.md 的要求用一句话向用户交代当前是什么模式、prompt 落在哪、图如有落在哪。八、实战流程一次完整的动漫 KV 生成把以上所有部分串起来一次完整的 KV 生成遵循 SKILL.md 定义的模式感知工作流前 6 步三模式共用第 7 步按模式分叉跑check-mode.js确定模式A / B / C判断任务类型这是生图任务生成动漫 KV不是改图路由到分类storyboards-and-sequences→anime-key-visual.md只读该模板文件不读整个references/按 JSON 模板渲染命中主模板的{argument ...}参数default标记的字段可用默认值澄清关键信息按作品名 → 主角 → 世界观 → 风格 → title 位 → 比例顺序只问缺失且显著影响结果的项目如作品主题是什么主角有几位按模式分叉出图Mode Aprompt 落盘garden-gpt-image-2/prompt/调用node skills/gpt-image-2/scripts/generate.js --promptfile ...Mode B把渲染好的 prompt 传给宿主图像工具Mode Cprompt 落盘后直接展示给用户附如何使用建议一句话汇报模式、prompt 路径、图片路径九、总结anime-key-visual.md是一个结构完整、可直接落地的单图主视觉提示词模板它通过ip / characters / world / style / title_block / constraints六组字段把一张图讲完一部作品的所有决定性因素显式化通过必问 / 可默认 / 可随机的参数策略控制信息采集成本通过单角色强氛围、群像、自动补全三个变体覆盖从个人 PV 到动画首播主图的不同强度需求最后用五条避免事项守住 KV 出图质量的底线。把它放进 gpt-image-2 的三模式工作流中再配合 generate.js 与 shared.js 的调用链即可完成从一句用户需求到一张落盘 KV 图的完整闭环。如果你想在同一主题上扩展能力边界可以继续阅读同一分类下的 manga-spread-page.md多分镜叙事页与 four-panel-comic.md4 格段子漫画以及方法论总文档 prompt-writing.mdJSON 模板设计规范。赞分享人工智能AI 技能/插件提示工程【免费下载链接】garden-skillsConardLis open-source Skills collection, featuring web design, knowledge retrieval, image generation, and more.项目地址https://gitcode.com/GitHub_Trending/we/garden-skills点击查看免费下载相关推荐garden-skills gpt-image-2 概念场景模板实战用结构化 JSON 生成电影感 Key Art 大场景garden skills gpt image 2 概念场景模板实战用结构化 JSON 生成电影感 Key Art 大场景 本指南围绕 garden skil人工智能AI 技能/插件提示工程garden-skills 的 gpt-image-2 技能四格漫画结构化提示词模板实战指南garden skills 的 gpt image 2 技能四格漫画结构化提示词模板实战指南 四格漫画是自媒体内容创作、反转段子与讽刺广告中最常见、也最容易翻人工智能AI 技能/插件提示工程gpt-image-2 技能之 Campaign Key Visual 模板用一份 JSON 生成可延展成系列的 campaign 主视觉系统gpt image 2 技能之 Campaign Key Visual 模板用一份 JSON 生成可延展成系列的 campaign 主视觉系统 导读 本文讲解人工智能AI 技能/插件提示工程上一篇fre:ac音频转换器你的免费数字音乐管家终极指南下一篇FaceNet Center Loss解析一招提升人脸特征的判别力创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。

↑