Claude Skill

creative-scene

从零创意生图,也可定向改模特、姿势、搭配。一句描述(可选参考图)→ 图。当用户说「创意生图」「生成一张」「改个姿势」「换模板」「随便来张图」时使用。

LLM Mart · 0 points · 0 views 0 listing impressions 0 install-command copies
Virus-scanned Reviewed automatically before listing.

Full trust report

Download dlazy-ai-ecommerce-skills-skills_creative-scene-c022f20.zip · 23 KB
Part of dlazy-ai/ecommerce-skills — 26 skills

Install

skills CLI npx skills add https://github.com/dlazy-ai/ecommerce-skills/tree/main/skills/creative-scene
Claude Code claude plugin marketplace add https://llmmart.ai/marketplace.json && claude plugin install dlazy-ai-ecommerce-skills@llmmart
Git git clone https://github.com/dlazy-ai/ecommerce-skills.git

The skills CLI installs just this skill, for any of its supported agents. Claude Code installs the whole dlazy-ai/ecommerce-skills collection as a plugin from our marketplace. Git is the plain clone.

Skill manifest

creative-scene — 输入想象中的画面自由创作图片

一句话造一张图。没有素材也能开工——描述人物、穿着、场景、视角,直接出图。

本技能同时收录了一套可直接复制的指令模板:改模特、改姿势、改搭配——这些是所有其他技能的通用零件。


生成效果示例

本技能不需要输入素材——只有一句描述。

实际执行的命令:

dlazy banana-pro \
  --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
  --aspectRatio 3:4 --imageSize 2K \
  --save docs/creative-scene/example-output.jpg

对应的五槽位拆解:

槽位 内容
人物 a long-haired young Asian woman
穿着 white puff-sleeve lace midi dress
场景 marble table inside a French-style cafe, fresh flowers and pastries
视角/景别 front three-quarter view, waist-up framing
氛围/影调 warm white colour grading, soft window light, atmospheric editorial

输出

example-output.jpg — 3:4 / 2K,18 credits。人物、穿着、法式咖啡馆场景、三分之三正面半身景别与暖白影调全部按描述落位。

这张图可以直接作为后续定向修改的输入——例如接 把模特的上衣变成黑色高领修身打底衫,保持其他不变 换搭配。


1、能力边界

模式 说明
纯文生图 只给描述,凭空造图
参考图 + 描述 带一张图做定向修改(改模特 / 改姿势 / 改搭配)
词库分类 说明
室内 / 室外 / 居家 / 街道 场景类
半身 / 全身 / 特写 景别类
场景图 完整场景氛围
改模特 / 改姿势 / 改搭配 定向修改类(见第三节)

不做:不生成特定真人的肖像;不生成未成年人的不当内容;不用于伪造商品实拍与使用体验。


2、描述公式

官方给的参考形式是:人物 + 穿着,场景氛围,图片视角。

一个长发小女孩穿灰色打底裤和长款羽绒服白色雪地靴,咖啡店圣诞,全身正面
 └── 人物 ──┘└──────── 穿着 ────────┘  └── 场景 ──┘ └─ 视角 ─┘

拆成五个槽位,缺哪个补哪个:

槽位 例子
人物 长发女生 卷毛非洲小女孩 35 岁商务男性 混血模特
穿着 白色泡泡袖蕾丝连衣裙 军绿麻花毛衣 + 米白阔腿裤 + 白色运动鞋
场景 法式装修风的咖啡店内,鲜花布置 新疆草原,身后有草原动物 T台走秀
视角/景别 全身正面 半身侧面 下半身图 颈部特写 半身背面转头
氛围/影调 明亮的暖白色调,氛围感 复古色调,写真 冷色光,明亮色调

电商向的经验:写真、氛围感、明亮的暖白色调 这类词能显著提升出图的商业可用度;全身正面 / 半身侧面 这类明确的景别词能大幅降低构图返工。


3、三类定向修改模板(可直接复制)

带参考图时,用下面的句式做定向修改。共同点:都以「保持其余不变」结尾——这是不跑偏的关键。

改模特

将主体改为一个[年龄]岁的[种族][性别][职业类型]模特,她/他有着[五官特征]、[发型]、[肤色]。
保持相同的服装、姿势和背景。

细分维度也可以单独改:

维度 模板
肤色 将肤色改为[浅色/浅桃色/温暖的香槟色/蜜色/可可色]。保持原有的面部结构、种族特征、所有面部特征的大小和位置、身体姿态、体型以及光照条件完全不变。
身材 将身材改为[苗条/丰满/稍微丰满/肌肉型]。保持主体完全不变,只改变身材。
发型 将发型改为[双麻花辫/凌乱的丸子头/长发大波浪/低马尾/精灵短发/寸头/背头]。保持角色与背景的一致性,同时保留相同的面部特征、姿势和表情。
五官 将[瞳孔颜色/唇色/眉毛/睫毛/腮红]改为[具体描述]。保持角色与背景的一致性,同时保留相同的姿势和表情。

改姿势

将姿势改为[姿势描述]。保持完全相同的拍摄角度、面部结构、肤色和体型。

常用姿势:正面站立,双臂自然下垂 / 以自然的步伐朝相机方向走来 / 侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓 / 背对镜头站立,回头看向肩膀 / 像模特一样走在T台中间的步伐,一脚向前并扭动臀部 / 坐在地板上,向后倾,用双手在身后支撑身体

改搭配

把模特的[上衣/下装/鞋子/配饰]变成[具体描述],保持其他不变

例:把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变 / 把模特的鞋子变成深棕色8孔马丁靴,硬朗帅气风,保持其他不变


4、工具调用

本技能使用 dLazy 的 banana-pro(高质量文生图模型,可选带参考图;擅长细节主视觉、商品图与品牌风格图像,适合从零造图这一主场景)。

调用方式

两种等价写法,选一种。统一入口会自动选后端、失败重试、建目录落盘、估算成本:

# A. 统一入口(推荐):可切任意后端,加 --dry-run 不计费空跑
node scripts/gen.mjs --task creative-scene \
  --prompt '<见下方 Prompt 模板>' \
  --images <按下表顺序> \
  --save output/creative-scene-<sku>.jpg

# B. 直接用 dLazy CLI(不想引入 Node 依赖时,效果等价)
dlazy banana-pro --prompt '...' --images ... --save output/creative-scene.jpg

参数约定(本技能固定用法)

参数 取值 理由
--images 留空(纯文生图)/ [参考图](定向修改,最多 14 张) 改模特/姿势/搭配时才需要
--aspectRatio 3:4(电商与种草竖版)/ 1:1 / 9:16(短视频封面) 电商竖版为主
--imageSize 1K 草稿探索 / 2K 上架 / 4K 大图与印刷 探索阶段用 1K 省成本
--batch 4(探索期)/ 1(已定稿) 文生图靠量取优
--save docs/creative-scene/output-<主题>.jpg 按主题归档

英文 vs 中文 prompt:场景与氛围类描述中英文都可以;但服装的材质与工艺细节用英文更稳定。定向修改模板用中文即可(第四节的句式实测有效)。

Command Examples

# basic call: 纯文生图
dlazy banana-pro \
  --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, photorealistic, no text.' \
  --aspectRatio 3:4 --imageSize 2K

# complex call: 探索期一次出 4 张 1K 草稿,定稿后再出 2K
dlazy banana-pro \
  --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
  --aspectRatio 3:4 --imageSize 1K \
  --batch 4 --save docs/creative-scene/draft.jpg

# 定向修改:改姿势(带参考图)
dlazy banana-pro \
  --prompt '将姿势改为侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓。保持完全相同的拍摄角度、面部结构、肤色和体型。' \
  --images docs/creative-scene/example-output.jpg \
  --aspectRatio 3:4 --imageSize 2K \
  --save docs/creative-scene/output-pose-side.jpg

# 定向修改:改搭配
dlazy banana-pro \
  --prompt '把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变。' \
  --images docs/creative-scene/example-output.jpg \
  --aspectRatio 3:4 --imageSize 2K \
  --save docs/creative-scene/output-swap-top.jpg

# 先估价不真跑
dlazy banana-pro --dry-run --prompt '...' --aspectRatio 3:4 --imageSize 2K

延伸阅读

要查什么 去哪
认证、多后端配置、输出结构、错误码 references/provider-cli.md
banana-pro 的全部可用参数 references/model-flags.md
统一入口的全部选项 node scripts/gen.mjs --help

5、Prompt 模板

纯文生图(五槽位公式):

[人物],穿着[穿着描述],在[场景描述],[视角/景别],[氛围/影调],
photorealistic, [镜头语言:shot on 85mm, shallow depth of field], no text, no watermark

定向修改(三类模板见第四节):

[改模特 / 改姿势 / 改搭配 的句式]。保持[其余要素]完全不变。

按问题追加的修正句

问题 追加到 prompt 末尾
构图不对(要全身给了半身) 把景别词放到 prompt 靠前位置,并追加 full-body framing, head to feet fully in frame
出图太像插画 photorealistic photograph, real fabric texture, natural skin pores, no illustration, no CGI
手部崩坏 hands anatomically correct, five distinct fingers, natural knuckles
服装细节不受控 服装描述改用英文,并写死颜色 / 面料 / 版型 / 领口
定向修改把别的也改了 把「保持其余不变」写得更具体:逐项列出不许动的东西
一组图风格不统一 固定氛围段与镜头语言段逐字不变,只换人物/场景

6、执行流程

  1. 判断模式:从零造图 → 纯文生图;已有图要改 → 带参考图 + 第四节模板。
  2. 按五槽位写描述:人物 / 穿着 / 场景 / 视角 / 氛围,缺一个就补一个。
  3. 探索期 --imageSize 1K --batch 4 快速看方向,成本最低。
  4. 定稿后 --imageSize 2K 出正式图。
  5. 要连续改(先定人,再改姿势,再改搭配):把上一步的输出作为下一步的 --images,每步只改一个维度。
  6. 质检:构图景别对不对、是否够真实、手部、服装细节是否受控。
  7. 要上架的图建议过一遍 detect-task 做投前检测。

7、常见问题

现象 原因 处理
要全身却出了半身 景别词位置太后 景别词提前 + 追加 head to feet fully in frame
出图像插画/CG 缺真实性约束 追加 photorealistic + 真实纹理句
服装细节完全不受控 描述太笼统或用中文写材质 服装段改英文,写死颜色/面料/版型/领口
手指崩坏 生成随机性 追加修手句 + --batch 4 挑图
定向修改改动过大 「保持不变」写得太笼统 逐项列出不许动的要素
一组图风格不统一 氛围段每次都改 固定氛围段与镜头语言段
成本超预期 一直用 2K/4K 探索 探索用 1K + --batch 4,定稿再 2K

Tips

Visit https://dlazy.com for more information.

Files (ecommerce-skills)
  • examples
    • brand.yaml 1.6 KB
      # ⚠️ 由 scripts/build-skills.mjs 从 shared/examples/brand.yaml 同步生成,不要直接改这里。
      # 店铺品牌视觉规范 —— 所有生图技能读这一份,保证几百个 SKU 看起来像同一家店。
      #   node scripts/brand.mjs --brand brand.yaml --for flat-lay
      #   node scripts/gen.mjs --task flat-lay --brand brand.yaml --prompt '...'
      
      brand:
        name: 示例品牌
        # 一句话概括调性,会原样进 prompt
        tone: quiet minimalist, warm and lived-in, never glossy or commercial
      
      model:
        # 锁模特:给一张脸的参考图,所有技能都会把它作为最后一张参考图传入
        reference: assets/model/face-a.jpg
        description: East Asian woman, late twenties, natural makeup, shoulder-length black hair
        body: slim, height around 168cm
      
      photography:
        background: seamless off-white studio backdrop, RGB 248 248 246
        lighting: soft large softbox from camera left, gentle fill, no hard shadows
        camera: 85mm equivalent, eye level, shallow depth of field
        grade: neutral white balance around 5200K, low contrast, slightly lifted blacks
        crop: full body with headroom, product centered
      
      layout:
        # 给带排版的技能(主图 / 详情页)用
        margin: at least 8% empty margin on all sides
        typeface: clean sans-serif, no decorative fonts
        text_color: near-black on light background
      
      forbid:
        - no visible brand logos other than the product's own
        - no text or watermark
        - no exaggerated poses or dramatic wind effects
        - no oversaturated colors
      
      # 可选:把这些直接写进合规目标,生成时就按平台要求出图
      compliance:
        platform: amazon
      
  • references
    • model-flags.md 1.9 KB
      # `banana-pro` 参数清单
      
      本技能默认用的模型的完整参数。日常只需要「参数约定」里那几个,
      这份清单在需要用到非常规参数时再看。
      
      **CRITICAL INSTRUCTION FOR AGENT**:
      Run the `dlazy banana-pro` command to get results.
      
      ```bash
      dlazy banana-pro -h
      
      Options:
        --prompt <prompt>            Prompt
        --images [images...]         Images [image: url or local path] (max 14)
        --aspectRatio <aspectRatio>  Aspect Ratio [default: auto] (choices: "auto",
                                     "1:1", "4:3", "3:4", "16:9", "9:16", "21:9")
        --imageSize <imageSize>      Image Size [default: 1K] (choices: "1K", "2K",
                                     "4K")
        --dry-run                    Print payload without executing the tool
        --no-wait                    Return generateId immediately for async tasks
        --timeout <seconds>          Max seconds to wait for async completion
                                     (default: "1800")
        --input <jsonOrFile>         Inline JSON or @path/to/file.json — merged under
                                     flag values (flags win)
        --save <path>                Download the result asset to this local path
                                     (mkdir + retry handled for you). A destination
                                     path — NOT a response format; for stdout shape
                                     use --format
        --batch <n>                  Fan-out N parallel runs (cloud tools only)
                                     (default: "1")
        -h, --help                   display help for command
      ```
      
      > Any flag also accepts pipe references — `-` (auto-pick from upstream stdin), `@N` (n-th output), `@N.path` (jsonpath into output), `@*` (all primary values), `@stdin` / `@stdin:path` (whole envelope). See `dlazy --help` for details.
      
      ---
      
      换其他后端时参数由 `scripts/gen.mjs` 统一翻译,见 [`provider-cli.md`](provider-cli.md)。
      
    • provider-cli.md 4.7 KB
      <!-- 由 scripts/build-skills.mjs 从 shared/references/provider-cli.md 同步生成,不要直接改这里。 -->
      # 后端调用参考
      
      技能正文只写「要生成什么」。认证、计费、错误码、输出结构这些每个技能都一样的东西放在这里,
      **用到时再读**,不占技能的常驻上下文。
      
      ---
      
      ## 一、认证
      
      ### 默认后端 dLazy
      
      ```bash
      dlazy login            # 设备码流程,远程 shell 也能用,自动写入本地配置
      dlazy auth set <KEY>   # 已有 key 时直接写入
      ```
      
      key 存在用户配置目录(macOS/Linux `~/.dlazy/config.json`,Windows `%USERPROFILE%\.dlazy\config.json`),
      权限限本机用户。也可以每次调用用环境变量 `DLAZY_API_KEY` 传入。
      
      手动获取:登录 [dlazy.com](https://dlazy.com) → [API Key 页面](https://dlazy.com/dashboard/organization/api-key)。
      key 按组织隔离,可随时轮换或吊销。
      
      ### 其他后端
      
      本技能库不锁定单一厂商。配好任意一家的 key 即可跑:
      
      | 后端 | 环境变量 | 说明 |
      | --- | --- | --- |
      | `dlazy` | `dlazy login` 或 `DLAZY_API_KEY` | 默认,最省事 |
      | `openai` | `OPENAI_API_KEY` | 走 `/v1/images/edits` 与 `/v1/images/generations` |
      | `gemini` | `GEMINI_API_KEY` | Nano Banana 系列 |
      | `fal` | `FAL_KEY` | |
      | `replicate` | `REPLICATE_API_TOKEN` | |
      | `ark` | `ARK_API_KEY` + `ARK_MODEL` | 火山方舟,模型 ID 需按开通情况填 |
      
      选路优先级:`--provider` 参数 > `PROVIDER` 环境变量 > 第一个配了 key 的 > `dlazy`。
      
      ```bash
      node scripts/gen.mjs --doctor     # 看当前哪个后端可用
      ```
      
      各后端的模型 ID 可用 `GEN_MODEL_OPENAI` / `GEN_MODEL_GEMINI` / `GEN_MODEL_FAL` /
      `GEN_MODEL_REPLICATE` / `GEN_MODEL_ARK` 覆盖。**厂商目录会变,以各家最新文档为准。**
      
      ---
      
      ## 二、两种调用方式
      
      ### 方式 A:统一入口(推荐)
      
      ```bash
      node scripts/gen.mjs --task <技能名> --prompt '...' --images a.jpg b.jpg --save out.jpg
      ```
      
      它负责:后端选路、默认尺寸档位、失败重试(429/5xx 指数退避)、落盘建目录、成本估算。
      
      ```bash
      node scripts/gen.mjs --task flat-lay --prompt '...' --dry-run   # 不调用不计费,只看要发什么
      node scripts/gen.mjs --help
      ```
      
      ### 方式 B:直接用 dLazy CLI
      
      不想引入 Node 依赖时,技能正文里的 `dlazy ...` 命令可以原样执行,效果等价。
      
      ```bash
      npx @dlazy/cli@1.2.3 <command>     # 不装全局二进制
      ```
      
      - CLI 源码:[github.com/dlazy-ai/cli](https://github.com/dlazy-ai/cli) · npm 包 `@dlazy/cli`
      
      ---
      
      ## 三、数据流向
      
      调用 dLazy 时:提示词与参数发往 `api.dlazy.com`;传入的本地图片会上传到 `files.dlazy.com`
      供模型读取;产出 URL 同样托管在 `files.dlazy.com`。这是云端生成 API 的通用形态。
      换成其他后端时,数据流向对应厂商,不经过 dLazy。
      
      ---
      
      ## 四、输出结构
      
      `gen.mjs`(加 `--json`):
      
      ```json
      {
        "ok": true,
        "task": "flat-lay",
        "provider": "dlazy",
        "model": "gpt-image-2",
        "files": ["docs/flat-lay/output-sku001.jpg"],
        "texts": [],
        "estimatedCredits": 60,
        "elapsedMs": 58213
      }
      ```
      
      dLazy CLI 原生:
      
      ```json
      {
        "ok": true,
        "result": {
          "tool": "gpt-image-2",
          "data": { "urls": ["https://files.dlazy.com/data/ai/....jpg"] },
          "savedPath": "docs/flat-lay/example-output.jpg"
        }
      }
      ```
      
      加 `--no-wait` 的异步任务不返回 `data`,返回 `task: { generateId, status }`,
      用 `dlazy status <generateId> --wait` 轮询。
      
      文本类模型(如质检)产出在 `result.data.texts[0]`:
      
      ```bash
      dlazy claude-sonnet-5 --prompt '...' --images x.jpg \
        | python3 -c 'import sys,json;print(json.load(sys.stdin)["result"]["data"]["texts"][0])'
      ```
      
      ---
      
      ## 五、错误处理
      
      | Code | 类型 | 示例 |
      | --- | --- | --- |
      | 401 | 未授权 / 无 key | `ok: false, code: "unauthorized"` |
      | 501 | 缺必填参数 | `error: required option '--prompt <prompt>' not specified` |
      | 502 | 本地文件读不到 | `Error: Image file not found: ...` |
      | 503 | 余额不足 | `ok: false, code: "insufficient_balance"` |
      | 503 | 服务端错误 | `HTTP status code error (500)` |
      | 504 | 异步任务失败 | `=== Generation Failed ===` / `Prompt violates safety policy` |
      
      **给 Agent 的硬性要求**
      
      1. 命中 `insufficient_balance` → 明确告诉用户算力不足,并给出充值入口
         <https://dlazy.com/dashboard/organization/settings?tab=credits>
      2. 命中 `unauthorized` / 缺 key → 告诉用户去 <https://dlazy.com/dashboard/organization/api-key>
         取 key,用 `dlazy auth set <key>` 存好再继续。
      3. 用 `gen.mjs` 时,429 与 5xx 已自动重试;仍失败才向用户报错。
      4. **不要**为了「跑通」而偷偷降级参数(尺寸、档位、批量),先问用户。
      
  • scripts
    • lib
      • miniyaml.mjs 2.8 KB · in bundle
      • providers.mjs 11.9 KB · in bundle
      • tasks.json 3.1 KB
        {
          "_note": "技能 → 默认模型与参数。dlazy 列为默认后端的模型名;其他后端走 providers.mjs 的通用映射,可用 GEN_MODEL_<PROVIDER> 覆盖。",
          "_credits": { "gpt-image-2": 60, "seedream-5.0": 30, "seedream-5.0-pro": 45, "banana-pro": 25, "claude-sonnet-5": 3 },
          "tasks": {
            "flat-lay":                { "model": "gpt-image-2",      "size": "1024x1536", "quality": "high",   "format": "jpeg" },
            "wear-everything":         { "model": "gpt-image-2",      "size": "1024x1536", "quality": "medium", "format": "jpeg" },
            "image-fusion":            { "model": "seedream-5.0",     "size": "3:4",       "resolution": "2k" },
            "one-shot":                { "model": "gpt-image-2",      "size": "1024x1536", "quality": "medium", "format": "jpeg" },
            "fission-pattern":         { "model": "gpt-image-2",      "size": "1024x1536", "quality": "medium", "format": "jpeg" },
            "item-detail":             { "model": "seedream-5.0-pro", "size": "3:4",       "resolution": "2k" },
            "creative-scene":          { "model": "banana-pro",       "size": "1024x1536", "format": "jpeg" },
            "batch-image":             { "model": "seedream-5.0",     "size": "3:4",       "resolution": "2k" },
            "to-3d":                   { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "clothing-extraction":     { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "fabric-on-body":          { "model": "gpt-image-2",      "size": "1024x1536", "quality": "high",   "format": "jpeg" },
            "clothing-detail":         { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "clothing-grass-planting": { "model": "gpt-image-2",      "size": "1024x1536", "quality": "medium", "format": "jpeg" },
            "item-selling-point":      { "model": "seedream-5.0-pro", "size": "1:1",       "resolution": "2k" },
            "item-change-background":  { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "remove-watermark":        { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "material-enhancement":    { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "item-repair":             { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "detect-task":             { "model": "claude-sonnet-5",  "text": true },
            "listing-optimizer":       { "model": "gpt-image-2",      "size": "1024x1024", "quality": "high",   "format": "jpeg" },
            "cross-border-localize":   { "model": "seedream-5.0-pro", "size": "1:1",       "resolution": "2k" },
            "brand-kit":               { "model": "gpt-image-2",      "size": "1024x1536", "quality": "high",   "format": "jpeg" },
            "platform-compliance":     { "model": "claude-sonnet-5",  "text": true },
            "main-image-video":        { "model": "$DLAZY_VIDEO_MODEL", "video": true },
            "product-video-ad":        { "model": "$DLAZY_VIDEO_MODEL", "video": true },
            "ugc-testimonial":         { "model": "$DLAZY_VIDEO_MODEL", "video": true }
          }
        }
        
    • brand.mjs 4.4 KB · in bundle
    • gen.mjs 9.3 KB · in bundle
  • skill.md 11.8 KB
    ---
    name: creative-scene
    description: 从零创意生图,也可定向改模特、姿势、搭配。一句描述(可选参考图)→ 图。当用户说「创意生图」「生成一张」「改个姿势」「换模板」「随便来张图」时使用。
    ---
    
    # creative-scene — 输入想象中的画面自由创作图片
    
    **一句话造一张图**。没有素材也能开工——描述人物、穿着、场景、视角,直接出图。
    
    本技能同时收录了一套**可直接复制的指令模板**:改模特、改姿势、改搭配——这些是所有其他技能的通用零件。
    
    ---
    
    ## 生成效果示例
    
    本技能不需要输入素材——只有一句描述。
    
    实际执行的命令:
    
    ```bash
    dlazy banana-pro \
      --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
      --aspectRatio 3:4 --imageSize 2K \
      --save docs/creative-scene/example-output.jpg
    ```
    
    对应的五槽位拆解:
    
    | 槽位 | 内容 |
    | --- | --- |
    | 人物 | `a long-haired young Asian woman` |
    | 穿着 | `white puff-sleeve lace midi dress` |
    | 场景 | `marble table inside a French-style cafe, fresh flowers and pastries` |
    | 视角/景别 | `front three-quarter view, waist-up framing` |
    | 氛围/影调 | `warm white colour grading, soft window light, atmospheric editorial` |
    
    **输出**
    
    <img src="../../docs/creative-scene/example-output.jpg" width="320">
    
    `example-output.jpg` — 3:4 / 2K,18 credits。人物、穿着、法式咖啡馆场景、三分之三正面半身景别与暖白影调全部按描述落位。
    
    这张图可以直接作为后续定向修改的输入——例如接 `把模特的上衣变成黑色高领修身打底衫,保持其他不变` 换搭配。
    
    ---
    
    ## 1、能力边界
    
    | 模式 | 说明 |
    | --- | --- |
    | 纯文生图 | 只给描述,凭空造图 |
    | 参考图 + 描述 | 带一张图做定向修改(改模特 / 改姿势 / 改搭配) |
    
    | 词库分类 | 说明 |
    | --- | --- |
    | 室内 / 室外 / 居家 / 街道 | 场景类 |
    | 半身 / 全身 / 特写 | 景别类 |
    | 场景图 | 完整场景氛围 |
    | 改模特 / 改姿势 / 改搭配 | 定向修改类(见第三节) |
    
    **不做**:不生成特定真人的肖像;不生成未成年人的不当内容;不用于伪造商品实拍与使用体验。
    
    ---
    
    ## 2、描述公式
    
    官方给的参考形式是:**人物 + 穿着,场景氛围,图片视角**。
    
    ```text
    一个长发小女孩穿灰色打底裤和长款羽绒服白色雪地靴,咖啡店圣诞,全身正面
     └── 人物 ──┘└──────── 穿着 ────────┘  └── 场景 ──┘ └─ 视角 ─┘
    ```
    
    拆成五个槽位,缺哪个补哪个:
    
    | 槽位 | 例子 |
    | --- | --- |
    | 人物 | `长发女生` `卷毛非洲小女孩` `35 岁商务男性` `混血模特` |
    | 穿着 | `白色泡泡袖蕾丝连衣裙` `军绿麻花毛衣 + 米白阔腿裤 + 白色运动鞋` |
    | 场景 | `法式装修风的咖啡店内,鲜花布置` `新疆草原,身后有草原动物` `T台走秀` |
    | 视角/景别 | `全身正面` `半身侧面` `下半身图` `颈部特写` `半身背面转头` |
    | 氛围/影调 | `明亮的暖白色调,氛围感` `复古色调,写真` `冷色光,明亮色调` |
    
    **电商向的经验**:`写真`、`氛围感`、`明亮的暖白色调` 这类词能显著提升出图的商业可用度;`全身正面` / `半身侧面` 这类明确的景别词能大幅降低构图返工。
    
    ---
    
    ## 3、三类定向修改模板(可直接复制)
    
    带参考图时,用下面的句式做定向修改。**共同点:都以「保持其余不变」结尾**——这是不跑偏的关键。
    
    **改模特**
    
    ```text
    将主体改为一个[年龄]岁的[种族][性别][职业类型]模特,她/他有着[五官特征]、[发型]、[肤色]。
    保持相同的服装、姿势和背景。
    ```
    
    细分维度也可以单独改:
    
    | 维度 | 模板 |
    | --- | --- |
    | 肤色 | `将肤色改为[浅色/浅桃色/温暖的香槟色/蜜色/可可色]。保持原有的面部结构、种族特征、所有面部特征的大小和位置、身体姿态、体型以及光照条件完全不变。` |
    | 身材 | `将身材改为[苗条/丰满/稍微丰满/肌肉型]。保持主体完全不变,只改变身材。` |
    | 发型 | `将发型改为[双麻花辫/凌乱的丸子头/长发大波浪/低马尾/精灵短发/寸头/背头]。保持角色与背景的一致性,同时保留相同的面部特征、姿势和表情。` |
    | 五官 | `将[瞳孔颜色/唇色/眉毛/睫毛/腮红]改为[具体描述]。保持角色与背景的一致性,同时保留相同的姿势和表情。` |
    
    **改姿势**
    
    ```text
    将姿势改为[姿势描述]。保持完全相同的拍摄角度、面部结构、肤色和体型。
    ```
    
    常用姿势:`正面站立,双臂自然下垂` / `以自然的步伐朝相机方向走来` / `侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓` / `背对镜头站立,回头看向肩膀` / `像模特一样走在T台中间的步伐,一脚向前并扭动臀部` / `坐在地板上,向后倾,用双手在身后支撑身体`
    
    **改搭配**
    
    ```text
    把模特的[上衣/下装/鞋子/配饰]变成[具体描述],保持其他不变
    ```
    
    例:`把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变` / `把模特的鞋子变成深棕色8孔马丁靴,硬朗帅气风,保持其他不变`
    
    ---
    
    ## 4、工具调用
    
    本技能使用 dLazy 的 **`banana-pro`**(高质量文生图模型,可选带参考图;擅长细节主视觉、商品图与品牌风格图像,适合从零造图这一主场景)。
    
    ### 调用方式
    
    两种等价写法,选一种。统一入口会自动选后端、失败重试、建目录落盘、估算成本:
    
    ```bash
    # A. 统一入口(推荐):可切任意后端,加 --dry-run 不计费空跑
    node scripts/gen.mjs --task creative-scene \
      --prompt '<见下方 Prompt 模板>' \
      --images <按下表顺序> \
      --save output/creative-scene-<sku>.jpg
    
    # B. 直接用 dLazy CLI(不想引入 Node 依赖时,效果等价)
    dlazy banana-pro --prompt '...' --images ... --save output/creative-scene.jpg
    ```
    
    **参数约定(本技能固定用法)**
    
    | 参数 | 取值 | 理由 |
    | --- | --- | --- |
    | `--images` | 留空(纯文生图)/ `[参考图]`(定向修改,最多 14 张) | 改模特/姿势/搭配时才需要 |
    | `--aspectRatio` | `3:4`(电商与种草竖版)/ `1:1` / `9:16`(短视频封面) | 电商竖版为主 |
    | `--imageSize` | `1K` 草稿探索 / `2K` 上架 / `4K` 大图与印刷 | 探索阶段用 1K 省成本 |
    | `--batch` | `4`(探索期)/ `1`(已定稿) | 文生图靠量取优 |
    | `--save` | `docs/creative-scene/output-<主题>.jpg` | 按主题归档 |
    
    > **英文 vs 中文 prompt**:场景与氛围类描述中英文都可以;但**服装的材质与工艺细节用英文更稳定**。定向修改模板用中文即可(第四节的句式实测有效)。
    
    ### Command Examples
    
    ```bash
    # basic call: 纯文生图
    dlazy banana-pro \
      --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, photorealistic, no text.' \
      --aspectRatio 3:4 --imageSize 2K
    
    # complex call: 探索期一次出 4 张 1K 草稿,定稿后再出 2K
    dlazy banana-pro \
      --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
      --aspectRatio 3:4 --imageSize 1K \
      --batch 4 --save docs/creative-scene/draft.jpg
    
    # 定向修改:改姿势(带参考图)
    dlazy banana-pro \
      --prompt '将姿势改为侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓。保持完全相同的拍摄角度、面部结构、肤色和体型。' \
      --images docs/creative-scene/example-output.jpg \
      --aspectRatio 3:4 --imageSize 2K \
      --save docs/creative-scene/output-pose-side.jpg
    
    # 定向修改:改搭配
    dlazy banana-pro \
      --prompt '把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变。' \
      --images docs/creative-scene/example-output.jpg \
      --aspectRatio 3:4 --imageSize 2K \
      --save docs/creative-scene/output-swap-top.jpg
    
    # 先估价不真跑
    dlazy banana-pro --dry-run --prompt '...' --aspectRatio 3:4 --imageSize 2K
    ```
    
    ### 延伸阅读
    
    | 要查什么 | 去哪 |
    | --- | --- |
    | 认证、多后端配置、输出结构、错误码 | [`references/provider-cli.md`](references/provider-cli.md) |
    | `banana-pro` 的全部可用参数 | [`references/model-flags.md`](references/model-flags.md) |
    | 统一入口的全部选项 | `node scripts/gen.mjs --help` |
    
    ## 5、Prompt 模板
    
    **纯文生图**(五槽位公式):
    
    ```text
    [人物],穿着[穿着描述],在[场景描述],[视角/景别],[氛围/影调],
    photorealistic, [镜头语言:shot on 85mm, shallow depth of field], no text, no watermark
    ```
    
    **定向修改**(三类模板见第四节):
    
    ```text
    [改模特 / 改姿势 / 改搭配 的句式]。保持[其余要素]完全不变。
    ```
    
    **按问题追加的修正句**
    
    | 问题 | 追加到 prompt 末尾 |
    | --- | --- |
    | 构图不对(要全身给了半身) | 把景别词放到 prompt 靠前位置,并追加 `full-body framing, head to feet fully in frame` |
    | 出图太像插画 | `photorealistic photograph, real fabric texture, natural skin pores, no illustration, no CGI` |
    | 手部崩坏 | `hands anatomically correct, five distinct fingers, natural knuckles` |
    | 服装细节不受控 | 服装描述改用英文,并写死颜色 / 面料 / 版型 / 领口 |
    | 定向修改把别的也改了 | 把「保持其余不变」写得更具体:逐项列出不许动的东西 |
    | 一组图风格不统一 | 固定氛围段与镜头语言段逐字不变,只换人物/场景 |
    
    ---
    
    ## 6、执行流程
    
    1. **判断模式**:从零造图 → 纯文生图;已有图要改 → 带参考图 + 第四节模板。
    2. **按五槽位写描述**:人物 / 穿着 / 场景 / 视角 / 氛围,缺一个就补一个。
    3. **探索期 `--imageSize 1K --batch 4`** 快速看方向,成本最低。
    4. **定稿后 `--imageSize 2K`** 出正式图。
    5. **要连续改**(先定人,再改姿势,再改搭配):把上一步的输出作为下一步的 `--images`,每步只改一个维度。
    6. **质检**:构图景别对不对、是否够真实、手部、服装细节是否受控。
    7. **要上架的图**建议过一遍 [detect-task](../detect-task/skill.md) 做投前检测。
    
    ---
    
    ## 7、常见问题
    
    | 现象 | 原因 | 处理 |
    | --- | --- | --- |
    | 要全身却出了半身 | 景别词位置太后 | 景别词提前 + 追加 `head to feet fully in frame` |
    | 出图像插画/CG | 缺真实性约束 | 追加 photorealistic + 真实纹理句 |
    | 服装细节完全不受控 | 描述太笼统或用中文写材质 | 服装段改英文,写死颜色/面料/版型/领口 |
    | 手指崩坏 | 生成随机性 | 追加修手句 + `--batch 4` 挑图 |
    | 定向修改改动过大 | 「保持不变」写得太笼统 | 逐项列出不许动的要素 |
    | 一组图风格不统一 | 氛围段每次都改 | 固定氛围段与镜头语言段 |
    | 成本超预期 | 一直用 2K/4K 探索 | 探索用 `1K` + `--batch 4`,定稿再 2K |
    
    ---
    
    ## Tips
    
    Visit https://dlazy.com for more information.
    

Comments (0)

Sign in to join the conversation.

No comments yet.

Reviews (0)

No reviews yet.

Related