creative-scene
从零创意生图,也可定向改模特、姿势、搭配。一句描述(可选参考图)→ 图。当用户说「创意生图」「生成一张」「改个姿势」「换模板」「随便来张图」时使用。
Install
npx skills add https://github.com/dlazy-ai/ecommerce-skills/tree/main/skills/creative-scene
claude plugin marketplace add https://llmmart.ai/marketplace.json && claude plugin install dlazy-ai-ecommerce-skills@llmmart
git clone https://github.com/dlazy-ai/ecommerce-skills.git
The skills CLI installs just this skill, for any of its supported agents. Claude Code installs the whole dlazy-ai/ecommerce-skills collection as a plugin from our marketplace. Git is the plain clone.
Skill manifest
creative-scene — 输入想象中的画面自由创作图片
一句话造一张图。没有素材也能开工——描述人物、穿着、场景、视角,直接出图。
本技能同时收录了一套可直接复制的指令模板:改模特、改姿势、改搭配——这些是所有其他技能的通用零件。
生成效果示例
本技能不需要输入素材——只有一句描述。
实际执行的命令:
dlazy banana-pro \
--prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
--aspectRatio 3:4 --imageSize 2K \
--save docs/creative-scene/example-output.jpg
对应的五槽位拆解:
| 槽位 | 内容 |
|---|---|
| 人物 | a long-haired young Asian woman |
| 穿着 | white puff-sleeve lace midi dress |
| 场景 | marble table inside a French-style cafe, fresh flowers and pastries |
| 视角/景别 | front three-quarter view, waist-up framing |
| 氛围/影调 | warm white colour grading, soft window light, atmospheric editorial |
输出
example-output.jpg — 3:4 / 2K,18 credits。人物、穿着、法式咖啡馆场景、三分之三正面半身景别与暖白影调全部按描述落位。
这张图可以直接作为后续定向修改的输入——例如接 把模特的上衣变成黑色高领修身打底衫,保持其他不变 换搭配。
1、能力边界
| 模式 | 说明 |
|---|---|
| 纯文生图 | 只给描述,凭空造图 |
| 参考图 + 描述 | 带一张图做定向修改(改模特 / 改姿势 / 改搭配) |
| 词库分类 | 说明 |
|---|---|
| 室内 / 室外 / 居家 / 街道 | 场景类 |
| 半身 / 全身 / 特写 | 景别类 |
| 场景图 | 完整场景氛围 |
| 改模特 / 改姿势 / 改搭配 | 定向修改类(见第三节) |
不做:不生成特定真人的肖像;不生成未成年人的不当内容;不用于伪造商品实拍与使用体验。
2、描述公式
官方给的参考形式是:人物 + 穿着,场景氛围,图片视角。
一个长发小女孩穿灰色打底裤和长款羽绒服白色雪地靴,咖啡店圣诞,全身正面
└── 人物 ──┘└──────── 穿着 ────────┘ └── 场景 ──┘ └─ 视角 ─┘
拆成五个槽位,缺哪个补哪个:
| 槽位 | 例子 |
|---|---|
| 人物 | 长发女生 卷毛非洲小女孩 35 岁商务男性 混血模特 |
| 穿着 | 白色泡泡袖蕾丝连衣裙 军绿麻花毛衣 + 米白阔腿裤 + 白色运动鞋 |
| 场景 | 法式装修风的咖啡店内,鲜花布置 新疆草原,身后有草原动物 T台走秀 |
| 视角/景别 | 全身正面 半身侧面 下半身图 颈部特写 半身背面转头 |
| 氛围/影调 | 明亮的暖白色调,氛围感 复古色调,写真 冷色光,明亮色调 |
电商向的经验:写真、氛围感、明亮的暖白色调 这类词能显著提升出图的商业可用度;全身正面 / 半身侧面 这类明确的景别词能大幅降低构图返工。
3、三类定向修改模板(可直接复制)
带参考图时,用下面的句式做定向修改。共同点:都以「保持其余不变」结尾——这是不跑偏的关键。
改模特
将主体改为一个[年龄]岁的[种族][性别][职业类型]模特,她/他有着[五官特征]、[发型]、[肤色]。
保持相同的服装、姿势和背景。
细分维度也可以单独改:
| 维度 | 模板 |
|---|---|
| 肤色 | 将肤色改为[浅色/浅桃色/温暖的香槟色/蜜色/可可色]。保持原有的面部结构、种族特征、所有面部特征的大小和位置、身体姿态、体型以及光照条件完全不变。 |
| 身材 | 将身材改为[苗条/丰满/稍微丰满/肌肉型]。保持主体完全不变,只改变身材。 |
| 发型 | 将发型改为[双麻花辫/凌乱的丸子头/长发大波浪/低马尾/精灵短发/寸头/背头]。保持角色与背景的一致性,同时保留相同的面部特征、姿势和表情。 |
| 五官 | 将[瞳孔颜色/唇色/眉毛/睫毛/腮红]改为[具体描述]。保持角色与背景的一致性,同时保留相同的姿势和表情。 |
改姿势
将姿势改为[姿势描述]。保持完全相同的拍摄角度、面部结构、肤色和体型。
常用姿势:正面站立,双臂自然下垂 / 以自然的步伐朝相机方向走来 / 侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓 / 背对镜头站立,回头看向肩膀 / 像模特一样走在T台中间的步伐,一脚向前并扭动臀部 / 坐在地板上,向后倾,用双手在身后支撑身体
改搭配
把模特的[上衣/下装/鞋子/配饰]变成[具体描述],保持其他不变
例:把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变 / 把模特的鞋子变成深棕色8孔马丁靴,硬朗帅气风,保持其他不变
4、工具调用
本技能使用 dLazy 的 banana-pro(高质量文生图模型,可选带参考图;擅长细节主视觉、商品图与品牌风格图像,适合从零造图这一主场景)。
调用方式
两种等价写法,选一种。统一入口会自动选后端、失败重试、建目录落盘、估算成本:
# A. 统一入口(推荐):可切任意后端,加 --dry-run 不计费空跑
node scripts/gen.mjs --task creative-scene \
--prompt '<见下方 Prompt 模板>' \
--images <按下表顺序> \
--save output/creative-scene-<sku>.jpg
# B. 直接用 dLazy CLI(不想引入 Node 依赖时,效果等价)
dlazy banana-pro --prompt '...' --images ... --save output/creative-scene.jpg
参数约定(本技能固定用法)
| 参数 | 取值 | 理由 |
|---|---|---|
--images |
留空(纯文生图)/ [参考图](定向修改,最多 14 张) |
改模特/姿势/搭配时才需要 |
--aspectRatio |
3:4(电商与种草竖版)/ 1:1 / 9:16(短视频封面) |
电商竖版为主 |
--imageSize |
1K 草稿探索 / 2K 上架 / 4K 大图与印刷 |
探索阶段用 1K 省成本 |
--batch |
4(探索期)/ 1(已定稿) |
文生图靠量取优 |
--save |
docs/creative-scene/output-<主题>.jpg |
按主题归档 |
英文 vs 中文 prompt:场景与氛围类描述中英文都可以;但服装的材质与工艺细节用英文更稳定。定向修改模板用中文即可(第四节的句式实测有效)。
Command Examples
# basic call: 纯文生图
dlazy banana-pro \
--prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, photorealistic, no text.' \
--aspectRatio 3:4 --imageSize 2K
# complex call: 探索期一次出 4 张 1K 草稿,定稿后再出 2K
dlazy banana-pro \
--prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \
--aspectRatio 3:4 --imageSize 1K \
--batch 4 --save docs/creative-scene/draft.jpg
# 定向修改:改姿势(带参考图)
dlazy banana-pro \
--prompt '将姿势改为侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓。保持完全相同的拍摄角度、面部结构、肤色和体型。' \
--images docs/creative-scene/example-output.jpg \
--aspectRatio 3:4 --imageSize 2K \
--save docs/creative-scene/output-pose-side.jpg
# 定向修改:改搭配
dlazy banana-pro \
--prompt '把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变。' \
--images docs/creative-scene/example-output.jpg \
--aspectRatio 3:4 --imageSize 2K \
--save docs/creative-scene/output-swap-top.jpg
# 先估价不真跑
dlazy banana-pro --dry-run --prompt '...' --aspectRatio 3:4 --imageSize 2K
延伸阅读
| 要查什么 | 去哪 |
|---|---|
| 认证、多后端配置、输出结构、错误码 | references/provider-cli.md |
banana-pro 的全部可用参数 |
references/model-flags.md |
| 统一入口的全部选项 | node scripts/gen.mjs --help |
5、Prompt 模板
纯文生图(五槽位公式):
[人物],穿着[穿着描述],在[场景描述],[视角/景别],[氛围/影调],
photorealistic, [镜头语言:shot on 85mm, shallow depth of field], no text, no watermark
定向修改(三类模板见第四节):
[改模特 / 改姿势 / 改搭配 的句式]。保持[其余要素]完全不变。
按问题追加的修正句
| 问题 | 追加到 prompt 末尾 |
|---|---|
| 构图不对(要全身给了半身) | 把景别词放到 prompt 靠前位置,并追加 full-body framing, head to feet fully in frame |
| 出图太像插画 | photorealistic photograph, real fabric texture, natural skin pores, no illustration, no CGI |
| 手部崩坏 | hands anatomically correct, five distinct fingers, natural knuckles |
| 服装细节不受控 | 服装描述改用英文,并写死颜色 / 面料 / 版型 / 领口 |
| 定向修改把别的也改了 | 把「保持其余不变」写得更具体:逐项列出不许动的东西 |
| 一组图风格不统一 | 固定氛围段与镜头语言段逐字不变,只换人物/场景 |
6、执行流程
- 判断模式:从零造图 → 纯文生图;已有图要改 → 带参考图 + 第四节模板。
- 按五槽位写描述:人物 / 穿着 / 场景 / 视角 / 氛围,缺一个就补一个。
- 探索期
--imageSize 1K --batch 4快速看方向,成本最低。 - 定稿后
--imageSize 2K出正式图。 - 要连续改(先定人,再改姿势,再改搭配):把上一步的输出作为下一步的
--images,每步只改一个维度。 - 质检:构图景别对不对、是否够真实、手部、服装细节是否受控。
- 要上架的图建议过一遍 detect-task 做投前检测。
7、常见问题
| 现象 | 原因 | 处理 |
|---|---|---|
| 要全身却出了半身 | 景别词位置太后 | 景别词提前 + 追加 head to feet fully in frame |
| 出图像插画/CG | 缺真实性约束 | 追加 photorealistic + 真实纹理句 |
| 服装细节完全不受控 | 描述太笼统或用中文写材质 | 服装段改英文,写死颜色/面料/版型/领口 |
| 手指崩坏 | 生成随机性 | 追加修手句 + --batch 4 挑图 |
| 定向修改改动过大 | 「保持不变」写得太笼统 | 逐项列出不许动的要素 |
| 一组图风格不统一 | 氛围段每次都改 | 固定氛围段与镜头语言段 |
| 成本超预期 | 一直用 2K/4K 探索 | 探索用 1K + --batch 4,定稿再 2K |
Tips
Visit https://dlazy.com for more information.
Files (ecommerce-skills)
-
examples
-
brand.yaml 1.6 KB
# ⚠️ 由 scripts/build-skills.mjs 从 shared/examples/brand.yaml 同步生成,不要直接改这里。 # 店铺品牌视觉规范 —— 所有生图技能读这一份,保证几百个 SKU 看起来像同一家店。 # node scripts/brand.mjs --brand brand.yaml --for flat-lay # node scripts/gen.mjs --task flat-lay --brand brand.yaml --prompt '...' brand: name: 示例品牌 # 一句话概括调性,会原样进 prompt tone: quiet minimalist, warm and lived-in, never glossy or commercial model: # 锁模特:给一张脸的参考图,所有技能都会把它作为最后一张参考图传入 reference: assets/model/face-a.jpg description: East Asian woman, late twenties, natural makeup, shoulder-length black hair body: slim, height around 168cm photography: background: seamless off-white studio backdrop, RGB 248 248 246 lighting: soft large softbox from camera left, gentle fill, no hard shadows camera: 85mm equivalent, eye level, shallow depth of field grade: neutral white balance around 5200K, low contrast, slightly lifted blacks crop: full body with headroom, product centered layout: # 给带排版的技能(主图 / 详情页)用 margin: at least 8% empty margin on all sides typeface: clean sans-serif, no decorative fonts text_color: near-black on light background forbid: - no visible brand logos other than the product's own - no text or watermark - no exaggerated poses or dramatic wind effects - no oversaturated colors # 可选:把这些直接写进合规目标,生成时就按平台要求出图 compliance: platform: amazon
-
-
references
-
model-flags.md 1.9 KB
# `banana-pro` 参数清单 本技能默认用的模型的完整参数。日常只需要「参数约定」里那几个, 这份清单在需要用到非常规参数时再看。 **CRITICAL INSTRUCTION FOR AGENT**: Run the `dlazy banana-pro` command to get results. ```bash dlazy banana-pro -h Options: --prompt <prompt> Prompt --images [images...] Images [image: url or local path] (max 14) --aspectRatio <aspectRatio> Aspect Ratio [default: auto] (choices: "auto", "1:1", "4:3", "3:4", "16:9", "9:16", "21:9") --imageSize <imageSize> Image Size [default: 1K] (choices: "1K", "2K", "4K") --dry-run Print payload without executing the tool --no-wait Return generateId immediately for async tasks --timeout <seconds> Max seconds to wait for async completion (default: "1800") --input <jsonOrFile> Inline JSON or @path/to/file.json — merged under flag values (flags win) --save <path> Download the result asset to this local path (mkdir + retry handled for you). A destination path — NOT a response format; for stdout shape use --format --batch <n> Fan-out N parallel runs (cloud tools only) (default: "1") -h, --help display help for command ``` > Any flag also accepts pipe references — `-` (auto-pick from upstream stdin), `@N` (n-th output), `@N.path` (jsonpath into output), `@*` (all primary values), `@stdin` / `@stdin:path` (whole envelope). See `dlazy --help` for details. --- 换其他后端时参数由 `scripts/gen.mjs` 统一翻译,见 [`provider-cli.md`](provider-cli.md)。 -
provider-cli.md 4.7 KB
<!-- 由 scripts/build-skills.mjs 从 shared/references/provider-cli.md 同步生成,不要直接改这里。 --> # 后端调用参考 技能正文只写「要生成什么」。认证、计费、错误码、输出结构这些每个技能都一样的东西放在这里, **用到时再读**,不占技能的常驻上下文。 --- ## 一、认证 ### 默认后端 dLazy ```bash dlazy login # 设备码流程,远程 shell 也能用,自动写入本地配置 dlazy auth set <KEY> # 已有 key 时直接写入 ``` key 存在用户配置目录(macOS/Linux `~/.dlazy/config.json`,Windows `%USERPROFILE%\.dlazy\config.json`), 权限限本机用户。也可以每次调用用环境变量 `DLAZY_API_KEY` 传入。 手动获取:登录 [dlazy.com](https://dlazy.com) → [API Key 页面](https://dlazy.com/dashboard/organization/api-key)。 key 按组织隔离,可随时轮换或吊销。 ### 其他后端 本技能库不锁定单一厂商。配好任意一家的 key 即可跑: | 后端 | 环境变量 | 说明 | | --- | --- | --- | | `dlazy` | `dlazy login` 或 `DLAZY_API_KEY` | 默认,最省事 | | `openai` | `OPENAI_API_KEY` | 走 `/v1/images/edits` 与 `/v1/images/generations` | | `gemini` | `GEMINI_API_KEY` | Nano Banana 系列 | | `fal` | `FAL_KEY` | | | `replicate` | `REPLICATE_API_TOKEN` | | | `ark` | `ARK_API_KEY` + `ARK_MODEL` | 火山方舟,模型 ID 需按开通情况填 | 选路优先级:`--provider` 参数 > `PROVIDER` 环境变量 > 第一个配了 key 的 > `dlazy`。 ```bash node scripts/gen.mjs --doctor # 看当前哪个后端可用 ``` 各后端的模型 ID 可用 `GEN_MODEL_OPENAI` / `GEN_MODEL_GEMINI` / `GEN_MODEL_FAL` / `GEN_MODEL_REPLICATE` / `GEN_MODEL_ARK` 覆盖。**厂商目录会变,以各家最新文档为准。** --- ## 二、两种调用方式 ### 方式 A:统一入口(推荐) ```bash node scripts/gen.mjs --task <技能名> --prompt '...' --images a.jpg b.jpg --save out.jpg ``` 它负责:后端选路、默认尺寸档位、失败重试(429/5xx 指数退避)、落盘建目录、成本估算。 ```bash node scripts/gen.mjs --task flat-lay --prompt '...' --dry-run # 不调用不计费,只看要发什么 node scripts/gen.mjs --help ``` ### 方式 B:直接用 dLazy CLI 不想引入 Node 依赖时,技能正文里的 `dlazy ...` 命令可以原样执行,效果等价。 ```bash npx @dlazy/cli@1.2.3 <command> # 不装全局二进制 ``` - CLI 源码:[github.com/dlazy-ai/cli](https://github.com/dlazy-ai/cli) · npm 包 `@dlazy/cli` --- ## 三、数据流向 调用 dLazy 时:提示词与参数发往 `api.dlazy.com`;传入的本地图片会上传到 `files.dlazy.com` 供模型读取;产出 URL 同样托管在 `files.dlazy.com`。这是云端生成 API 的通用形态。 换成其他后端时,数据流向对应厂商,不经过 dLazy。 --- ## 四、输出结构 `gen.mjs`(加 `--json`): ```json { "ok": true, "task": "flat-lay", "provider": "dlazy", "model": "gpt-image-2", "files": ["docs/flat-lay/output-sku001.jpg"], "texts": [], "estimatedCredits": 60, "elapsedMs": 58213 } ``` dLazy CLI 原生: ```json { "ok": true, "result": { "tool": "gpt-image-2", "data": { "urls": ["https://files.dlazy.com/data/ai/....jpg"] }, "savedPath": "docs/flat-lay/example-output.jpg" } } ``` 加 `--no-wait` 的异步任务不返回 `data`,返回 `task: { generateId, status }`, 用 `dlazy status <generateId> --wait` 轮询。 文本类模型(如质检)产出在 `result.data.texts[0]`: ```bash dlazy claude-sonnet-5 --prompt '...' --images x.jpg \ | python3 -c 'import sys,json;print(json.load(sys.stdin)["result"]["data"]["texts"][0])' ``` --- ## 五、错误处理 | Code | 类型 | 示例 | | --- | --- | --- | | 401 | 未授权 / 无 key | `ok: false, code: "unauthorized"` | | 501 | 缺必填参数 | `error: required option '--prompt <prompt>' not specified` | | 502 | 本地文件读不到 | `Error: Image file not found: ...` | | 503 | 余额不足 | `ok: false, code: "insufficient_balance"` | | 503 | 服务端错误 | `HTTP status code error (500)` | | 504 | 异步任务失败 | `=== Generation Failed ===` / `Prompt violates safety policy` | **给 Agent 的硬性要求** 1. 命中 `insufficient_balance` → 明确告诉用户算力不足,并给出充值入口 <https://dlazy.com/dashboard/organization/settings?tab=credits> 2. 命中 `unauthorized` / 缺 key → 告诉用户去 <https://dlazy.com/dashboard/organization/api-key> 取 key,用 `dlazy auth set <key>` 存好再继续。 3. 用 `gen.mjs` 时,429 与 5xx 已自动重试;仍失败才向用户报错。 4. **不要**为了「跑通」而偷偷降级参数(尺寸、档位、批量),先问用户。
-
-
scripts
-
lib
-
miniyaml.mjs 2.8 KB · in bundle
-
providers.mjs 11.9 KB · in bundle
-
tasks.json 3.1 KB
{ "_note": "技能 → 默认模型与参数。dlazy 列为默认后端的模型名;其他后端走 providers.mjs 的通用映射,可用 GEN_MODEL_<PROVIDER> 覆盖。", "_credits": { "gpt-image-2": 60, "seedream-5.0": 30, "seedream-5.0-pro": 45, "banana-pro": 25, "claude-sonnet-5": 3 }, "tasks": { "flat-lay": { "model": "gpt-image-2", "size": "1024x1536", "quality": "high", "format": "jpeg" }, "wear-everything": { "model": "gpt-image-2", "size": "1024x1536", "quality": "medium", "format": "jpeg" }, "image-fusion": { "model": "seedream-5.0", "size": "3:4", "resolution": "2k" }, "one-shot": { "model": "gpt-image-2", "size": "1024x1536", "quality": "medium", "format": "jpeg" }, "fission-pattern": { "model": "gpt-image-2", "size": "1024x1536", "quality": "medium", "format": "jpeg" }, "item-detail": { "model": "seedream-5.0-pro", "size": "3:4", "resolution": "2k" }, "creative-scene": { "model": "banana-pro", "size": "1024x1536", "format": "jpeg" }, "batch-image": { "model": "seedream-5.0", "size": "3:4", "resolution": "2k" }, "to-3d": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "clothing-extraction": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "fabric-on-body": { "model": "gpt-image-2", "size": "1024x1536", "quality": "high", "format": "jpeg" }, "clothing-detail": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "clothing-grass-planting": { "model": "gpt-image-2", "size": "1024x1536", "quality": "medium", "format": "jpeg" }, "item-selling-point": { "model": "seedream-5.0-pro", "size": "1:1", "resolution": "2k" }, "item-change-background": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "remove-watermark": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "material-enhancement": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "item-repair": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "detect-task": { "model": "claude-sonnet-5", "text": true }, "listing-optimizer": { "model": "gpt-image-2", "size": "1024x1024", "quality": "high", "format": "jpeg" }, "cross-border-localize": { "model": "seedream-5.0-pro", "size": "1:1", "resolution": "2k" }, "brand-kit": { "model": "gpt-image-2", "size": "1024x1536", "quality": "high", "format": "jpeg" }, "platform-compliance": { "model": "claude-sonnet-5", "text": true }, "main-image-video": { "model": "$DLAZY_VIDEO_MODEL", "video": true }, "product-video-ad": { "model": "$DLAZY_VIDEO_MODEL", "video": true }, "ugc-testimonial": { "model": "$DLAZY_VIDEO_MODEL", "video": true } } }
-
-
brand.mjs 4.4 KB · in bundle
-
gen.mjs 9.3 KB · in bundle
-
-
skill.md 11.8 KB
--- name: creative-scene description: 从零创意生图,也可定向改模特、姿势、搭配。一句描述(可选参考图)→ 图。当用户说「创意生图」「生成一张」「改个姿势」「换模板」「随便来张图」时使用。 --- # creative-scene — 输入想象中的画面自由创作图片 **一句话造一张图**。没有素材也能开工——描述人物、穿着、场景、视角,直接出图。 本技能同时收录了一套**可直接复制的指令模板**:改模特、改姿势、改搭配——这些是所有其他技能的通用零件。 --- ## 生成效果示例 本技能不需要输入素材——只有一句描述。 实际执行的命令: ```bash dlazy banana-pro \ --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \ --aspectRatio 3:4 --imageSize 2K \ --save docs/creative-scene/example-output.jpg ``` 对应的五槽位拆解: | 槽位 | 内容 | | --- | --- | | 人物 | `a long-haired young Asian woman` | | 穿着 | `white puff-sleeve lace midi dress` | | 场景 | `marble table inside a French-style cafe, fresh flowers and pastries` | | 视角/景别 | `front three-quarter view, waist-up framing` | | 氛围/影调 | `warm white colour grading, soft window light, atmospheric editorial` | **输出** <img src="../../docs/creative-scene/example-output.jpg" width="320"> `example-output.jpg` — 3:4 / 2K,18 credits。人物、穿着、法式咖啡馆场景、三分之三正面半身景别与暖白影调全部按描述落位。 这张图可以直接作为后续定向修改的输入——例如接 `把模特的上衣变成黑色高领修身打底衫,保持其他不变` 换搭配。 --- ## 1、能力边界 | 模式 | 说明 | | --- | --- | | 纯文生图 | 只给描述,凭空造图 | | 参考图 + 描述 | 带一张图做定向修改(改模特 / 改姿势 / 改搭配) | | 词库分类 | 说明 | | --- | --- | | 室内 / 室外 / 居家 / 街道 | 场景类 | | 半身 / 全身 / 特写 | 景别类 | | 场景图 | 完整场景氛围 | | 改模特 / 改姿势 / 改搭配 | 定向修改类(见第三节) | **不做**:不生成特定真人的肖像;不生成未成年人的不当内容;不用于伪造商品实拍与使用体验。 --- ## 2、描述公式 官方给的参考形式是:**人物 + 穿着,场景氛围,图片视角**。 ```text 一个长发小女孩穿灰色打底裤和长款羽绒服白色雪地靴,咖啡店圣诞,全身正面 └── 人物 ──┘└──────── 穿着 ────────┘ └── 场景 ──┘ └─ 视角 ─┘ ``` 拆成五个槽位,缺哪个补哪个: | 槽位 | 例子 | | --- | --- | | 人物 | `长发女生` `卷毛非洲小女孩` `35 岁商务男性` `混血模特` | | 穿着 | `白色泡泡袖蕾丝连衣裙` `军绿麻花毛衣 + 米白阔腿裤 + 白色运动鞋` | | 场景 | `法式装修风的咖啡店内,鲜花布置` `新疆草原,身后有草原动物` `T台走秀` | | 视角/景别 | `全身正面` `半身侧面` `下半身图` `颈部特写` `半身背面转头` | | 氛围/影调 | `明亮的暖白色调,氛围感` `复古色调,写真` `冷色光,明亮色调` | **电商向的经验**:`写真`、`氛围感`、`明亮的暖白色调` 这类词能显著提升出图的商业可用度;`全身正面` / `半身侧面` 这类明确的景别词能大幅降低构图返工。 --- ## 3、三类定向修改模板(可直接复制) 带参考图时,用下面的句式做定向修改。**共同点:都以「保持其余不变」结尾**——这是不跑偏的关键。 **改模特** ```text 将主体改为一个[年龄]岁的[种族][性别][职业类型]模特,她/他有着[五官特征]、[发型]、[肤色]。 保持相同的服装、姿势和背景。 ``` 细分维度也可以单独改: | 维度 | 模板 | | --- | --- | | 肤色 | `将肤色改为[浅色/浅桃色/温暖的香槟色/蜜色/可可色]。保持原有的面部结构、种族特征、所有面部特征的大小和位置、身体姿态、体型以及光照条件完全不变。` | | 身材 | `将身材改为[苗条/丰满/稍微丰满/肌肉型]。保持主体完全不变,只改变身材。` | | 发型 | `将发型改为[双麻花辫/凌乱的丸子头/长发大波浪/低马尾/精灵短发/寸头/背头]。保持角色与背景的一致性,同时保留相同的面部特征、姿势和表情。` | | 五官 | `将[瞳孔颜色/唇色/眉毛/睫毛/腮红]改为[具体描述]。保持角色与背景的一致性,同时保留相同的姿势和表情。` | **改姿势** ```text 将姿势改为[姿势描述]。保持完全相同的拍摄角度、面部结构、肤色和体型。 ``` 常用姿势:`正面站立,双臂自然下垂` / `以自然的步伐朝相机方向走来` / `侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓` / `背对镜头站立,回头看向肩膀` / `像模特一样走在T台中间的步伐,一脚向前并扭动臀部` / `坐在地板上,向后倾,用双手在身后支撑身体` **改搭配** ```text 把模特的[上衣/下装/鞋子/配饰]变成[具体描述],保持其他不变 ``` 例:`把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变` / `把模特的鞋子变成深棕色8孔马丁靴,硬朗帅气风,保持其他不变` --- ## 4、工具调用 本技能使用 dLazy 的 **`banana-pro`**(高质量文生图模型,可选带参考图;擅长细节主视觉、商品图与品牌风格图像,适合从零造图这一主场景)。 ### 调用方式 两种等价写法,选一种。统一入口会自动选后端、失败重试、建目录落盘、估算成本: ```bash # A. 统一入口(推荐):可切任意后端,加 --dry-run 不计费空跑 node scripts/gen.mjs --task creative-scene \ --prompt '<见下方 Prompt 模板>' \ --images <按下表顺序> \ --save output/creative-scene-<sku>.jpg # B. 直接用 dLazy CLI(不想引入 Node 依赖时,效果等价) dlazy banana-pro --prompt '...' --images ... --save output/creative-scene.jpg ``` **参数约定(本技能固定用法)** | 参数 | 取值 | 理由 | | --- | --- | --- | | `--images` | 留空(纯文生图)/ `[参考图]`(定向修改,最多 14 张) | 改模特/姿势/搭配时才需要 | | `--aspectRatio` | `3:4`(电商与种草竖版)/ `1:1` / `9:16`(短视频封面) | 电商竖版为主 | | `--imageSize` | `1K` 草稿探索 / `2K` 上架 / `4K` 大图与印刷 | 探索阶段用 1K 省成本 | | `--batch` | `4`(探索期)/ `1`(已定稿) | 文生图靠量取优 | | `--save` | `docs/creative-scene/output-<主题>.jpg` | 按主题归档 | > **英文 vs 中文 prompt**:场景与氛围类描述中英文都可以;但**服装的材质与工艺细节用英文更稳定**。定向修改模板用中文即可(第四节的句式实测有效)。 ### Command Examples ```bash # basic call: 纯文生图 dlazy banana-pro \ --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, photorealistic, no text.' \ --aspectRatio 3:4 --imageSize 2K # complex call: 探索期一次出 4 张 1K 草稿,定稿后再出 2K dlazy banana-pro \ --prompt 'A long-haired young Asian woman wearing a white puff-sleeve lace midi dress, sitting at a marble table inside a French-style cafe, fresh flowers and pastries arranged on the table, warm white colour grading, soft window light, front three-quarter view, waist-up framing, atmospheric editorial portrait, photorealistic, shot on 85mm, shallow depth of field, no text, no watermark.' \ --aspectRatio 3:4 --imageSize 1K \ --batch 4 --save docs/creative-scene/draft.jpg # 定向修改:改姿势(带参考图) dlazy banana-pro \ --prompt '将姿势改为侧身站立,上半身朝向相机扭转,双手放在背后以展示腰线和侧面轮廓。保持完全相同的拍摄角度、面部结构、肤色和体型。' \ --images docs/creative-scene/example-output.jpg \ --aspectRatio 3:4 --imageSize 2K \ --save docs/creative-scene/output-pose-side.jpg # 定向修改:改搭配 dlazy banana-pro \ --prompt '把模特的上衣变成黑色高领修身打底衫,冬季百搭款,保持其他不变。' \ --images docs/creative-scene/example-output.jpg \ --aspectRatio 3:4 --imageSize 2K \ --save docs/creative-scene/output-swap-top.jpg # 先估价不真跑 dlazy banana-pro --dry-run --prompt '...' --aspectRatio 3:4 --imageSize 2K ``` ### 延伸阅读 | 要查什么 | 去哪 | | --- | --- | | 认证、多后端配置、输出结构、错误码 | [`references/provider-cli.md`](references/provider-cli.md) | | `banana-pro` 的全部可用参数 | [`references/model-flags.md`](references/model-flags.md) | | 统一入口的全部选项 | `node scripts/gen.mjs --help` | ## 5、Prompt 模板 **纯文生图**(五槽位公式): ```text [人物],穿着[穿着描述],在[场景描述],[视角/景别],[氛围/影调], photorealistic, [镜头语言:shot on 85mm, shallow depth of field], no text, no watermark ``` **定向修改**(三类模板见第四节): ```text [改模特 / 改姿势 / 改搭配 的句式]。保持[其余要素]完全不变。 ``` **按问题追加的修正句** | 问题 | 追加到 prompt 末尾 | | --- | --- | | 构图不对(要全身给了半身) | 把景别词放到 prompt 靠前位置,并追加 `full-body framing, head to feet fully in frame` | | 出图太像插画 | `photorealistic photograph, real fabric texture, natural skin pores, no illustration, no CGI` | | 手部崩坏 | `hands anatomically correct, five distinct fingers, natural knuckles` | | 服装细节不受控 | 服装描述改用英文,并写死颜色 / 面料 / 版型 / 领口 | | 定向修改把别的也改了 | 把「保持其余不变」写得更具体:逐项列出不许动的东西 | | 一组图风格不统一 | 固定氛围段与镜头语言段逐字不变,只换人物/场景 | --- ## 6、执行流程 1. **判断模式**:从零造图 → 纯文生图;已有图要改 → 带参考图 + 第四节模板。 2. **按五槽位写描述**:人物 / 穿着 / 场景 / 视角 / 氛围,缺一个就补一个。 3. **探索期 `--imageSize 1K --batch 4`** 快速看方向,成本最低。 4. **定稿后 `--imageSize 2K`** 出正式图。 5. **要连续改**(先定人,再改姿势,再改搭配):把上一步的输出作为下一步的 `--images`,每步只改一个维度。 6. **质检**:构图景别对不对、是否够真实、手部、服装细节是否受控。 7. **要上架的图**建议过一遍 [detect-task](../detect-task/skill.md) 做投前检测。 --- ## 7、常见问题 | 现象 | 原因 | 处理 | | --- | --- | --- | | 要全身却出了半身 | 景别词位置太后 | 景别词提前 + 追加 `head to feet fully in frame` | | 出图像插画/CG | 缺真实性约束 | 追加 photorealistic + 真实纹理句 | | 服装细节完全不受控 | 描述太笼统或用中文写材质 | 服装段改英文,写死颜色/面料/版型/领口 | | 手指崩坏 | 生成随机性 | 追加修手句 + `--batch 4` 挑图 | | 定向修改改动过大 | 「保持不变」写得太笼统 | 逐项列出不许动的要素 | | 一组图风格不统一 | 氛围段每次都改 | 固定氛围段与镜头语言段 | | 成本超预期 | 一直用 2K/4K 探索 | 探索用 `1K` + `--batch 4`,定稿再 2K | --- ## Tips Visit https://dlazy.com for more information.
Comments (0)
Sign in to join the conversation.
Reviews (0)
No reviews yet.
No comments yet.