flux-2-klein

flux-2-klein

使用 RunComfy 上的 Flux 2 Klein(Black Forest Labs 的 Flux 2 蒸馏快速变体)生成图像——捆绑了模型文档化的提示模式,使技能比针对同一模型的朴素提示获得更清晰的输出。记录了 Flux 2 Klein 的优势(亚秒级延迟、多参考品牌样式、声明式主体优先提示)、步数策略(4–8 步快速迭代,约 25 步精修)、9B 与 4B 变体的权衡,以及何时改用 Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地 RunComfy CLI 调用 `runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或 `/4b/`)。触发词为 "flux 2 klein"、"flux-2-klein"、"flux klein"、"BFL flux 2" 或任何明确要求使用此模型生成的请求。

20Star
9Fork
更新于 2026/6/14
SKILL.md
readonly只读
name
flux-2-klein
description

使用 RunComfy 上的 Flux 2 Klein(Black Forest Labs 的 Flux 2 蒸馏快速变体)生成图像——捆绑了模型文档化的提示模式,使技能比针对同一模型的朴素提示获得更清晰的输出。记录了 Flux 2 Klein 的优势(亚秒级延迟、多参考品牌样式、声明式主体优先提示)、步数策略(4–8 步快速迭代,约 25 步精修)、9B 与 4B 变体的权衡,以及何时改用 Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地 RunComfy CLI 调用 `runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或 `/4b/`)。触发词为 "flux 2 klein"、"flux-2-klein"、"flux klein"、"BFL flux 2" 或任何明确要求使用此模型生成的请求。

Flux 2 Klein — RunComfy 专业包

runcomfy.com · 9B 模型 · 4B 模型 · GitHub

Black Forest Labs 的 Flux 2 Klein(Flux 2 的蒸馏低延迟变体)托管在 RunComfy 模型 API 上——无需 API 密钥,异步 REST。

npx skills add agentspace-so/runcomfy-skills --skill flux-2-klein -g

何时选择此模型(与同类模型对比)

Flux 2 Klein 的独特优势是延迟优先的创意迭代:亚秒级反馈支持实时艺术指导会话和快速产品可视化,这是批量式模型无法持续的。当迭代速度比最终分辨率更重要时选择它。

需求 使用
实时/现场艺术指导会话 Flux 2 Klein 4B
快速迭代且最终细节丰富 Flux 2 Klein 9B
多参考品牌样式,风格一致 Flux 2 Klein
2K–4K 主图,最高分辨率 Seedream 5
最大提示遵循度 + 极致细节 Flux 2 Pro
嵌入文本、标志、多语言标牌 GPT Image 2
超写实肖像 Nano Banana Pro

如果用户明确提到 "Flux 2 Klein" / "BFL Klein" / "flux klein",则直接路由至此。如果用户只说 "Flux 2",则在默认之前询问他们想要 Klein(快速)还是 Pro(最高质量)。

前提条件

  1. RunComfy CLInpm i -g @runcomfy/cli
  2. RunComfy 账户runcomfy login 打开浏览器设备码流程。
  3. CI / 容器 — 设置 RUNCOMFY_TOKEN=<token> 代替 runcomfy login

端点 + 输入模式

两个变体,相同的端点形状,相同的提示语法。

blackforestlabs/flux-2-klein/9b/text-to-image

保真度优先的变体。用于精修/最终输出。

字段 类型 必填 默认值 备注
prompt 字符串 最多约 512 个 token。更长会降低质量。
steps 整数 25 4–50。步数蒸馏架构——概念设计 4–8 步足够;精修约 25 步;超过 25 步收益甚微。
width 整数 1024 通常 512–1536。宽高比上限 16:9,总分辨率最大约 2K。
height 整数 1024 width 的宽高意图匹配。

blackforestlabs/flux-2-klein/4b/text-to-image

延迟优先的变体。亚秒级 4 步推理。用于实时迭代/概念设计。

字段集与 9B 相同。默认 steps 实际上为 4——该变体针对此步数构建。

参考图像(两个变体)

同一端点支持最多 4 张同时参考图像,用于风格迁移/引导构图。JSON 主体中的确切字段名在模型的 API 标签页中有文档说明——通过 CLI 原样传递。参考图像的使用支持编辑风格的工作流,无需单独的 /edit 端点。

如何调用

快速概念设计(4B,亚秒级):

runcomfy run blackforestlabs/flux-2-klein/4b/text-to-image \
  --input '{"prompt": "<用户提示>"}' \
  --output-dir <绝对路径>

精修/最终(9B,约 25 步):

runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
  --input '{
    "prompt": "<用户提示>",
    "steps": 25,
    "width": 1024,
    "height": 1024
  }' \
  --output-dir <绝对路径>

宽幅海报:

runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
  --input '{"prompt": "<用户提示>", "width": 1536, "height": 864}' \
  --output-dir <绝对路径>

CLI 提交请求,每 2 秒轮询直到完成,然后将结果中的任何 *.runcomfy.net / *.runcomfy.com URL 下载到 --output-dir。标准输出是结果 JSON。标准错误是进度。

适用于管道的用法:

runcomfy --output json run blackforestlabs/flux-2-klein/4b/text-to-image \
  --input '{"prompt":"..."}' --no-wait | jq -r .request_id

提示技巧——实际有效的方法

以下是模型特定的模式,经验上能提高输出质量。

主体优先的声明式语法。 Flux 2 Klein 训练所用的结构是 "主体 + 动作 + 场景 + 风格 + 光照 + 相机 + 质量"。将主体放在前面;指令放在后面。示例:"A vibrant hummingbird mid-flight sipping nectar from a bright pink hibiscus, iridescent feathers in morning sun, soft bokeh tropical garden, macro photography, razor-sharp detail, cinematic lighting"

具体性胜过华丽语言。 "4k product photo, softbox lighting, reflective table, 35mm, f/2.8" 能可靠地引导模型。"A really pretty product image" 则不能。

按阶段选择步数。

  • 概念设计:4B 变体 4–8 步——亚秒级反馈,适合实时探索。
  • 细化:仍用 4B 变体 8–15 步,锁定主体和构图。
  • 精修:9B 变体约 25 步——纹理、微细节、精细排版。

多参考对齐。 传递参考图像时,保持其美学风格一致。在同一调用中混合水彩 + 写实 + 3D 渲染会混淆编辑器。在所有参考中选择一种一致的视觉风格。

条件编辑:说明保留什么,然后改变什么。"Same composition and lighting as reference, but change the background from beach to mountain studio." 这种模式能保持构图稳定。

对于文本渲染(Klein 使用 8B Qwen3 嵌入器,效果不错但不及 GPT Image 2):添加 "crisp typography, high-contrast label" 并将步数提高到约 25(如果文本输出模糊)。对于大量图像内文本或多语言渲染,改用 GPT Image 2。

反模式

  • 不要使用冲突的形容词。"minimalist + ornate" 会相互抵消。
  • 不要超过约 512 个 token。模型质量会下降,且不会优雅地截断。
  • 不要要求 4K——模型的分辨率上限约为 2K。
  • 不要要求超宽(>16:9)——模型会裁剪。

优势场景

用例 为什么选择 Flux 2 Klein
现场艺术指导会话 亚秒级反馈(4B)支持实时迭代
交互式产品可视化 快速 UI 预览和产品合成,无需批量等待
多参考品牌样式 跨参考的强风格一致性,实现统一资产包
快速概念设计到精修工作流 4B 用于探索,9B 用于最终输出——全程使用相同提示语法
消费级 GPU 友好推理 4B 变体可在普通硬件上运行;与自托管对比相关,但 RunComfy 托管同样适用

示例提示(已验证能产生强结果)

来自模型页面(BFL 示例):

A vibrant hummingbird mid-flight sipping nectar from a bright pink hibiscus
flower, iridescent emerald and sapphire feathers catching the morning sun,
soft bokeh tropical garden background, macro photography, razor-sharp
detail, cinematic lighting

产品照片模式:

A matte ceramic mug on a reclaimed-wood table, soft northern window light
from the left, shallow depth of field, 50mm prime, f/2.0, neutral
background, e-commerce ready, 4K product photography

品牌一致对(多参考):

Same composition and lighting as the reference image, but the bottle
label is now blue with white sans-serif typography reading "AURA";
keep the bottle silhouette, table, and shadow exactly as in the reference

限制

  • 分辨率上限约 2K——如需更高原生分辨率,改用 Seedream 5。
  • 宽高比上限 16:9——极端宽/高比例会被裁剪。
  • 提示上限约 512 个 token——更长会降低质量;不会优雅截断。
  • 参考图像上限 4 张——超过 4 张会增加延迟并稀释引导效果。
  • 文本渲染——8B Qwen3 嵌入器有帮助,但 GPT Image 2 在嵌入文本精度上仍然胜出。

退出码

runcomfy CLI 使用 sysexits 风格码:

含义
0 成功
64 CLI 参数错误
65 输入 JSON 错误/模式不匹配(例如 width: 4096 会返回 422)
69 上游 5xx 错误
75 可重试:超时/429
77 未登录或 token 被拒绝

完整参考:docs.runcomfy.com/cli/troubleshooting

工作原理

  1. 技能使用匹配模式的 JSON 主体调用 runcomfy run blackforestlabs/flux-2-klein/<variant>/text-to-image
  2. CLI 使用用户的 bearer token 向 https://model-api.runcomfy.net/v1/models/blackforestlabs/flux-2-klein/<variant>/text-to-image 发送 POST 请求。
  3. 模型 API 返回 request_id;CLI 每 2 秒轮询 GET .../requests/<id>/status
  4. 状态变为终态后,CLI 获取 GET .../requests/<id>/result 并下载任何主机名以 .runcomfy.net.runcomfy.com 结尾的 URL 到 --output-dir。其他 URL 仅列出但不获取。
  5. 轮询期间按 Ctrl-C 会发送 POST .../requests/<id>/cancel,这样你就不会为已停止的 GPU 付费。

此技能不是什么

不是自托管的 Flux 运行器。不是能力授权——依赖于有效的 RunComfy 账户。不是多租户。

安全与隐私

  • Token 存储runcomfy login 将 API token 写入 ~/.config/runcomfy/token.json,权限为 0600(仅所有者读写)。在 CI/容器中设置 RUNCOMFY_TOKEN 环境变量可完全绕过文件。
  • 输入边界:用户提示通过 --input 作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 主体通过 HTTPS 传输到模型 API。提示内容不存在 shell 注入风险。
  • 第三方内容:你传递的图像/蒙版/视频 URL 由 RunComfy 模型服务器获取,而非你机器上的 CLI。将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
  • 出站端点:仅 model-api.runcomfy.net(请求提交)和 *.runcomfy.net / *.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。
  • 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。