
flux-2-klein
使用 RunComfy 上的 Flux 2 Klein(Black Forest Labs 的 Flux 2 蒸馏快速变体)生成图像——捆绑了模型文档化的提示模式,使技能比针对同一模型的朴素提示获得更清晰的输出。记录了 Flux 2 Klein 的优势(亚秒级延迟、多参考品牌风格、声明式主体优先提示)、步数策略(4-8 步快速迭代,约 25 步精修)、9B 与 4B 变体的权衡,以及何时改用 Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地 RunComfy CLI 调用 `runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或 `/4b/`)。触发词为 "flux 2 klein"、"flux-2-klein"、"flux klein"、"BFL flux 2" 或任何明确要求使用此模型生成图像的请求。
使用 RunComfy 上的 Flux 2 Klein(Black Forest Labs 的 Flux 2 蒸馏快速变体)生成图像——捆绑了模型文档化的提示模式,使技能比针对同一模型的朴素提示获得更清晰的输出。记录了 Flux 2 Klein 的优势(亚秒级延迟、多参考品牌风格、声明式主体优先提示)、步数策略(4-8 步快速迭代,约 25 步精修)、9B 与 4B 变体的权衡,以及何时改用 Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地 RunComfy CLI 调用 `runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或 `/4b/`)。触发词为 "flux 2 klein"、"flux-2-klein"、"flux klein"、"BFL flux 2" 或任何明确要求使用此模型生成图像的请求。
Flux 2 Klein — RunComfy 专业包
runcomfy.com · 9B 模型 · 4B 模型 · GitHub
Black Forest Labs 的 Flux 2 Klein(Flux 2 的蒸馏低延迟变体)托管在 RunComfy 模型 API 上——无需 API 密钥,异步 REST。
npx skills add agentspace-so/runcomfy-skills --skill flux-2-klein -g
何时选择此模型(与同类模型对比)
Flux 2 Klein 的独特优势在于延迟优先的创意迭代:亚秒级反馈支持实时艺术指导会话和快速产品可视化,这是批量式模型无法持续的。当迭代速度比最高分辨率更重要时,选择它。
| 需求 | 使用 |
|---|---|
| 实时/现场艺术指导会话 | Flux 2 Klein 4B |
| 快速迭代且最终细节丰富 | Flux 2 Klein 9B |
| 多参考品牌风格,外观一致 | Flux 2 Klein |
| 2K–4K 主图,最高分辨率 | Seedream 5 |
| 最大提示遵循度 + 极致细节 | Flux 2 Pro |
| 嵌入文本、标志、多语言标牌 | GPT Image 2 |
| 超写实肖像 | Nano Banana Pro |
如果用户明确提到 "Flux 2 Klein" / "BFL Klein" / "flux klein",则直接路由到此模型。如果他们泛泛地说 "Flux 2",则在默认之前询问他们想要 Klein(快速)还是 Pro(最高质量)。
前提条件
- RunComfy CLI —
npm i -g @runcomfy/cli - RunComfy 账户 —
runcomfy login打开浏览器设备码流程。 - CI / 容器 — 设置
RUNCOMFY_TOKEN=<token>代替runcomfy login。
端点 + 输入模式
两个变体,相同的端点形状,相同的提示语法。
blackforestlabs/flux-2-klein/9b/text-to-image
保真优先的变体。用于精修/最终输出。
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
prompt |
string | 是 | — | 最多约 512 个 token。更长会降低质量。 |
steps |
int | 否 | 25 | 4–50。步蒸馏架构——概念设计 4–8 步足够;精修约 25 步;超过 25 步收益甚微。 |
width |
int | 否 | 1024 | 通常 512–1536。宽高比上限 16:9,总像素最大约 2K。 |
height |
int | 否 | 1024 | 与 width 的宽高意图匹配。 |
blackforestlabs/flux-2-klein/4b/text-to-image
延迟优先的变体。亚秒级 4 步推理。用于实时迭代/概念设计。
字段集与 9B 相同。默认 steps 实际上为 4——该变体专为此步数设计。
参考图像(两个变体)
同一端点支持最多 4 张同时参考图像,用于风格迁移/引导构图。JSON 主体中的确切字段名记录在模型的 API 标签页上——通过 CLI 原样传递。参考图像的使用支持编辑风格的工作流,无需单独的 /edit 端点。
如何调用
快速概念设计(4B,亚秒级):
runcomfy run blackforestlabs/flux-2-klein/4b/text-to-image \
--input '{"prompt": "<用户提示>"}' \
--output-dir <绝对路径>
精修/最终(9B,约 25 步):
runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
--input '{
"prompt": "<用户提示>",
"steps": 25,
"width": 1024,
"height": 1024
}' \
--output-dir <绝对路径>
宽幅海报:
runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
--input '{"prompt": "<用户提示>", "width": 1536, "height": 864}' \
--output-dir <绝对路径>
CLI 提交请求,每 2 秒轮询直到完成,然后将结果中的任何 *.runcomfy.net / *.runcomfy.com URL 下载到 --output-dir。标准输出为结果 JSON。标准错误为进度。
适用于管道:
runcomfy --output json run blackforestlabs/flux-2-klein/4b/text-to-image \
--input '{"prompt":"..."}' --no-wait | jq -r .request_id
提示——实际有效的方法
这些是模型特定的模式,经验上能提高输出质量。
主体优先的声明式语法。 Flux 2 Klein 训练所用的结构是 "主体 + 动作 + 场景 + 风格 + 光照 + 相机 + 质量"。将主体放在前面;指令放在后面。示例:"A vibrant hummingbird mid-flight sipping nectar from a bright pink hibiscus, iridescent feathers in morning sun, soft bokeh tropical garden, macro photography, razor-sharp detail, cinematic lighting"。
具体性胜过华丽辞藻。 "4k product photo, softbox lighting, reflective table, 35mm, f/2.8" 可预测地引导。"A really pretty product image" 则不行。
按阶段选择步数。
- 概念设计:4B 变体 4–8 步——亚秒级反馈,适合实时探索。
- 细化:仍用 4B 变体 8–15 步,锁定主体和构图。
- 精修:9B 变体约 25 步——纹理、微细节、精细排版。
多参考对齐。 传递参考图像时,保持其美学风格一致。在同一调用中混合水彩 + 写实 + 3D 渲染会混淆编辑器。在所有参考中选择一种一致的视觉风格。
条件编辑:说明保留什么,然后改变什么。"Same composition and lighting as reference, but change the background from beach to mountain studio." 这种模式能稳定构图。
对于文本渲染(Klein 使用 8B Qwen3 嵌入器,效果不错但不及 GPT Image 2):添加 "crisp typography, high-contrast label" 并将步数提高到约 25(如果文本输出模糊)。对于大量图像内文本或多语言渲染,改用 GPT Image 2。
反模式:
- 不要使用冲突的形容词。"minimalist + ornate" 会相互抵消。
- 不要超过约 512 个 token。模型会降级,不会优雅地截断。
- 不要要求 4K——模型的分辨率上限约为 2K。
- 不要要求超宽(>16:9)——模型会裁剪。
优势场景
| 用例 | 为什么选择 Flux 2 Klein |
|---|---|
| 现场艺术指导会话 | 亚秒级反馈(4B)支持实时迭代 |
| 交互式产品可视化 | 快速 UI 预览和产品合成,无需批量等待 |
| 多参考品牌风格 | 跨参考的强风格一致性,实现统一资产包 |
| 快速概念设计到精修工作流 | 4B 用于探索,9B 用于最终输出——全程使用相同提示语法 |
| 消费级 GPU 友好推理 | 4B 变体可在普通硬件上运行;与自托管对比相关,但 RunComfy 托管同样适用 |
示例提示(已验证能产生强结果)
来自模型页面(BFL 示例):
A vibrant hummingbird mid-flight sipping nectar from a bright pink hibiscus
flower, iridescent emerald and sapphire feathers catching the morning sun,
soft bokeh tropical garden background, macro photography, razor-sharp
detail, cinematic lighting
产品照片模式:
A matte ceramic mug on a reclaimed-wood table, soft northern window light
from the left, shallow depth of field, 50mm prime, f/2.0, neutral
background, e-commerce ready, 4K product photography
品牌一致对(多参考):
Same composition and lighting as the reference image, but the bottle
label is now blue with white sans-serif typography reading "AURA";
keep the bottle silhouette, table, and shadow exactly as in the reference
限制
- 分辨率上限约 2K——如需更高原生分辨率,改用 Seedream 5。
- 宽高比上限 16:9——极端宽/高比例会被裁剪。
- 提示上限约 512 个 token——更长会降低质量;不会优雅截断。
- 参考图像上限 4 张——超过 4 张会增加延迟并稀释引导。
- 文本渲染——8B Qwen3 嵌入器有帮助,但 GPT Image 2 在嵌入文本精度上仍然胜出。
退出码
runcomfy CLI 使用 sysexits 风格码:
| 码 | 含义 |
|---|---|
| 0 | 成功 |
| 64 | CLI 参数错误 |
| 65 | 输入 JSON 错误/模式不匹配(例如 width: 4096 会返回 422) |
| 69 | 上游 5xx 错误 |
| 75 | 可重试:超时/429 |
| 77 | 未登录或 token 被拒绝 |
完整参考:docs.runcomfy.com/cli/troubleshooting。
工作原理
- 技能使用匹配模式的 JSON 主体调用
runcomfy run blackforestlabs/flux-2-klein/<variant>/text-to-image。 - CLI 使用用户的 bearer token 向
https://model-api.runcomfy.net/v1/models/blackforestlabs/flux-2-klein/<variant>/text-to-image发送 POST 请求。 - 模型 API 返回
request_id;CLI 每 2 秒轮询GET .../requests/<id>/status。 - 状态完成后,CLI 获取
GET .../requests/<id>/result并下载任何主机名以.runcomfy.net或.runcomfy.com结尾的 URL 到--output-dir。其他 URL 会被列出但不下载。 - 轮询时按
Ctrl-C会发送POST .../requests/<id>/cancel,这样你就不会为已停止的 GPU 付费。
此技能不是
不是自托管的 Flux 运行器。不是能力授予——依赖于有效的 RunComfy 账户。不是多租户。
安全与隐私
- Token 存储:
runcomfy login将 API token 写入~/.config/runcomfy/token.json,权限为 0600(仅所有者读写)。在 CI/容器中设置RUNCOMFY_TOKEN环境变量可完全绕过文件。 - 输入边界:用户提示通过
--input作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 主体通过 HTTPS 传输到模型 API。提示内容不存在 shell 注入风险。 - 第三方内容:你传递的图像/蒙版/视频 URL 由 RunComfy 模型服务器获取,而不是由你机器上的 CLI 获取。将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
- 出站端点:仅
model-api.runcomfy.net(请求提交)和*.runcomfy.net/*.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。 - 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。





