Skip to main content

FLUX(Black Forest Labs)| Stable Diffusion 原班人马的开放权重「第二幕」(2024–至今)

原 SD 核心团队出走后的回归之作——开放权重的高质量继任者

FLUX 是德国初创公司 Black Forest Labs(黑森林实验室) 于 2024 年推出的文本生成图像模型家族。它的特殊身份在于:开发团队正是 Stable Diffusion 的原始共同创建者——Robin Rombach、Andreas Blattmann、Patrick Esser 在离开 Stability AI 后另起炉灶,把潜在扩散的家底带进了这家新公司。因此 FLUX 被广泛视为开放权重路线的高质量「继任者」:既延续了 SD「把权重交给用户」的开放传统,又在画质、提示词遵循与文字渲染上把开源生图推到了新高度。在 Anianima 的软件资料库里,本条目与 Stable Diffusion 一脉相承(同一批人),并与闭源的 Midjourney、助手内嵌的 DALL·E 形成「开放 ↔ 闭源」的持续对照。

础信息(Metadata)

  • 软件名称:FLUX(FLUX.1 / FLUX.1 Kontext / FLUX.1 Krea / FLUX.2 系列)
  • 首次发布:2024 年 8 月(FLUX.1,随 Black Forest Labs 成立发布)
  • 主要开发者 / 机构:Black Forest Labs(德国弗赖堡;创始人 Robin Rombach、Andreas Blattmann、Patrick Esser,均为 Stable Diffusion 原始共同创建者)
  • 软件类别:创作与设计(主)/ 资产制作
  • 运行平台:开放权重(dev / schnell / krea / FLUX.2 dev 可本地下载,经 ComfyUI 等运行)+ 官方 API 与合作平台(pro / flex 闭源)
  • 授权模式:混合——开放权重(dev / Kontext dev / krea 偏非商业许可,schnell 为 Apache-2.0 可商用)与闭源 API(pro / flex)并存;不可笼统称为”完全开源”
  • 官方网站:blackforestlabs.ai(bfl.ai)
  • 当前状态:⚠️ 活跃;当前主线为 FLUX.2 系列(dev 32B 开放权重 + klein 轻量版),2025 年 11 月起接棒 FLUX.1

👾 本节部分内容由AI整理生成,人工复检紧张排期中,请谨慎参考,极度欢迎专业人士加入纠错团队!

历史背景与发展历程(Historical Context & Development)

FLUX 的故事是一条「出走的原班人马,回家重做一遍」的弧线。

Black Forest Labs 的三位创始人——Robin Rombach(Stable Diffusion 第一作者)、Andreas Blattmann、Patrick Esser——正是当年在 CompVis / Stability AI 打造 Latent Diffusion 与 Stable Diffusion 的核心研究者(Patrick Esser 同时也是 🔗Runway 的研究员背景)。离开 Stability AI 后,他们于 2024 年在德国弗赖堡创立 Black Forest Labs,并在 2024 年 8 月随公司成立同步发布 FLUX.1:一个 120 亿参数、基于整流流(rectified flow)/ 流匹配 Transformer 的文生图模型。同期公司获得 a16z 领投的约 3100 万美元种子轮

FLUX.1 一出手就定下「分层开放」的基调:闭源的 [pro] 走 API、开放权重的 [dev] 限非商业、[schnell] 则以 Apache-2.0 许可放开商用——这让「FLUX 开源」成为一种需要拆开看的说法。2025 年 5 月,BFL 推出 FLUX.1 Kontext,把能力从「纯生成」扩展到上下文感知的图像编辑与角色一致性(支持多轮修改、多参考图),并随后开源 Kontext [dev]——这一步直接命中动画与影视最看重的「跨镜头一致性」。2025 年下半年,与 Krea 合作的 FLUX.1 Krea [dev] 开放权重,主打更自然、少「AI 感」的美学。

2025 年 11 月,BFL 发布 FLUX.2FLUX.2 [dev] 升至 320 亿参数、开放权重,支持多参考图生成与角色一致性,并宣布登陆 Adobe Firefly;同期公司完成 3 亿美元 B 轮、估值约 32.5 亿美元(媒体报道口径),Adobe、Canva 等开始集成其模型。2026 年 1 月 15 日,轻量化的 FLUX.2 [klein](德语「小」)发布,把高质量生成压到消费级显卡可运行的体量。

⚠️ 开放度澄清:FLUX 是「开放权重 + 闭源 API」的混合体,不能笼统说成「完全开源」。[pro] / [flex] 为闭源 API;[dev] / Kontext [dev] / Krea [dev] 为开放权重但多为非商业许可;[schnell] 才是 Apache-2.0(可商用)。此外,FLUX.2 [dev] 虽开放权重,却是 320 亿参数、数十 GB 体量的「大块头」,真正面向消费级的是轻量的 [klein]——”开放”与”能跑”是两回事。


核心功能与技术特征(Core Features & Technical Character)

FLUX 的核心身份是以整流流 Transformer 为底座、把「开放权重」做到旗舰级画质的文生图模型家族;Kontext 则把它从「生成器」扩展为「可对话的图像编辑器」。

📅 本部分基于 FLUX.1 / Kontext / Krea / FLUX.2(2024–2026)撰写;参数与版本差异以官方模型卡为准。

技术要点:

  • 整流流 / 流匹配 Transformer:
    • 继承并发展 Latent Diffusion 的潜空间思路,改用整流流(rectified flow)+ Transformer 主干,配合并行注意力,在画质、提示词遵循与文字渲染上明显强于 SD 1.x 时代的 U-Net。
  • 分层开放:
    • 同一架构按 [pro](闭源 API)/ [dev](开放权重、非商业)/ [schnell](开放权重、Apache-2.0)/ [klein](轻量)分层,覆盖从企业 API 到本地部署的不同需求。
  • Kontext 上下文编辑:
    • 接受文本 + 图像双输入,做上下文感知的局部编辑、风格迁移与角色一致性,支持多轮修改——把「改图」变成可对话、可复现的过程。
  • 多参考图与一致性(FLUX.2 起):
    • 支持多张参考图联合生成,跨图保持角色 / 物体一致,直指动画与影视的可控生产。
  • Krea 美学调校:
    • Krea [dev] 主打更自然、更「不像 AI」的观感,回应社区对「AI 味过重」的批评。
  • 本地部署与生态:
    • 开放权重版本可经 ComfyUI 等前端在本地 / 私有环境运行,延续 SD 建立的自托管生态。

代表性应用案例(Representative Uses)

FLUX 自 2024 年以来,是开放权重阵营里画质最能打的选择之一,典型落点包括:

  • 动画 / 影视概念与角色一致性: Kontext 的多轮编辑与角色一致性,让「同一角色跨镜头稳定」成为可控操作,直接服务分镜、概念图与设定稿。
  • 设计 / 电商 / 品牌视觉: 高画质 + 文字渲染改善,适合海报、产品图与营销物料。
  • 本地 / 私有管线: 开放权重版本进入 ComfyUI 等自托管管线,满足对数据与可控性有要求的团队。
  • 专业创意生态集成: 经 Adobe Firefly、Canva 等集成,FLUX 能力被嵌进现有设计工作流。
  • 美学向创作: Krea [dev] 面向追求「自然、少 AI 感」的插画与摄影感创作。

说明:以上为该类工具的典型用途归纳,未断言具体影片以 FLUX 完成成片制作;涉及单一生产请以官方与创作者披露为准。

版本迭代中的关键技术更新(Milestone Versions + Legacy)

👾 版本清单由AI整理生成,请谨慎参考

FLUX 的版本线以「FLUX.1 奠基 → Kontext/Krea 扩展 → FLUX.2 换代」推进:

FLUX.1 [pro] / [dev] / [schnell](2024-08)
  • 120 亿参数整流流 Transformer;随 BFL 成立发布,奠定「分层开放」格局(pro 闭源 API / dev 非商业 / schnell Apache-2.0)。
FLUX.1 Kontext(2025-05)
  • 上下文感知图像编辑与角色一致性,多轮修改;Kontext [dev] 随后开源。
FLUX.1 Krea [dev](2025 下半年)
  • 与 Krea 合作的开放权重版本,主打更自然、少「AI 感」的美学。
FLUX.2 [dev] / [pro] / [flex](2025-11)
  • dev 升至 320 亿参数、开放权重;多参考图生成与角色一致性;宣布登陆 Adobe Firefly。
FLUX.2 [klein](2026-01-15)
  • 轻量化、低延迟,把 FLUX.2 级质量压到消费级显卡可运行,面向交互式创作形态。

版本代际与技术脉络

把 FLUX 放进 AI 生图的演进脉络,它扮演的是「开放权重路线正统继承者」的角色:

  • 谱系延续: Latent Diffusion(CompVis / LMU)→ Stable Diffusion(Stability AI)→ 团队出走 → FLUX(Black Forest Labs)。FLUX 本质上是 SD 核心技术血脉的「第二幕」,这也让它的开放权重姿态格外有分量。
  • 架构换代: 从 SD 的「潜扩散 + U-Net」转向「整流流 + Transformer」,与 SD 3.5 的 MM-DiT、GPT Image 的原生多模态同处一条「告别 U-Net」的河流。
  • 开放 ↔ 闭源的中间态: 与完全闭源的 Midjourney、完全靠 API 的 DALL·E 不同,FLUX 用「分层开放」试图两头通吃——开放权重养生态、闭源 API 赚营收。这套打法能否持续,是观察开放路线商业可持续性的重要样本。

需要厘清的是:FLUX 不是另起炉灶的新物种,而是 SD 那批人把同一件事做得更好的一次回归。读本站 Stable Diffusion、LoRA、ComfyUI 等条目时,请把 FLUX 放进这条「潜在扩散 → 开放权重」的血脉里理解。


结语

FLUX 的意义在于:它是 Stable Diffusion 原班人马出走后的「回归之作」,用整流流 Transformer 把开放权重生图的画质与可控性推到旗舰级,又以 Kontext 的角色一致性、多轮编辑,把「开放模型」从一次性生成器变成可对话的创作伙伴。它证明了开放权重路线在 2024 之后仍能与闭源旗舰同台竞技——而这正是它的缔造者们 2022 年就点燃的那把火。

它与 Stable Diffusion 是同一条血脉的两段:SD 把「模型交给用户」变成现实,FLUX 则试图证明这件事在商业上也能成立。至于「分层开放」能否在 Midjourney 的闭源美学与 GPT Image 的原生多模态之间走出一条长久的窄路,是这段历史留给 2026 年之后的开放命题。