FLUX.2 模型家族詳解
核心模型對比
| 模型 | 引數量 | 許可證 | 最佳用途 | VRAM 需求 |
|---|---|---|---|---|
| FLUX.2 [klein] 4B | 4B | Apache 2.0 | 實時應用、邊緣部署 | ~8GB |
| FLUX.2 [klein] 9B | 9B | 非商業許可 | 高質量文生圖 | ~16GB |
| FLUX.2 [klein] 9B KV | 9B | 非商業許可 | 多圖編輯(最快) | ~16GB |
| FLUX.2 [dev] | 32B | 非商業許可 | 最高質量、無延遲限制 | ~24GB |
如何選擇模型?
選擇 4B 模型,如果:
- 你需要實時生成(<1 秒)
- 你只有消費級 GPU(RTX 3090/4070)
- 你需要商用許可(Apache 2.0)
- 你想做 LoRA 微調
選擇 9B 模型,如果:
- 你需要更高質量的文生圖
- 你有 16GB+ VRAM
- 你只做個人/研究用途
選擇 dev 32B 模型,如果:
- 質量優先,不在乎速度
- 你有專業級 GPU(RTX 4090/A100)
- 你需要最豐富的輸出多樣性
本地部署:使用 ComfyUI
環境準備
# 建立虛擬環境
python3 -m venv flux2-env
source flux2-env/bin/activate
# 安裝 ComfyUI
git clone https://github.com/comfyanonymous/ComfyUI.git
cd ComfyUI
pip install -r requirements.txt
# 安裝 FLUX.2 專用節點
pip install comfyui-flux2
下載模型
# 從 Hugging Face 下載 4B 模型(推薦)
cd ComfyUI/models/unet
wget https://huggingface.co/black-forest-labs/FLUX.2-klein-4B/resolve/main/flux2-klein-4b.safetensors
# 下載 T5 文字編碼器
cd ../text_encoders
wget https://huggingface.co/comfyanonymous/flux_text_encoders/resolve/main/t5xxl_fp8_e4m3fn.safetensors
# 下載 VAE
cd ../vae
wget https://huggingface.co/black-forest-labs/FLUX.2-dev/resolve/main/ae.safetensors
ComfyUI 工作流範例
FLUX.2 的工作流與傳統 Stable Diffusion 類似,但需要注意:
- 使用正確的取樣器:推薦使用
euler或dpmpp_2m - 步數設定:
- Distilled 模型(4B/9B):4 步即可
- Base 模型:需要 50 步
- 解析度:原生支援 4MP(如 2048×2048、2560×1536)
API 呼叫:使用官方 API
如果你不想本地部署,Black Forest Labs 提供官方 API:
Python SDK 範例
import requests
API_KEY = "your-api-key"
API_URL = "https://api.bfl.ai/v1/flux-2-pro"
def generate_image(prompt, width=1024, height=1024):
response = requests.post(
API_URL,
headers={
"Authorization": f"Bearer {API_KEY}",
"Content-Type": "application/json"
},
json={
"prompt": prompt,
"width": width,
"height": height,
"num_inference_steps": 4
}
)
return response.json()["result"]["url"]
# 使用範例
image_url = generate_image(
"A futuristic cityscape at sunset, cyberpunk style, neon lights, 4k detailed"
)
print(f"Generated image: {image_url}")
API 定價(2026 年)
| 模型 | 價格/張 | 速度 |
|---|---|---|
| FLUX.2 [klein] 4B | $0.003 | <1 秒 |
| FLUX.2 [klein] 9B | $0.006 | ~2 秒 |
| FLUX.2 [dev] 32B | $0.015 | ~5 秒 |
影象編輯功能
FLUX.2 的核心優勢之一是統一的編輯架構。你可以用同一個模型完成:
單圖編輯(風格遷移)
# 將影象 1 轉換為影象 2 的風格
response = requests.post(
API_URL + "/edit",
json={
"prompt": "Make it look like a vintage poster",
"image_url": "https://example.com/source.webp",
"reference_url": "https://example.com/style.webp"
}
)
多圖參考生成
# 結合多個參考圖生成新影象
response = requests.post(
API_URL + "/multi-reference",
json={
"prompt": "A person wearing the sweater from image 1",
"reference_images": [
"https://example.com/person.webp",
"https://example.com/sweater.webp"
]
}
)
效能基準測試
根據 Black Forest Labs 官方資料(RTX 4090):
| 任務 | FLUX.2 4B | FLUX.2 9B KV | FLUX.1 |
|---|---|---|---|
| 文生圖(4MP) | 0.8 秒 | 0.6 秒 | 3.2 秒 |
| 單圖編輯 | 0.9 秒 | 0.7 秒 | 4.1 秒 |
| 多圖編輯 | 1.2 秒 | 0.9 秒 | 5.8 秒 |
速度提升:相比 FLUX.1,FLUX.2 快 4-5 倍!
實戰技巧
1. 提示詞工程
FLUX.2 對自然語言理解更好,不需要複雜的標籤堆砌:
✅ 推薦:
"A middle-aged man in a green military jacket standing outdoors,
photorealistic, natural lighting, earthy tones"
❌ 避免:
"man, green, jacket, military, outdoors, 8k, ultra detailed,
masterpiece, best quality, (photorealistic:1.3)"
2. 解析度選擇
- 1024×1024:快速迭代、社群媒體
- 2048×2048:高質量輸出、列印
- 2560×1536:寬屏桌布、橫幅
3. 負面提示詞(可選)
FLUX.2 通常不需要負面提示詞,但以下情況可以使用:
negative_prompt = "blurry, low quality, distorted, watermark, text"
與其他模型對比
| 特性 | FLUX.2 4B | Midjourney v7 | DALL-E 3 | SDXL Turbo |
|---|---|---|---|---|
| 速度 | 0.8 秒 | 10-30 秒 | 5-10 秒 | 0.3 秒 |
| 質量 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 開源 | ✅ | ❌ | ❌ | ✅ |
| 可商用 | ✅ | ❌ | ❌ | ✅ |
| 本地部署 | ✅ | ❌ | ❌ | ✅ |
| 影象編輯 | ✅ | ❌ | ❌ | ❌ |
結論:FLUX.2 在速度、質量、開源和可商用之間取得了最佳平衡。
常見問題
Q: FLUX.2 可以商用嗎?
A:4B 模型使用 Apache 2.0 許可,可以商用。9B 和 dev 模型僅限非商業用途。
Q: 我的 GPU 顯存不夠怎麼辦?
A:使用 FP8 量化版本,可以將顯存需求降低 40%。或者使用官方 API。
Q: 支援哪些解析度?
A:原生支援 4MP 及以下解析度。常見尺寸:1024×1024、2048×2048、2560×1536、1536×2560。
Q: 可以微調嗎?
A:可以!使用 Base 版本(非 distilled)進行 LoRA 微調效果最佳。
資源連結
總結
FLUX.2 是 2026 年最值得關注的開源 AI 影象生成模型。它結合了:
- ✅ 速度:亞秒級生成
- ✅ 質量:4MP 照片級真實輸出
- ✅ 可控性:支援文生圖、單圖/多圖編輯
- ✅ 開放性:4B 模型 Apache 2.0 可商用
- ✅ 易用性:ComfyUI、API 多種部署方式
無論你是開發者、設計師還是 AI 愛好者,FLUX.2 都值得加入你的工具箱。
下一步:從 4B 模型開始嘗試,體驗亞秒級 AI 影象生成的魅力!