FLUX.2 klein 4B — Core AI

Apple Core AI 格式的 FLUX.2 klein 4B, 可在 macOS 26 / iOS 26 及以上直接经 CoreAIDiffusion 加载运行。

⚠️ 本仓库是修改后的衍生作品(Apache License 2.0 §4(b) 声明)

原始权重由 Black Forest Labs 以 Apache License 2.0 发布。本仓库内的文件已被修改, 具体变更如下:

变更 说明
格式转换 PyTorch safetensors → Core AI .aimodel(MLIR 字节码)
量化 float16 → int4,per-block 粒度,block_size=32
图追踪 torch.export 追踪为 8 个入口的 multi-function 资产

未对模型架构或训练权重的数值语义做任何人为调整,全部变更均由 Apple 官方导出工具产生。

来源与可复现性

源模型 black-forest-labs/FLUX.2-klein-4B
源 commit e7b7dc27f91deacad38e78976d1f2b499d76a294
导出工具 apple/coreai-models @ e282dbdd4339f16cac14da80fbcbd185d90dd12a
转换器 coreai-torch 0.4.2
导出命令 uv run coreai.diffusion.export flux2-klein-4b --platform macOS

任何人都可用上述命令复现出等价产物。

内容

资产 大小 说明
Transformer.aimodel 2.0 GB DiT,25 blocks。multi-function,含 8 个入口
TextEncoder.aimodel 1.6 GB Qwen3 编码器,取中间层 9 / 18 / 27
VAEDecoder.aimodel / _half 95 MB ×2 latent → 像素(1024 / 512)
VAEEncoder.aimodel / _half 66 MB ×2 像素 → latent(图生图用)
tokenizer/ 11 MB Qwen3 tokenizer
metadata.json 流水线描述

Transformer 的 8 个入口:mainhalfimg2img_{quarter,half,full}img2img_512_{quarter,half,full} —— 共享同一份权重。

用法

import CoreAIDiffusionPipeline

let pipeline = try await Flux2Pipeline(from: modelURL)
let config = PipelineConfiguration(
    prompt: "a calico cat wearing a tiny wizard hat",
    seed: 42, stepCount: 4, guidanceScale: 1.0,
    schedulerType: .discreteFlow)
let result = try await pipeline.generateImages(configuration: config)

图生图额外设置 startingImagereferenceGrid.full / .half / .quarter)。 **注意 FLUX.2 忽略 strength**,引导强度由 referenceGrid 决定。

实测性能(Apple M1 Max / 64 GB / macOS 27.0)

配置 耗时 峰值内存
1024×1024,4 步 21.1 s 6.15 GB
1024×1024,8 步 38.5 s 6.15 GB
512×512,4 步 7.8 s 4.36 GB
图生图 1024,half grid 26.6 s 7.07 GB

首次运行约 32.5 s —— Core AI 需在设备端编译一次, 并在 ~/Library/Caches/coreai-cache/ 生成约 3.8 GB 特化缓存;之后每次约 21 s。 系统大版本升级后缓存会失效并重新编译。

已知限制

  • 仅支持 1024×1024 与 512×512 两档(导出时固定)
  • 图生图与 tiled decode 互斥(VAE 编码器形状不匹配,会抛错)
  • 不支持 LoRA —— .aimodel 的权重已编入编译产物

许可

Apache License 2.0,继承自原始模型。完整文本见本仓库 LICENSE

原始模型版权归 Black Forest Labs 所有。

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for dushandz/FLUX.2-klein-4B-CoreAI

Quantized
(40)
this model