Black Forest Labs 发布 FLUX 3 Image:按边界框编辑,框外像素不变
10 月 1 日(周三),FLUX 系列背后的德国公司 Black Forest Labs 通过官方账号 @bfl_ai 发布 FLUX 3 Image——FLUX 3 多模态家族的图像分支。它用结构化 JSON 的边界框排布画面,多轮编辑后边界框之外的像素保持不动,最高输出 4K,单次编辑支持最多 10 张参考图。API 现已上线(10 月 8 日前五折),开放权重版本预计“未来几周”到来。

事件经过
10 月 1 日,Black Forest Labs 在官方 X 账号 @bfl_ai 宣布:“Introducing FLUX 3 Image. Control every pixel.”这是 7 月公布 FLUX 3 多模态架构(Self-Flow 框架,覆盖图像、视频、音频)之后,图像分支的首次产品化落地。新模型通过统一 API 端点提供两种能力:从零生成全新场景,或用文字指令 + 空间坐标修改已有图像,还默认开启搜索 grounding 来核验视觉细节(据第三方整理)。
核心功能是“像素级控制”:画面被映射到与长宽比无关的 0–1000 归一化网格上,每个元素有一个 ID、一段描述和一个边界框 [y_min, x_min, y_max, x_max],开发者可以直接给坐标,也可以用 LLM 从一句话生成排布表;边界框之间的区域在多轮编辑中保持原样。BFL 称其编辑是“pixel perfect”;有独立评测指出,公司示例之外的区域是否完全不变,需要用真实文件测试。
关键事实
- 发布形式:托管 API 与 playground 已上线,可免费试玩;10 月 8 日前 API 五折。企业可直接购买商业权重,在自己的基础设施上运行和微调。
- 开放权重:BFL 此前的做法是先托管、后开放。FLUX 3 Image 的开放权重版本预计“未来几周”发布,具体日期未定。
- 规格:原生输出最高 4K(含 5456×3072 示例);单次最多 10 张参考图拼场;边界框排布 + 多语言图像内文字渲染。早期测试者(Canva、Magnific、Krea、Picsart)称细节与场景连贯性优于 FLUX.2 Pro。
- 对手:发布前夕,Ideogram 也宣布了主打编辑的 4.5 版本,同样计划开放权重。
背景
在多家对比评测中,FLUX 排在 Midjourney V7、DALL-E 3、Imagen 3 之前。同一天,Cloudflare 发布开源决策模型 Clef,让智能体做结构化决策而不必生成文本。
为什么重要
FLUX 3 Image 用边界框限定编辑区域,多轮编辑后框外像素不变;这是 FLUX 3 图像分支首次产品化,开放权重预计未来几周发布。
评论
今天
10月12日 星期一- 早报亚马逊被曝洽购 AI 初创 Decart,交易估值约 70 亿美元
共 10 条 · 10月11日
- 三问
- 预测
