FLUX 3 Image发布:局部编辑不动其他像素

以Stable Diffusion起家的德国公司Black Forest Labs正式补上了FLUX 3家族的最后一块拼图:图像模型FLUX 3 Image。据The Decoder报道,新模型覆盖文生图、图生图、文字渲染和照片级写实生成,官方称其最大卖点是"多轮局部编辑"——只改你指定的区域,画面其余像素保持不动。
控制方式上,FLUX 3 Image引入了两项设计。一是边界框排版:用户可以在提示词后附加一组JSON格式的框(坐标以0到1000的网格表示),直接指定标题、人脸、版面元素各自落在哪里,既可用于从零构图,也可用于精准编辑——改色、移动、替换或删除某个元素而不触碰未标记区域。二是参考图合成:一次最多可传入10张参考图,由模型自行决定它们在画面中的位置并整体渲染。
输出方面,模型原生支持从768像素预览到约1600万像素的4K共15种宽高比,官方产品页展示的样张达到5456×3072,强调这是原生分辨率而非后期放大。定价按分辨率分档:768像素单张0.041美元、1K为0.048美元、2K为0.10美元、4K为0.607美元,是否附加参考图不影响单价。10月8日前API调用一律半价。
商业化路径延续了这家公司一贯的三步走:API即日上线(fal、Replicate、OpenRouter等平台首日接入),商业权重即刻开放给想在自有基础设施上微调部署的企业,开源权重版预计数周内放出。免费试用演示已经上线。
需要指出的是,"其余像素一个都不动"是Black Forest Labs自己的说法,尚无独立测试佐证;发布时官方也未公布与其他图像模型的跑分对比。而在竞品侧,这套能力并不新鲜:OpenAI的GPT Image 2.5被认为最擅长用一句指令做局部修改,谷歌Nano Banana支持14张参考图和原生4K,字节跳动Seedream 4.5同样支持10张参考图加4K输出,Midjourney V8编辑模型则只支持4张。就在FLUX 3 Image发布前不久,Ideogram也刚发布了同样主打局部编辑的4.5版本,同样计划放出开源权重。对于今年7月23日以视频、音频和机器人动作预测惊艳亮相的FLUX 3家族来说,把图像这步棋补完,更多是交还看家本领,而非开辟新战场。
编译自 The Decoder,原标题:"Black Forest Labs launches Flux 3 Image with multi-step editing that leaves the rest of your picture alone"