[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"news-f1397080-206a-469f-846c-932a4b3ab8f9":3},{"id":4,"title":5,"summary":6,"original_url":7,"source_id":8,"tags":9,"published_at":23,"created_at":24,"modified_at":25,"is_published":26,"publish_type":27,"image_url":13,"view_count":28},"f1397080-206a-469f-846c-932a4b3ab8f9","京东开源 JoyAI-Image：统一多模态基础模型，把「理解-生成-编辑」拧成一个闭环","京东（jd-opensource）正式开源 JoyAI-Image——一款真正意义上的统一多模态基础模型。它用一个 8B 多模态大语言模型（MLLM）做理解中枢，搭配 16B 多模态扩散 Transformer（MMDiT）做生成引擎，把「图像理解、文生图、指令式图像编辑」三件事拧进同一个模型族。\n\n最值得关注的是它的「理解⇄生成」闭环设计：以往的多模态系统理解归理解、生成归生成；JoyAI-Image 把两边打通——更强的空间理解反哺生成质量与可控编辑，而生成出的新视角又能为空间推理提供证据。这种双向激励的范式在国内开源多模态里相当少见。\n\n技术细节上，它在长文本排版、多视角生成、几何感知的空间编辑（Object Move \u002F Object Rotation \u002F Camera Control）上做了专项优化，在 spatial reasoning 与 Qwen-Image-Edit、Nano Banana Pro 等同台对标。模型权重、Diffusers 集成、ComfyUI 工作流、HuggingFace Demo 一并释放，Apache 2.0 完全开源。\n\n7 月 17 日最新更新：JoyAI-Image-Edit 与 Edit-Plus 原生支持 ComfyUI，可直接拖入工作流运行，无需额外依赖。\n\n这条路径的真正意义在于：当行业还在争论「理解派」和「生成派」谁主导，京东用统一架构给出了答案——边界本来就不必分。短期内，这会给 Qwen-Image-Edit、Seedream 等开源图像模型压力；长期看，「理解⇄生成」的双向激励范式有可能成为下一代多模态模型的标配。","https:\u002F\u002Fgithub.com\u002Fjd-opensource\u002FJoyAI-Image","137ed312-2c62-42a3-be83-8e32d7b81e56",[10,14,17,20],{"id":11,"name":12,"slug":12,"description":13,"color":13},"7e89b5cc-57db-4f37-bc6d-28919a73931c","model-release",null,{"id":15,"name":16,"slug":16,"description":13,"color":13},"499f4b56-819d-49a3-9609-33e775143b86","multimodal",{"id":18,"name":19,"slug":19,"description":13,"color":13},"b9bd9039-fcdb-41a8-b85b-fc1587def2b9","open-source",{"id":21,"name":22,"slug":22,"description":13,"color":13},"c883fd20-1d66-4fb7-9fc7-320fa7f87023","text-to-image","2026-07-20T06:00:00Z","2026-07-20T06:06:49.626150Z","2026-07-20T06:06:49.626160Z",true,"agent",6]