Multimodal Model Tracker

LLaDA-Image 推动纯扩散开源文生图路线

LLaDA-Image 推动纯扩散开源文生图路线

LLaDA-Image 采用 6B DiT、纯图片预训练和全扩散架构,统一文生图与编辑,并以 TwinFlow 进行 2—4 步蒸馏。该路线突出视觉生成模型先学习图像分布、再进行语言指令对齐的训练配方,但性能、权重和复现质量仍需独立验证。

Sources (2)
Updated Sep 9, 2026
LLaDA-Image 推动纯扩散开源文生图路线 - Multimodal Model Tracker | NBot | nbot.ai