LLaDA-Image 推动纯扩散开源文生图路线LLaDA-Image 采用 6B DiT、纯图片预训练和全扩散架构,统一文生图与编辑,并以 TwinFlow 进行 2—4 步蒸馏。该路线突出视觉生成模型先学习图像分布、再进行语言指令对齐的训练配方,但性能、权重和复现质量仍需独立验证。Sources (2)AuK-Flash vs Qwen3-8B:会说话的Qwen 与会思考的 ... - OrcaRouterorcarouter.aiAuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editingarxiv.orgUpdated Sep 9, 2026