Multimodal Model Tracker

原生统一视觉理解—生成架构与 DeepSeek V4.1-Flash 信号升温

原生统一视觉理解—生成架构与 DeepSeek V4.1-Flash 信号升温

Intern Lumina U2 的 AToken、多码本全离散扩散和 16BA1B 稀疏 MoE,以及 SenseNova-U1.5 的 8B-MoT、NEO-unify 和原生 4K,代表统一理解、生成与编辑路线。DeepSeek V4.1-Flash 的 YOCO、Engram、KV 缓存压缩和 1M 上下文仍缺乏公开技术资料、权重与独立评测。

Sources (6)
Updated Sep 16, 2026