中文读懂 AI 与全技术今天发生了什么
← 返回首页
站内快照 · 国内可打开。外网原文可能无法访问。
Breaking the Uniformity Trap: Scaling Video Diffusion Model via SplitMoE
受大语言模型启发的混合专家(MoE)是扩展视觉生成模型的有前景范式,但传统token级MoE在同类专家池中独立路由token并趋向均匀化,限制了性能。本文提出SplitMoE方法。
原文链接