Sand.ai今日开源了全球首个千亿参数的MoE(混合专家)视频生成模型,该模型拥有1140亿参数但仅需激活60亿参数,大幅降低推理成本,为视频生成领域树立新标杆。
详细分析
这一开源事件标志着视频生成模型进入新的竞争阶段。此前,视频生成领域由OpenAI的Sora、Runway Gen-3等闭源模型主导,但高昂的训练和推理成本限制了行业普及。Sand.ai此次发布的模型采用MoE架构,通过稀疏激活机制,在保持千亿级参数容量的同时,将推理时激活参数压缩至6B,显著降低计算资源需求。这一技术路线与谷歌的Mixtral、国内的DeepSeek-MoE等语言模型思路一脉相承,但首次在视频生成领域实现。从行业角度看,MoE架构的应用有望解决视频生成模型“规模大但效率低”的痛点,推动该技术向中小企业和开发者普及。市场反应方面,开源社区已出现大量关注,Hugging Face上的模型下载量在发布后24小时内即突破数万次。竞争格局上,Sand.ai此举可能迫使其他头部玩家调整策略:一方面,闭源模型需在效果上拉开差距;另一方面,其他开源团队如智谱AI、阿里通义等或加速跟进MoE路线。此外,该模型的商业潜力巨大——企业可按需调用激活参数,降低API调用成本,从而催生更多视频生成应用,如自动化广告制作、虚拟数字人、影视预演等。然而,挑战依然存在:MoE模型的训练复杂性高,且开源后的伦理风险(如深度伪造)需行业共同应对。总体而言,Sand.ai此次开源不仅是技术突破,更可能重塑视频生成行业的成本结构和创新生态。
开源MoE视频模型,或将引发行业效仿潮,加速AI视频生成商业化落地。
原文:量子位