Sora 扔掉的那把钥匙,如今被 Meta 捡了起来。8 月 19 日,科技媒体 TestingCatalog 披露,Meta 正在对全新视频生成模型 Muse Video 做封闭测试,单次最多生成 10 秒视频。10 秒是什么概念,短视频里一个人说一句开场白的时间。可就是这 10 秒,被 Meta 当成敲门砖,敲向这个 2026 年已经杀红眼的 AI 视频赛道。
10 秒的模特,藏着接近天花板的细节
按 TestingCatalog 的说法,Muse Video 在精细细节、世界理解、时间连续性上展现出接近行业天花板的潜力。所谓时间连续性,指的是帧与帧之间不再跳帧、闪屏、物体错位,这正是早期 AI 视频最劝退的硬伤。模型还支持原生音频,生成画面时同步产出声音,省掉二次配音的功夫。
Meta 并不讳言短板,官方明确承认两个缺口:音画不同步,以及高速运动的物理模拟不准确。让一只玻璃杯缓缓倾倒它做得很好,让一辆车在急刹时甩尾打滑,它可能就会把牛顿推翻在地。
何况 10 秒的窗口,决定了眼下一切都是限定范围内的表演。长叙事、角色一致性、高强度动作场景,这些真正决定一个视频模型能否上桌吃饭的能力,都还没有被大规模验证。TestingCatalog 也强调,目前仍没有确认的公开发布时间,它尚处于早期技术验证阶段。
迟到的 Meta,手里握着别人没有的东西
论模型能力,Meta 不算快。上一代研究模型 Movie Gen 是 300 亿参数、最长 16 秒,外加一个 130 亿参数的音频模型,但始终停在论文与演示层面,迟迟没有铺成消费级产品。而快手可灵、字节 Seedance 这些国内玩家,早把一致性、运动性这些硬骨头啃了大半。
但 Meta 真正的牌不在技术,在分发。它旗下全家桶应用的月活跃用户接近 40 亿,日活跃约 36 亿,Instagram 日活已破 20 亿,Meta AI 自身月活据估已超 15 亿。Muse Video 一旦嵌进 Meta AI、Vibes 信息流或 Instagram,等于把生成器直接塞进全球最大的短视频消费场景。别的模型厂商要烧钱买流量,Meta 自己就握着流量。
为什么偏偏是 10 秒
答案藏在赛道结构里。短视频、广告贴片、电商素材、漫剧预告,目前 AI 真正能渗透的商用场景,绝大多数都集中在十几秒以内的片段。10 秒不是能力上限,而是商业端口的宽度。Meta 先拿最短、最稳的时窗敲开门,把能用跑通成能赚,再谈更长的叙事。
这个思路和它布局商业化的节奏一脉相承。据外媒报道,Meta 早把 AI 生成广告写进了 2026 年的规划,品牌只需上传产品图和预算,AI 就能自动产出图文、视频并完成定向投放。Muse Video 不是孤立的模型,而是这条自动化广告和内容生产链条上最关键的一环。
价格战白热化的档口,迟到者还有没有位置
2026 年的定价战已经打到肉搏。据研报数据,国产 5 秒视频约 0.4 美元,而谷歌 Veo 的 5 秒约 5 美元,价差超过十倍。可灵 3.0 与 Seedance 2.0 被普遍视为当前全球第一梯队,可灵上线一年全球用户据称已到 2200 万。Meta 此时进场,要么靠生态补贴打低价,要么靠分发把边际获客成本打到趋近于零,后者的想象空间显然更大。
音画、物理、长叙事,是所有人的老难题
这三个问题并非 Meta 独有,而是全行业共性硬伤。MiniMax 的海螺早被指出音画不同步需后期配音,OpenAI 的 Sora 2 被批生成画面有明显游戏感,其消费级应用 Sora 也于今年 3 月关停退场。Meta 老老实实承认自己同样存在短板,恰恰说明视频生成距离通用内容生产力仍有一段落差,所有想冲刺长视频与高强度动作的玩家,都得先翻过这三道坎。
按 TestingCatalog 的实测表述,Muse Video 在精细细节、世界理解与时间连续性上表现出行业领先潜力,同时 Meta 承认音画同步与高速运动物理模拟仍存在缺口,且当前没有确认的公开发布时间。
模型可以追上,渠道很难被复制
Muse Video 单独看只是一次 Beta,放进布局看却是一枚重子。Meta 赌的是分发为王能否在 AI 视频时代延续。模型胜负未分,渠道已分出高下。对国产玩家而言,这尾鲶鱼的威胁不在技术,而在于当大家还在为一条 5 秒视频打折促销时,Meta 正把生成器免费塞进几十亿人天天点开的 App 里。
10 秒装下的从来不是画面,而是 Meta 想重塑的那张内容版图。模型可以追上,渠道很难被复制。






快报