返回首页

Muse Video 是什么?Meta AI 视频模型、能力与开放状态

基于 Meta 官方资料解析 Muse Video:已确认能力、原生音频、开放状态、当前局限、提示词方法和官方预览证据。

最近更新: 2026-07-10

Muse Video 是什么?

Muse Video 是 Meta Superintelligence Labs 在 2026 年 7 月 7 日预览的 AI 视频生成模型。Meta 表示它与 Muse Image 共享预训练基础,并重点强调提示词遵循、视觉保真度、时间一致性和原生音频四个方向。它是真实存在的 Meta 模型,但目前不能等同于已经全面开放的公共产品或 API。

需要明确区分:Muse AI Video 是独立的研究与创作工作站,不是 Meta 官方产品。 本站生成器会展示任务实际调用的模型,不会把 Seedance 或其他可用模型的结果重新包装为官方 Muse Video 输出。

当前状态一览

| 问题 | 已核实答案 | 信息状态 | |---|---|---| | 开发者 | Meta Superintelligence Labs | Meta 已确认 | | 首次预览 | 2026 年 7 月 7 日 | Meta 已确认 | | 是否全面开放 | Meta 表示未来将向创作者和 Meta AI 开放 | 尚未全面开放 | | 是否有公共 API | 尚未公布通用 API 规范或上线时间 | 未确认 | | 是否支持原生音频 | Meta 将原生音频列为核心方向 | 已确认方向 | | 当前已知局限 | 音画同步、物理准确的高速运动 | Meta 已确认 | | 发布时排名 | Meta 引用的 7 月 5 日快照中位列文生视频 Arena 第三 | 时间点快照 |

开放状态会变化,请结合日期阅读,并查看持续更新的 Muse Video 发布追踪

已确认的核心能力

提示词遵循

提示词遵循不只是画面好看,而是主体、动作、环境、镜头、节奏、声音和结尾是否按照要求出现。产品视频中即使光影漂亮,只要产品形状变化、Logo 消失或镜头运动错误,仍然属于失败结果。

视觉保真度

视觉保真度包括人物和物体细节、材质、光线、空间纵深与整体电影感。官方预览展示了较高质量的精选结果,但单帧质量不能代替对身份稳定、运动连续和生成成功率的检查。

时间一致性

视频中的脸、服装、产品、背景结构、阴影和镜头位置需要在连续帧中保持稳定。你可以在 Muse Video 官方案例分析 中按照统一方法检查这些表现。

原生音频

原生音频意味着对白、环境声、音效和音乐可以与画面一起规划,而不是最后随意贴上一条声音。提示词应指出声源、距离、情绪和触发时间。Meta 同时承认音画同步仍需改进,因此“支持原生音频”不代表口型和高速动作声音已经完全准确。

仍未公布的信息

Meta 尚未发布完整的公共规格,包括最长时长、分辨率、宽高比、价格、地区、商业授权、速率限制、参考图控制和 API 请求格式。第三方页面如果展示完整 Muse Video 价格表或 API 参数,应同时提供可核验的官方来源。

官方明确提到的两项局限是:

  • 音频与视频同步仍在改进。
  • 物理准确的高速运动仍存在不足。

对白、撞击、体育动作、液体、快速手部动作和复杂物体交互都应通过多次原始输出测试,不能只依据一段精选 Demo 判断。

如何提前准备 Muse Video 提示词

一份可复用的视频制作简报应包含:

  1. 主体:人物、动物、产品或主要物体。
  2. 动作:在视频时长内可以清楚完成的一件事。
  3. 环境:地点、天气、时间与背景活动。
  4. 镜头:景别、角度、运动路径和速度。
  5. 连续性:脸、服装、Logo、包装和空间中不能改变的内容。
  6. 光线:光源方向、色温、对比与时间氛围。
  7. 节奏:开场、发展和最后一个画面节点。
  8. 声音:对白、环境声、音效、音乐和同步点。

完整模板和案例见 Muse Video 提示词指南。现在也可以在 AI 视频生成器 中使用实际标注的可用模型测试同一份制作简报。

本站如何核验新信息

我们将内容分为 Meta 官方事实、带日期的榜单快照和编辑分析,不把发布公告推断成未经证实的价格或产品参数。未来开放后,应使用相同提示词和参考素材,多次测试提示词遵循、身份稳定、镜头运动、物理表现、声音同步、失败率、生成时间和每个可用结果的实际成本。

官方来源

最后核实日期:2026 年 7 月 10 日。