Genmo 当前官网的核心是开放视频模型 Mochi 1,而不只是一个普通网页生成器。官方提供托管 Playground,同时开放代码与权重,用户可以通过 GitHub、Hugging Face 或 ComfyUI 在自己的环境运行和修改模型。
在线试用还是本地运行
| 路线 | 适合对象 | 需要承担 |
|---|---|---|
| Playground | 快速验证提示和运动效果 | 账号、额度与云端规则 |
| ComfyUI | 视觉化组合节点与批处理 | 模型文件、显存和节点版本 |
| 源码部署 | 研究、微调和产品开发 | Python 环境、依赖与工程维护 |
Mochi 1 的开放范围
Genmo 官方说明 Mochi 1 使用 Apache 2.0 许可证,可供个人和商业用途,并发布模型权重、架构与代码。开放许可证解决的是模型软件的使用条件,不会自动覆盖输入图片、人物肖像、商标、音乐或生成内容中的第三方权利。
最小启动路径
- 从官方 GitHub 克隆 Mochi 仓库,不使用来历不明的打包程序。
- 按仓库说明建立隔离 Python 环境并安装依赖。
- 下载官方权重,记录模型版本和文件校验值。
- 先运行仓库的示例命令,再调整提示、输出目录和计算参数。
官网给出的基本顺序是克隆仓库、执行 pip install -e .,再运行 python demos/cli.py。实际依赖、显存和启动参数应以当前仓库 README 为准。
研究预览的已知限制
官方发布说明将 Mochi 1 定位为研究预览,初始模型以 480p 为主,极端运动可能出现扭曲,并更偏向写实画面,对动画风格并不占优。它生成的是短视频素材,长叙事、文字、声音和角色跨镜头一致性需要额外流程。
提示词应描述时间变化
与图片提示不同,视频要写清主体从何状态变化到何状态,以及摄影机如何移动。例如分别描述人物动作、环境变化、镜头方向和节奏;避免同时安排多个角色、快速切换场景和互相冲突的运镜。先做短样本,再把稳定参数用于批量。
自托管的工程责任
本地运行需要管理 GPU 显存、模型缓存、队列、失败任务和输出存储。生产服务还应固定依赖版本、限制上传大小、隔离用户文件、记录生成参数并设置内容审核。升级权重前用固定样本回归,不要直接覆盖正在使用的模型。
谁更适合使用
Genmo/Mochi 1 适合希望研究模型、集成 ComfyUI、进行定制或掌握数据存储位置的开发者与实验团队。只需要偶尔制作成片的用户,用 Playground 更省维护成本;需要口型、声音、团队审批和多镜头资产管理的项目,则要在模型之外搭建完整工具链。
数据统计
相关导航
支持首尾帧、镜头描述与创意特效的AI视频平台
蝉镜
面向营销内容与数字人口播的 AI 视频创作平台。
通义万相
万相 3.0 网页创作入口与 Wan 2.7 Model Studio 视频 API
pyVideoTrans
开源的视频翻译、转录、配音与字幕合成工具。
Runway
覆盖视频生成、变换、表演驱动与团队资产的AI创作平台
CapCut
多端 AI 视频剪辑、字幕与创意内容生成工具
清影AI
集成在智谱清言中的中文 AI 视频生成功能与合成内容规范入口
Vidu
以多参考主体和首尾帧控制保持人物、物体与场景一致的 AI 视频平台
暂无评论...

