一句话生成完整视频:ViMax 多智能体视频创作框架从配置到成片实战
【免费下载链接】ViMax"ViMax: Agentic Video Generation (Director, Screenwriter, Producer, and Video Generator All-in-One)"项目地址: https://gitcode.com/GitHub_Trending/ai/ViMax
ViMax 是一个开源的多智能体(Agentic)视频生成框架,它把编剧、角色设定、分镜设计、关键帧绘制和镜头合成串成一条流水线,你用一句创意或一段现成剧本做输入,最终在本地拿到拼接好的成片。它适合想把短视频原型快速跑通的内容创作者,也适合研究 LLM 多智能体编排的开发者。
它解决什么问题
- 你只有一个模糊创意:Idea2Video 会自动补全故事大纲、角色卡、剧本和分镜,最后合成视频,你不需要自己写剧本。
- 你已有一页完整剧本:Script2Video 保留剧本原文与人物设定,将其拆分为多场景、多镜头的拍摄序列,而不重新发明故事。
- 你有一段长篇文字:Novel2Video 先压缩文本、抽取事件与场景,把长篇小说整理成分集可拍的视觉素材。
三种入口对应 pipelines/ 下的三条流水线,此外还支持用一张人物或宠物照片在生成内容中保持外观一致。
环境与依赖:Python 3.12 加 uv 一条命令装好
项目运行在 Linux 或 Windows 上,要求 Python 3.12+,依赖统一用 uv 管理(安装方式可参考 uv 官方文档)。克隆仓库后只需执行一条uv sync:
git clone https://gitcode.com/GitHub_Trending/ai/ViMax cd ViMax uv sync模型服务需要 API 密钥,建议用环境变量注入,例如OPENROUTER_API_KEY、GOOGLE_API_KEY。如果想用交互式终端界面(TUI),还需要在ui/目录下先执行npm install,依赖来自 ui/package.json。
跑通第一个结果:改两个文件,跑一条命令
最小路径是「Idea 变视频」,只需改两处:
- 打开 configs/idea2video.yaml,在三段的
api_key处填入密钥。 - 修改 main_idea2video.py 顶部的
idea、user_requirement、style三个变量。
python main_idea2video.py运行过程中,所有中间产物(角色设定、分镜、关键帧、镜头片段)都会写入配置里的working_dir,默认是.working_dir/idea2video/,最终产物为一段拼接好的 mp4。你第一次跑建议把创意控制在一句话、场景数不超过 3 个。
能力与关键配置:一份 YAML 撑起整条流水线
每条流水线的入口由一份 YAML 配置驱动,configs/idea2video.yaml 的写法可以代表全部结构:
chat_model: init_args: model: google/gemini-2.5-flash-lite-preview-09-2025 model_provider: openai api_key: ${OPENROUTER_API_KEY} base_url: https://openrouter.ai/api/v1 image_generator: class_path: tools.ImageGeneratorNanobananaGoogleAPI video_generator: class_path: tools.VideoGeneratorVeoGoogleAPIchat_model负责所有文本环节,image_generator与video_generator通过class_path指向具体实现,可替换为 tools/ 下的其它后端(如 Nanobanana、Veo、Seedance 系列)。Idea2Video 的实际执行顺序是:idea → project_brief → characters → script → storyboard → shot_decomposition → camera_tree → frame_prompts → keyframes → video_clips → final_video,各环节提示词见 prompts/。
每个生成器还配了本地限流参数max_requests_per_minute与max_requests_per_day,设为null表示不限制;chat_model支持model_provider: minimax这类预设名,自动填充 base_url 与默认模型,见 utils/provider_presets.py。
交互式路线同样值得试:先按 configs/agent.example.yaml 复制出configs/agent.local.yaml填好密钥,再执行:
vimax tui new vimax tui resume <session_id>TUI 由 main_agent.py 驱动,支持讨论创意、修订规划、断点恢复,.vimax/sessions.json只存会话索引,真正的产物都在.working_dir/会话目录里。
效果调优:参数与提示词层面能动的旋钮
- 控制规模:用
user_requirement写明硬性约束,如"面向儿童,不超过 3 个场景"或"快节奏,不超过 15 个镜头";默认规划倾向 1 个场景配 3–5 个镜头,想要更长就明确写出来。 - 描述具体化:
idea里给出环境、光线、角色动作等细节,style指定艺术风格(如Cartoon、Anime Style),这直接影响关键帧质量。 - 调限流节奏:
idea2video.yaml默认视频生成max_requests_per_day: 10,镜头多的任务会被限流拖慢,按你的 API 配额调高这三个参数,或直接设为null。 - 复用会话:TUI 会话中断后用
vimax tui resume接回,已有的角色设定与分镜会复用,不会全部重算。
常见问题
Q:运行报错说找不到 API 密钥?依次检查:配置文件中api_key是否为空、对应环境变量是否已export、TUI 场景下configs/agent.local.yaml是否已创建。密钥也可以只走环境变量,配置文件留空。
Q:跑几个镜头后就没有新视频了?多半是撞上max_requests_per_day限流(默认每天 10 次视频请求)。把该项调高或设为null,等次日配额恢复后重跑,已有产物会自动复用。
Q:script2video 提示要求"显式剧本",但我只有点子?脚本模式需要具体到场景、角色与台词的文本,模糊想法请走 idea2video 入口,它会自动帮你把点子扩写成剧本。
Q:产物都生成在哪里?全部在配置的working_dir下,默认.working_dir/idea2video/(脚本模式为.working_dir/script2video/),按环节分目录存放,最后一个是拼接完成的视频。
三类流水线的智能体实现分别位于 agents/ 与 pipelines/,从文本规划到渲染的控制逻辑都在其中,想二次开发可以直接从这两个目录入手。
【免费下载链接】ViMax"ViMax: Agentic Video Generation (Director, Screenwriter, Producer, and Video Generator All-in-One)"项目地址: https://gitcode.com/GitHub_Trending/ai/ViMax
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考