9 智能体导演流水线
调研、脚本、美术风格、分镜、角色、场景、配音、配乐、素材九个专职智能体按序协作,每个节点实时流式输出,方案可逐步查看。
BAIZE AI RESOURCE
Open-director
OpenDirector 是开源自托管 AI 视频工作室,通过 9 个专职 Agent 完成调研、脚本、分镜、配音、配乐和素材生成,最终渲染成片。

OpenDirector 是一个 Docker 优先、可自托管的 AI 视频制作系统,定位为“开源 AI 视频工作室”。它的核心是一条由 9 个专职智能体组成的导演流水线:调研智能体按需检索公开资料,脚本智能体生成故事大纲,美术风格智能体从 34 种内置风格中选型,分镜智能体拆解镜头与台词,角色与场景智能体产出视觉设定,配音与配乐智能体分别匹配音色和氛围音乐,最后由素材智能体编排图像、语音与音乐并交给渲染 Worker 输出成片。每个智能体都是 LangGraph 节点,执行过程通过 SSE 实时流式展示,用户可以逐步看到方案成型。系统提供创作模式(完整导演流程)与批量模式(短视频量产),支持 16:9、9:16、1:1 画幅与 480p/720p/1080p 导出,可接入 OpenAI、Gemini、DeepSeek、Qwen、MiniMax、Ollama 等多种模型,数据保存在自有服务器上。适合希望私有化部署 AI 视频生产能力的团队与个人创作者。
调研、脚本、美术风格、分镜、角色、场景、配音、配乐、素材九个专职智能体按序协作,每个节点实时流式输出,方案可逐步查看。
创作模式从一句话生成完整方案并支持手动编辑脚本;批量模式输入主题自动生成多条脚本,批量产出短视频并生成多个版本供挑选。
覆盖电影感、商业、未来、复古、动漫、3D、插画、写实、实验等 9 大类,可在生成前选定整体视觉方向。
内置 Edge TTS 免费语音并支持多音色实时预览,字幕可自定义字体、字号、颜色、位置与描边,背景音乐可按氛围生成或指定本地文件。
支持 OpenAI、Google Gemini、DeepSeek、Qwen、MiniMax、Ollama 等模型提供方,媒体生成服务可通过环境变量切换。
通过 docker compose 启动 Web、渲染 Worker、MySQL、Redis 与 MinIO,数据与素材保留在自有服务器,界面支持中英文。
使用场景个人创作者快速验证创意
输入一句故事想法,由 9 个智能体自动完成调研、脚本、分镜、角色、配音与配乐,直接得到带旁白和背景音乐的完整视频。
使用场景内容运营批量产出短视频
在批量模式输入多个主题,AI 自动生成多条脚本并批量渲染,可配置 2-10 秒片段节奏、字幕样式与配乐,一次产出多个版本。
使用场景对数据合规有要求的企业团队
通过 Docker Compose 在自有服务器部署 Web 与渲染 Worker,接入自选模型服务,创意与素材数据不出内网。