大模型清单 BM 影视梦工厂 V3.0

系统使用的大模型清单 · 本地 Ollama / ComfyUI / 远程 NAS · 全四中心共享同一 LLM 池
3
LLM
3
图像模型
1
视频模型
2
音频模型
3
口型模型
2
工具/编码器

LLM 本地 · Ollama · 剧本/审核/知识/调度

Qwen3:14B
LLM
主力模型。剧本生成、导演分镜、角色塑造、知识增强、Prompt 优化、跨中心格式转换。平衡性能与质量的最佳选择,承担 80% 以上 LLM 调用。
Ollama · 127.0.0.1:11434
DeepSeek-R1:14B
LLM
推理模型。连续性检查、逻辑验证、科学知识推理、复杂约束求解、内容审核。用于需要深度推理的高精度任务。
Ollama · 127.0.0.1:11434
Qwen3.5:9B
LLM
轻量模型。资源需求提取、标签分类、关键词提取、缓存检查等低延迟任务。主力模型负载高时自动降级。
Ollama · 127.0.0.1:11434

图像模型 本地 ComfyUI · 分镜/角色/场景/道具

z-image-turbo
图像
主力文生图。AuraFlow 架构 + Qwen 3.4B 中文编码器,8 step 快速推理,CFG=1.0。原生中文 prompt,用于角色参考图、场景关键帧、道具图、分镜图生成。由 IMAGE_WORKFLOW_MODE=z_image_turbo 启用。
ComfyUI · localhost:8188
RealVisXL V4.0
图像
备选图像模型。标准 SDXL 架构,25 step 推理,需英文 prompt。在 IMAGE_WORKFLOW_MODE=stable_sdxl 时启用,z-image-turbo 无法满足时使用。
ComfyUI · localhost:8188
FLUX.1-fill-dev
图像
图像修补。扩展图像、修复局部、替换画面元素。用于 img2img 场景,不作为主力文生图模型。
ComfyUI · localhost:8188

视频模型 本地 ComfyUI · 分镜动画

LTX-Video 0.9.1 I2V
视频
图生视频。将分镜关键帧 + 运动描述转化为约 5 秒短视频片段(25 帧, 854×480, 8 step)。支持运动控制和相机轨迹描述。
ComfyUI · localhost:8188

音频模型 远程 NAS + 内置 · 配音/TTS

GPT-SoVITS
音频
语音克隆与生成。角色配音、情感控制、文本转语音。使用角色参考音频进行零样本声音克隆。部署在 NAS 从服务器(RTX 3060)。
NAS · 192.168.3.140:9880
Edge-TTS
音频
备选 TTS。快速语音生成,无需 GPU。NAS 离线或 GPT-SoVITS 不可用时自动降级。用于临时配音和预览。
内置 · 零依赖

口型模型 本地 + NAS · 口型同步

SadTalker
口型
本地口型同步。音频驱动 + 单张人像 → 口型同步视频。部署在本地(RTX 2080 Ti),低延迟,适合快速预览。
本地 · 127.0.0.1:9860
MuseTalk
口型
高质量口型同步。实时口型驱动,仅修改嘴部区域。部署在 NAS 从服务器,需要 GPU,质量优于 SadTalker。
NAS · 192.168.3.140:9881
LivePortrait
口型
视频驱动面部动画。用驱动视频控制角色视频的面部姿态和表情。适合数字人口播场景的微调。
本地 ONNX · 127.0.0.1:9870

工具 / 编码器 本地 · 基础能力

FFmpeg
工具
媒体处理核心。视频/音频拼接、格式转换、混音、字幕叠加、缩放、场景分割。全部媒体操作的基础工具。
系统工具
Ollama
工具
LLM 推理服务器。管理所有本地 LLM 的加载、推理、切换。提供 OpenAI 兼容 API,支持模型热切换。
本地 · 127.0.0.1:11434

能力矩阵 模型 ⇄ 任务映射

每个任务的首选和备用模型,帮助理解系统在不同负载下的行为

能力首选模型备用模型节点显存可队列
剧本生成Qwen3:14BQwen3.5:9B主机
导演拆镜Qwen3:14BQwen3.5:9B主机
一致性审查DeepSeek-R1:14BQwen3:14B主机
图像生成z-image-turboRealVisXL V4.02080Ti
视频生成LTX-Video 0.9.12080Ti
配音GPT-SoVITSEdge-TTS3060
口型同步MuseTalkSadTalker / LivePortrait3060/主机
知识提取Qwen3:14BDeepSeek-R1:14B主机
翻译Qwen3:14BQwen3.5:9B主机
图像修补FLUX.1-fill-dev2080Ti

共 14 个大模型/工具 · 本地 Ollama(3) + ComfyUI(4) + 远程 NAS(2) + 内置(5)