恒美微站
首页
关于我们
建站服务
主题模板
案例展示
资讯中心
联系我们
如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战
首页
资讯中心
/
如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战
如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战
发布时间:2026/10/8 23:02:39
如何让ComfyUI_MiniMaxH3_Director自动改写提示词Ollama / OpenAI视觉LLM分镜增强实战【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_DirectorComfyUI_MiniMaxH3_Director 是面向 ComfyUI 官方 MiniMax H3 的多段音视频导演台插件它内置了LLM 提示词自动改写分镜增强功能只需连接本地 Ollama 或 OpenAI 兼容的视觉大模型每一段分镜的简单描述都会在采样前被自动扩写成细节丰富的生成提示词且 LLM 会看到你的参考图、源视频帧与参考视频做到图文一致的精准改写。本篇手把手教你配置 Ollama 与 OpenAI 视觉 LLM实现多段视频提示词一键增强。1️⃣ 提示词增强能帮你做什么多段视频生成的痛点是每段提示词都要手动写足镜头语言、主体特征、动作细节费时且容易前后不一致。导演台的 LLM 增强功能前端面板 minimax_prompt_enhancer.js、后端运行时 prompt_enhance_runtime.py可以逐段自动改写队列运行时对每段分镜提示词调用视觉 LLM扩写成更详细、具体的分镜脚本看图说话自动采集参考图、源视频抽帧、参考视频帧最多 4 张见 prompt_enhancer.py 的MAX_OLLAMA_VISION_IMAGES交给视觉模型理解画面内容按任务适配模板t2v / i2v / fl2v / r2v / v2v / rv2v各有专属增强模板prompt_enhance_templates.pyr2v/rv2v 会保留Picture N/Video K等引用标签失败自动兜底LLM 调用失败时直接沿用你写的原始提示词不会阻断生成流程2️⃣ 准备工作安装插件与依赖确认 ComfyUI 已升级到v0.30.0 及以上需含官方 MiniMax H3 节点在ComfyUI/custom_nodes目录安装本插件后执行pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt重启 ComfyUI加载 example_workflows/minimax_h3_director_t2v.json 等示例工作流即可看到导演台节点完整安装与模型下载说明见 README.md 的「安装」与「模型与工作流下载」章节。3️⃣ 最快配置方法三种 API 格式任选打开导演台节点下方的LLM 提示词增强面板第一个下拉框选择 API 格式插件内置三套预设默认地址与模型见 prompt_enhancer.pyAPI 格式默认地址默认模型适合场景Ollamahttp://127.0.0.1:11434/v1qwen3.5本地免费部署隐私可控智谱 GLMhttps://open.bigmodel.cn/api/paas/v4glm-4.6v-flash云端视觉大模型开箱即用OpenAI Compatiblehttp://127.0.0.1:8080/v1自填vLLM / llama-swap 等兼容服务方案 A本地 Ollama推荐新手安装并启动 [Ollama]无需外链官网或包管理器均可拉取一个视觉模型例如ollama pull qwen3.5面板中API 格式选OllamaURL 保持http://127.0.0.1:11434模型填qwen3.5点击面板上的「刷新模型」按钮——后端会通过 prompt_enhance_routes.py 的director_enhance_models路由拉取 Ollama 的/v1/models列表选中你拉取的模型即可方案 BOpenAI 兼容服务vLLM / llama-swap用 vLLM 或 llama-swap 部署任意 OpenAI 兼容的视觉模型服务面板选择OpenAI Compatible填入服务地址如http://127.0.0.1:8080/v1与模型名若使用 llama-swap 动态加载切换兼容模式为llama-swap并勾选「用完卸载」——增强结束后插件会调用 unload 接口释放显存把 GPU 留给视频采样显存紧张时强烈建议勾选「用完卸载」改写完成后立即卸载 LLM。4️⃣ 开启自动改写分镜增强实战配置好模型后进入实际生产流程在导演台选择任务类型如t2v在时间轴上写好每一段的简短分镜描述例如镜头推进角色抬头微笑勾选 LLM 面板中的「自动增强」auto_enhance见 PromptEnhanceSettings按需设置输出语言中文/English决定改写后的提示词语言自定义模板粘贴你自己的系统提示词覆盖默认模板角色特征增强人物类内容选「详尽」LLM 会额外展开外貌细节要求总汉字数 ≥ 300、外貌 ≥ 200见 prompt_enhance_templates.py点击 Queue采样前 maybe_enhance_segment_prompt 会逐段调用视觉 LLM 改写提示词改写结果会实时回写到对应镜卡片上你可以随时查看甚至再手动微调视觉理解是怎么生效的prompt_enhance_media.py 会按段采集三类素材转成 Base64 附图源视频抽帧Video 1帧、本组参考图Picture N、参考视频帧连同槽位说明一并喂给视觉模型——因此改写结果会与画面内容对齐而不是凭空臆造。5️⃣ 常见问题清单面板选不到模型先手动在浏览器打开http://127.0.0.1:11434/v1/models确认服务已启动URL 必须以http://开头否则会被回退为默认地址coerce_llm_url改写后Picture 1等标签丢了检查是否误用了自定义模板默认模板对 r2v/rv2v 有硬性要求保留小写image0/image1槽位、不得占用源视频frameN命名模板规则增强失败会报错吗不会中断任务日志打印Director auto-enhance failed并回退原始提示词详见运行报告想要更强细节把角色特征增强切到「详尽」或参考 example_workflows/minimax_h3_director_加速版.json 的工作流结构做批量分镜6️⃣ 小结步骤操作关键点1安装插件 依赖ComfyUI ≥ 0.30.02部署视觉 LLMOllama 本地qwen3.5或 OpenAI 兼容服务3面板填 URL / 模型 / Key选对 API 格式刷新模型列表4勾选自动增强并 Queue失败自动回退改写实时回显整套功能源码集中在 director/prompt_enhance_runtime.py、director/prompt_enhance_media.py 与 lib/prompt_enhancer.py配合导演台的多段时间轴、段间引导与二采 Refine就能以很低的提示词成本产出风格统一的多段视频。【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_Director创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考