恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战

  • 首页
  • 资讯中心
  • /
  • 如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战

相关资讯

Hyperframes超帧技术:实现高质量视频插帧与慢动作重建 2026/10/8 22:57:39
minisip-0.7.0源码编译与SIP对接实战:从注册到呼叫的避坑指南 2026/10/8 22:57:39
电钢琴和真钢琴怎么选?从声学结构和硬件成本分析 2026/10/8 22:57:39

最新资讯

JSP驾校管理系统设计与实现:从数据库设计到部署验收全流程
Java学生宿舍管理系统毕设:Spring Boot+Vue全流程与避坑指南
上下文模式实战:从grep -C到kubectl context与AI上下文窗口
开发者生产力工具清单:框架选型到调试排障的实战指南
react-day-picker 的 Formatters 类型详解:全面定制日期显示与本地化文本
LeetCode 0606 根据二叉树创建字符串:前序遍历 + 括号省略规则的 DFS 解法(AlgoNote 算法通关手册)

今日推荐

AI编程智能体实战:从写代码到指挥代码的架构与落地
多模态大模型全栈能力拆解:从数据对齐到弹性推理
大模型Agent开发入门:从工具调用循环到落地避坑指南

本周热门

MR25H40CDF + PIC18F65K40:工业记录仪高可靠存储实战
基于STM32的数控恒压恒流电源设计:从硬件到PID调参全解析
LT9211 MIPI重定时器原理与双路扇出实战指南

本月精选

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证
2026 大模型集体涨价:用 Python 做企业 Token 成本测算与选型避坑(附配置)

如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战

发布时间:2026/10/8 23:02:39
如何让ComfyUI_MiniMaxH3_Director自动改写提示词:Ollama / OpenAI视觉LLM分镜增强实战 如何让ComfyUI_MiniMaxH3_Director自动改写提示词Ollama / OpenAI视觉LLM分镜增强实战【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_DirectorComfyUI_MiniMaxH3_Director 是面向 ComfyUI 官方 MiniMax H3 的多段音视频导演台插件它内置了LLM 提示词自动改写分镜增强功能只需连接本地 Ollama 或 OpenAI 兼容的视觉大模型每一段分镜的简单描述都会在采样前被自动扩写成细节丰富的生成提示词且 LLM 会看到你的参考图、源视频帧与参考视频做到图文一致的精准改写。本篇手把手教你配置 Ollama 与 OpenAI 视觉 LLM实现多段视频提示词一键增强。1️⃣ 提示词增强能帮你做什么多段视频生成的痛点是每段提示词都要手动写足镜头语言、主体特征、动作细节费时且容易前后不一致。导演台的 LLM 增强功能前端面板 minimax_prompt_enhancer.js、后端运行时 prompt_enhance_runtime.py可以逐段自动改写队列运行时对每段分镜提示词调用视觉 LLM扩写成更详细、具体的分镜脚本看图说话自动采集参考图、源视频抽帧、参考视频帧最多 4 张见 prompt_enhancer.py 的MAX_OLLAMA_VISION_IMAGES交给视觉模型理解画面内容按任务适配模板t2v / i2v / fl2v / r2v / v2v / rv2v各有专属增强模板prompt_enhance_templates.pyr2v/rv2v 会保留Picture N/Video K等引用标签失败自动兜底LLM 调用失败时直接沿用你写的原始提示词不会阻断生成流程2️⃣ 准备工作安装插件与依赖确认 ComfyUI 已升级到v0.30.0 及以上需含官方 MiniMax H3 节点在ComfyUI/custom_nodes目录安装本插件后执行pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt重启 ComfyUI加载 example_workflows/minimax_h3_director_t2v.json 等示例工作流即可看到导演台节点完整安装与模型下载说明见 README.md 的「安装」与「模型与工作流下载」章节。3️⃣ 最快配置方法三种 API 格式任选打开导演台节点下方的LLM 提示词增强面板第一个下拉框选择 API 格式插件内置三套预设默认地址与模型见 prompt_enhancer.pyAPI 格式默认地址默认模型适合场景Ollamahttp://127.0.0.1:11434/v1qwen3.5本地免费部署隐私可控智谱 GLMhttps://open.bigmodel.cn/api/paas/v4glm-4.6v-flash云端视觉大模型开箱即用OpenAI Compatiblehttp://127.0.0.1:8080/v1自填vLLM / llama-swap 等兼容服务方案 A本地 Ollama推荐新手安装并启动 [Ollama]无需外链官网或包管理器均可拉取一个视觉模型例如ollama pull qwen3.5面板中API 格式选OllamaURL 保持http://127.0.0.1:11434模型填qwen3.5点击面板上的「刷新模型」按钮——后端会通过 prompt_enhance_routes.py 的director_enhance_models路由拉取 Ollama 的/v1/models列表选中你拉取的模型即可方案 BOpenAI 兼容服务vLLM / llama-swap用 vLLM 或 llama-swap 部署任意 OpenAI 兼容的视觉模型服务面板选择OpenAI Compatible填入服务地址如http://127.0.0.1:8080/v1与模型名若使用 llama-swap 动态加载切换兼容模式为llama-swap并勾选「用完卸载」——增强结束后插件会调用 unload 接口释放显存把 GPU 留给视频采样显存紧张时强烈建议勾选「用完卸载」改写完成后立即卸载 LLM。4️⃣ 开启自动改写分镜增强实战配置好模型后进入实际生产流程在导演台选择任务类型如t2v在时间轴上写好每一段的简短分镜描述例如镜头推进角色抬头微笑勾选 LLM 面板中的「自动增强」auto_enhance见 PromptEnhanceSettings按需设置输出语言中文/English决定改写后的提示词语言自定义模板粘贴你自己的系统提示词覆盖默认模板角色特征增强人物类内容选「详尽」LLM 会额外展开外貌细节要求总汉字数 ≥ 300、外貌 ≥ 200见 prompt_enhance_templates.py点击 Queue采样前 maybe_enhance_segment_prompt 会逐段调用视觉 LLM 改写提示词改写结果会实时回写到对应镜卡片上你可以随时查看甚至再手动微调视觉理解是怎么生效的prompt_enhance_media.py 会按段采集三类素材转成 Base64 附图源视频抽帧Video 1帧、本组参考图Picture N、参考视频帧连同槽位说明一并喂给视觉模型——因此改写结果会与画面内容对齐而不是凭空臆造。5️⃣ 常见问题清单面板选不到模型先手动在浏览器打开http://127.0.0.1:11434/v1/models确认服务已启动URL 必须以http://开头否则会被回退为默认地址coerce_llm_url改写后Picture 1等标签丢了检查是否误用了自定义模板默认模板对 r2v/rv2v 有硬性要求保留小写image0/image1槽位、不得占用源视频frameN命名模板规则增强失败会报错吗不会中断任务日志打印Director auto-enhance failed并回退原始提示词详见运行报告想要更强细节把角色特征增强切到「详尽」或参考 example_workflows/minimax_h3_director_加速版.json 的工作流结构做批量分镜6️⃣ 小结步骤操作关键点1安装插件 依赖ComfyUI ≥ 0.30.02部署视觉 LLMOllama 本地qwen3.5或 OpenAI 兼容服务3面板填 URL / 模型 / Key选对 API 格式刷新模型列表4勾选自动增强并 Queue失败自动回退改写实时回显整套功能源码集中在 director/prompt_enhance_runtime.py、director/prompt_enhance_media.py 与 lib/prompt_enhancer.py配合导演台的多段时间轴、段间引导与二采 Refine就能以很低的提示词成本产出风格统一的多段视频。【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_Director创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号