news 2026/9/12 13:46:59

OpenMontage HunyuanVideo 1.5 提示词工程实战:从公式、运镜到 I2V 的最佳实践

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
OpenMontage HunyuanVideo 1.5 提示词工程实战:从公式、运镜到 I2V 的最佳实践

OpenMontage HunyuanVideo 1.5 提示词工程实战:从公式、运镜到 I2V 的最佳实践

【免费下载链接】OpenMontageWorld's first open-source, agentic video production system. 12 production pipelines, 100+ tools, 700+ agent skill and production-knowledge files. Turn your AI coding assistant into a full video production studio.项目地址: https://gitcode.com/GitHub_Trending/op/OpenMontage

本文是 OpenMontage 开源视频生产系统中 HunyuanVideo Prompting 技能文档 的深度实战解读。它面向所有希望通过 AI 编程助手/Agent 调用本地hunyuan_video工具生成高质量视频的开发者,讲解 HunyuanVideo 1.5 的提示词公式、灯光与运镜词汇库、I2V 最佳实践与完整示例。读完本文,你将能写出让 Hunyuan 1.5 稳定产出符合预期的 T2V / I2V 提示词,并理解这套提示词在 OpenMontage 中的调用链与使用前提。

HunyuanVideo 1.5 在 OpenMontage 中的定位

在 OpenMontage 的视频生成工具族中,HunyuanVideo 1.5 是本地 GPU 视频生成的骨干模型之一,与 Wan、LTX-2、CogVideoX 等并列。它在 技能索引 中被单列为 "HunyuanVideo Prompting",定位为"针对 HunyuanVideo 公式与 I2V 最佳实践的专项指南",其通用提示词词汇表则归属于 通用视频生成提示词技能。

从源码看,OpenMontage 为它提供了两层入口:

  • 本地工具hunyuan_video:定义在 tools/video/hunyuan_video.py,运行时为LOCAL_GPU,能力包含text_to_videoimage_to_video,支持参考图片、离线运行与本地 GPU 推理,并声明了兜底链路wan_video → ltx_video_local → cogvideo_video → image_selector
  • 云侧工具hunyuan_cloud_video:独立的 API 工具。测试用例 test_hunyuan_cloud_video.py 明确验证了它与本地工具并存(provider分别为hunyuan_cloudhunyuan,运行时分别为APILOCAL_GPU),且可被 video_selector 路由选择。

因此,本文的提示词技巧既适用于本地 Hunyuan 推理,也适用于云侧 Hunyuan API —— 提示词本身是模型无关的输入契约。

提示词长度:80–200 词是甜区

Hunyuan 1.5 的最佳阅读区间是80–200 个英文单词。官方提示词手册强调:它不会因为 400 词的"长篇大论"而给出更好的结果,反而容易稀释关键动作与运镜信息。作为对比,OpenMontage 的 通用提示词指南 给出了各模型的甜区差异(Seedance 2.0 偏好 200–400 词、LTX-2 不超过 80 词、Runway Gen-4 不超过 60 词),Hunyuan 属于"中等密度"模型:

短提示词 = 更多创作自由度;长提示词 = 更强控制力。Hunyuan 需要的是控制力与信息密度的平衡——把有限词数用在运动、运镜与灯光上。

HunyuanVideo 提示词公式

文生视频(T2V)公式

Subject(主体) + Motion(动作) + Scene(场景) + [Shot Type(景别)] + [Camera Movement(运镜)] + [Lighting(灯光)] + [Style(风格)] + [Atmosphere(氛围)]

其中主体、动作、场景为必填项,景别、运镜、灯光、风格、氛围为可选增强项。这套公式与 OpenMontage 的通用 5 要素骨架(Subject / Subject Motion / Scene / Spatial / Camera)一脉相承,Hunyuan 版将其细化为 8 段式,更强调灯光与氛围的权重。

图生视频(I2V)公式

Subject Motion Dynamics(主体运动动态) + Scene Motion Dynamics(场景运动动态) + [Camera Movement(运镜)]

I2V 的核心原则是:输入图片已经提供了外观(appearance),提示词只负责描述运动(motion)。你不需要(也不应该)复述图片里已经能看到的内容。

好 I2V 提示词 vs 坏 I2V 提示词

好的 I2V 提示词示例:

"The woman's hair blows in the wind as she turns to face the camera. Leaves scatter across the path. Camera slowly dollies in." (女子转身面向镜头时头发随风飘动。落叶在小径上散落。镜头缓慢推进。)

坏的 I2V 提示词示例:

"A beautiful woman in a red dress standing in a forest" (一个穿着红裙的美女站在森林里)

坏例的问题在于:它只是在用文字重复图片已经显示的内容,没有给模型任何新的运动信息,模型只能自行"脑补"运动方式,结果不可控。

灯光即氛围:Hunyuan 的核心强项

腾讯官方提示词手册的原话是:"Light is the soul of atmosphere."(灯光是氛围的灵魂)。Hunyuan 1.5 对灯光描述高度敏感,官方建议用多个维度描述灯光,而不是只丢一个"cinematic lighting":

维度可选描述词
Style(风格)soft(柔和)、hard(硬朗)、neon(霓虹)、ambient(环境光)
Direction(方向)side-lit(侧光)、backlit(逆光)、overhead(顶光)、underlighting(底光)
Quality(质感)harsh spotlight(强烈聚光)、diffuse glow(漫射光晕)
Shadows(阴影)long dramatic shadows(长戏剧性阴影)、soft shadow edges(柔和阴影边缘)
Color temperature(色温)golden hour warmth(黄金时刻暖调)、cool daylight blue(冷日光蓝调)
Reflections(反射)wet surface reflections(湿面反射)、metallic glints(金属闪光)

这套多维灯光词汇在 通用视频提示词指南 的 "Lighting Vocabulary" 一节有更完整的映射(Rembrandt 光、high-key / low-key、volumetric 体积光、rim light 轮廓光等),可以作为 Hunyuan 灯光词汇的扩展库交叉使用。

关键提醒:灯光描述要前后一致。不要在同一个提示词里同时写 "bright noon"(正午强光)和 "dark shadows"(深阴影)这类相互矛盾的设定——模型只会选取其中一个并忽略另一个。

运镜词汇库:12 种基础运镜

Hunyuan 官方手册整理了一张 12 种基础运镜的对照表,OpenMontage 的技能文档完整保留了它。运镜分三大类:平移(Translation)、旋转(Rotation)、纯镜头(Lens-only),模型对这三类的底层理解方式不同:

运镜类型HunyuanVideo 提示词
Crane / Pedestal(升降/升降台)平移(垂直)"camera rises vertically"(镜头垂直上升)
Truck / Tracking(横移/跟移)平移(水平)"camera tracks left alongside subject"(镜头沿主体左侧横移)
Dolly In(推近)平移(推)"camera pushes forward toward subject"(镜头向主体推进)
Dolly Out(拉远)平移(拉)"camera pulls back from subject"(镜头从主体拉远)
Pan(摇镜)旋转(偏航)"camera pans right across the scene"(镜头向右扫过场景)
Tilt(俯仰)旋转(俯仰)"camera tilts upward to follow the rocket"(镜头上仰跟随火箭)
Roll(横滚/荷兰角)旋转(Z 轴)"camera rolls clockwise into a Dutch tilt"(镜头顺时针滚入荷兰角)
Orbit(环绕)圆周运动"camera orbits around subject"(镜头环绕主体)
Follow(跟随)锁定"camera follows subject from behind"(镜头从后方跟随主体)
Zoom(变焦)纯镜头(焦距)"camera slowly zooms in on the figure"(镜头缓慢推近人物)
Rack focus(焦点切换)纯镜头(焦平面,快切)"rack focus from the foreground bottle to the figure in the background"(焦点从前景瓶子切到背景人物)
Pull focus(焦点拉动)纯镜头(焦平面,渐变)"camera shifts focus from foreground X to background Y"(镜头焦点从前景 X 渐变到背景 Y)
Static(静止)固定"static camera, no movement"(固定机位,无运动)

从 OpenMontage 通用指南可以进一步得到两条与 Hunyuan 强相关的运镜规则:

  • dolly ≠ zoom:dolly 是机身平移,zoom 是焦距变化,模型会跟随占主导地位的 token 执行;
  • static 是严格的:static 意味着零运动、零焦点变化、零变焦。只要有任何一种变化发生,就不要写 "static camera",而要选用正确的运镜原语。

动态景深镜头:首尾两端都要标注焦平面

Hunyuan 的一个独特行为是:当镜头存在焦点变化(dynamic DoF)时,同时声明焦点起始与结束位置能显著提升效果。OpenMontage 技能文档给出明确的指导——不要只写一半:

Example: "shallow DoF; focus on the foreground bottle at start; focus pulls to the figure in the background by end." (浅景深;开始时焦点在前景瓶子上;结束时焦点拉到背景人物身上。)

如果不写全两个端点,Hunyuan 经常会退化为深景深(deep focus),或者停在错误的焦平面上。这与 通用视频生成提示词指南 中 "When DoF changes during a shot, label start AND end focal plane (FG/MG/BG/out-of-focus)" 的原则完全一致——这是一个跨模型的通用规律,在 Hunyuan 上表现得尤其明显。

风格关键词库

OpenMontage 的技能文档按两大方向整理了 Hunyuan 官方认可的风格词:

写实 / 电影感(Photorealistic / Cinematic)

  • Film noir(黑色电影)、hard sci-fi(硬核科幻)、cinematic photography(电影摄影)
  • Period drama(年代剧)、war documentary(战争纪录片)、nature documentary(自然纪录片)

动画 / 插画(Animation / Illustration)

  • 2D animation(2D 动画)、Japanese anime(日式动画)
  • Watercolor painting(水彩画)、Chinese ink wash(中国水墨)
  • Low-poly 3D(低多边形 3D)、pixel art(像素艺术)

结合通用指南中的风格维度(Animation Styles 如 Ghibli 系、Art Movements 如印象派/装饰艺术、Film Stock / Grade 如 16mm 黑白、teal-and-orange 调色),可以为 Hunyuan 构建更精细的风格描述。注意:通用指南 明确建议避免 "cinematic look" 这类空泛词——每个模型本来就在尝试电影感,应具体到 "anamorphic lens, shallow DOF, golden hour lighting"。

I2V 最佳实践

按时间顺序排列动作

Hunyuan按提示词中出现的顺序执行动作。如果多个动作同时发生,请用时间顺序拆分描述,而不是揉进同一个从句:

"first the camera pans right, then tilts upward" (镜头先向右摇,再上仰)

如果两个运动被塞进同一个从句,其中一个往往会被丢弃或混叠(dropped or blended)。OpenMontage 通用指南的 "Order Matters" 一节补充了另一条排序规则:事件在时间上展开时用时间顺序,与时间无关时用显著性顺序(人类先于物体、最大/居中的先写)。

I2V 的提示词只写三件事

  1. 主体如何运动(subject moves)
  2. 环境如何变化(environment changes)
  3. 运镜(camera motion)

完整示例

T2V 示例(约 90 词,落在 80–200 甜区)

A young woman in a flowing white dress walks barefoot along a deserted beach at golden hour. She trails her hand through the shallow surf, leaving ripples. Her hair catches the warm side-light from the setting sun. Medium tracking shot, camera follows alongside at knee height. Soft golden lighting with long shadows stretching toward the camera. Cinematic photography style, shallow depth of field. Peaceful, contemplative atmosphere.

拆解:主体(白裙女子)+ 动作(赤足行走、手划过浅浪)+ 场景(金色时刻的空旷海滩)+ 景别(中景跟拍)+ 运镜(膝盖高度跟随)+ 灯光(柔和金色光、长阴影、侧光)+ 风格(电影摄影、浅景深)+ 氛围(平静、沉思)。

I2V 示例(只写运动,不写外观)

The cat stretches lazily, then leaps from the windowsill to the floor. Dust motes scatter in the shaft of light. Camera remains static, slight rack focus from window to landing spot.

拆解:主体运动(猫伸展后跳跃)+ 场景运动(光束中尘埃散开)+ 运镜(机位静止 + 轻微焦点切换)。注意开头写了 "static"(机位静止),同时又有轻微的 rack focus——这符合"static 严格"规则的边界用法:机位本身零运动,但焦点变化被单独、显式地声明出来。

如何在 OpenMontage 中调用与验证

调用链:从提示词到视频文件

  1. 提示词组装:按本文公式(T2V 8 段式 / I2V 3 要素式)编写提示词;
  2. 工具调用:将提示词交给hunyuan_video(本地)或hunyuan_cloud_video(云端)。本地工具的输入 schema 见 tools/video/hunyuan_video.py,支持operationtext_to_video/image_to_video)、model_variant(默认hunyuan-1.5)、reference_image_url/reference_image_path(I2V 必填)、width/height/num_frames/num_inference_steps/seed/output_path等参数;
  3. 路由选择:如果通过 video_selector 调用,本地模型通过环境变量VIDEO_GEN_LOCAL_MODEL=hunyuan-1.5映射到hunyuanprovider 参与候选排序;
  4. 结果产出:本地推理经由 tools/video/_shared.py 中的generate_local_video()执行——加载 diffusers 的HunyuanVideoPipeline、处理参考图、导出 MP4,并在返回结果中附带分辨率、帧率、时长等元信息。

运行前提

本地 Hunyuan 推理有两个硬前提(定义在local_generation_status()local_install_instructions()中):

  • 设置环境变量VIDEO_GEN_LOCAL_ENABLED=true
  • 安装 diffusers 技术栈:uv pip install diffusers transformers accelerate torch pillow requests

硬件方面,hunyuan_video.py 声明的资源画像为cpu_cores=2, ram_mb=16000, vram_mb=14000,即至少需要约 14GB 显存,不支持纯 CPU 机器(工具元数据not_good_for = ["CPU-only machines"])。推理精度由 _shared.py 自动选择:CUDA 下优先 bfloat16,Apple Silicon MPS 用 float16,CPU 回退 float32;支持enable_model_cpu_offload与 VAE tiling/slicing 降低显存峰值。

验证与兜底

OpenMontage 的测试体系对 Hunyuan 有明确契约验证:test_hunyuan_cloud_video.py 覆盖了云侧工具的 prompt 长度限制等行为,并验证hunyuan_video(本地)与hunyuan_cloud_video(云端)在注册表中并存且 provider 不同。本地工具还声明了兜底链:wan_video → ltx_video_local → cogvideo_video → image_selector,当 Hunyuan 不可用或效果不符时可以自动切换。

常见误区与自查清单

误区正确做法
写 400 词长文控制在 80–200 词,把词数花在运动与运镜上
I2V 提示词复述外观I2V 只写主体运动 + 场景运动 + 运镜
多个动作揉进一个从句按时间顺序拆分:"first …, then …"
焦点变化只写起点或终点动态景深首尾两端都标注焦平面
"cinematic look" 空泛词具体到 "soft golden lighting, shallow depth of field"
灯光设定自相矛盾选定一种灯光方案并贯彻到底
写了 "static" 又叠加运动static 严格为零运动;有任何变化就换运镜原语

最后,将 HunyuanVideo 1.5 提示词技能 与 通用视频生成提示词技能 配合使用:后者提供跨模型的通用词汇(景别、运镜分组、灯光、镜头光学、时间效果、音频描述等),前者提供 Hunyuan 专属的公式与取舍。二者叠加,即可在 OpenMontage 中稳定地产出符合预期的 Hunyuan 视频片段。

【免费下载链接】OpenMontageWorld's first open-source, agentic video production system. 12 production pipelines, 100+ tools, 700+ agent skill and production-knowledge files. Turn your AI coding assistant into a full video production studio.项目地址: https://gitcode.com/GitHub_Trending/op/OpenMontage

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/12 13:45:27

图片转3D模型完整教程:Hunyuan3D-2 本地部署与首次生成上手

图片转3D模型完整教程:Hunyuan3D-2 本地部署与首次生成上手 【免费下载链接】Hunyuan3D-2 High-Resolution 3D Assets Generation with Large Scale Hunyuan3D Diffusion Models. 项目地址: https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2 手里有一张角…

作者头像 李华
网站建设 2026/9/12 13:42:39

AI内容检测与降AI率工具全解析

1. 自考备考的AI检测困境解析 近年来,随着在线教育平台和远程考试系统的普及,自考考生在提交作业和论文时,越来越频繁地遇到AI内容检测的困扰。各大院校使用的查重系统如Turnitin、知网等,都陆续加入了AI生成内容识别功能&#xf…

作者头像 李华
网站建设 2026/9/12 13:41:40

5 分钟把写不利的提示词改好:prompt-optimizer 快速上手指南

5 分钟把写不利的提示词改好:prompt-optimizer 快速上手指南 【免费下载链接】prompt-optimizer An AI prompt optimizer for writing better prompts and getting better AI results. 项目地址: https://gitcode.com/GitHub_Trending/pro/prompt-optimizer …

作者头像 李华
网站建设 2026/9/12 13:41:35

NautilusTrader 高精度 128 位与标准 64 位精度模式怎么选?

NautilusTrader 高精度 128 位与标准 64 位精度模式怎么选? 【免费下载链接】nautilus_trader Production-grade Rust-native trading engine with deterministic event-driven architecture 项目地址: https://gitcode.com/GitHub_Trending/na/nautilus_trader …

作者头像 李华
网站建设 2026/9/12 13:40:04

OpenCore Legacy Patcher 手把手教程:让老 Mac 装上最新 macOS

OpenCore Legacy Patcher 手把手教程:让老 Mac 装上最新 macOS 【免费下载链接】OpenCore-Legacy-Patcher Experience macOS just like before 项目地址: https://gitcode.com/GitHub_Trending/op/OpenCore-Legacy-Patcher 想象这样一个场景:你那…

作者头像 李华