LogoLTX-2.5
  • 首页
  • 生成
  • 提示词
  • 博客
  • 价格
为 LTX-2.5 编写结构化运镜和声音提示词
2026/09/14

LTX-2.5 提示词指南:控制动作、运镜、剪辑与声音

学习如何为 LTX-2.5 编写清晰的主体动作、运镜、多镜头剪辑、对白和环境音描述,提高视频生成的一致性。

LTX-2.5 提示词更适合描述一个能够实际拍摄的镜头顺序,而不是堆积大量画质关键词。模型使用 LTX 专用 Gemma 4 12B 文本编码器,可以理解自然语言、动作顺序、运镜、剪辑、对白和环境音。

LTX 官方提示词指南建议按时间顺序描述事件,并在每次明确剪辑之后重新说明构图、人物身份和声音。

从一个清晰镜头开始

第一版提示词可以由六个部分组成:

构图 → 主体 → 环境 → 动作 → 运镜 → 声音

例如:

中景跟拍。一名穿深绿色雨衣的快递员在夜晚狭窄的霓虹小巷中奔跑。
摄影机在她侧面保持同速移动,雨水将蓝色和品红色灯光映在路面上。
脚步溅过水坑,远处传来交通声。

这个版本只有一个主体、一个连续动作、一条摄影机指令和一个声音环境。先确认基础动作正常,再添加更多风格细节。

把情绪写成可见动作

“紧张”这样的抽象词可以对应很多视觉表现,因此不容易稳定生成。应描述摄影机能够看到的行为:

  • 不写“她很紧张”,改写成“她握紧信封,看向门口,短促地吸了一口气”。
  • 不写“场面变得戏剧化”,而是说明光线、动作或剪辑如何变化。
  • 使用现在时,并按照动作实际发生的顺序书写。

动作数量还应与目标时长匹配。长片段中只有一个极小动作,容易出现不必要的慢动作或重复动作。

每个镜头只给摄影机一个任务

使用明确运镜,并说明它跟随或揭示什么:

  • “摄影机向后跟拍,让奔跑者始终位于画面中央。”
  • “摄影机缓慢前推,从中景收窄到面部特写。”
  • “摄影机向右平摇,最终停在打开的门口。”

不要在一个短镜头里同时叠加平摇、环绕、变焦、升降和手持晃动。如果视点需要完全改变,应使用明确剪辑。

把剪辑后的内容写成新镜头

每次剪辑后,重复必须保持一致的身份特征:

硬切到同一名快递员湿透的绿色衣袖特写,她正在拆开信封。
小巷的蓝色与品红色灯光保持不变,交通环境音继续,
并加入纸张撕开的声音。

“同一名快递员”“绿色衣袖”以及重复出现的光线和声音,有助于维持连续性。完整多镜头写法可参考 LTX-2.5 多镜头提示词指南。

把声音作为场景的一部分

明确应该听到什么,以及声音何时发生变化:

  • 环境音:雨声、室内底噪、交通声、机器声;
  • 对白:说话人、准确台词、说话方式;
  • 音乐:开始、延续、淡出或停止;
  • 静默:明确其他声音在哪一刻结束。

双人对白时,要用外观特征分别识别人物,并把台词直接写在对应人物之后。相比在一个广角镜头中重叠对话,切到当前说话者通常更容易控制。

谨慎使用负面提示词

负面提示词更适合排除反复出现的具体伪影或风格,例如不需要的文字、Logo、过度抖动、严重动态模糊或 CGI 质感。不要使用可能与正向提示冲突的超长通用列表。

可复用公式

景别与角度 → 主体身份特征 → 环境与光线 → 一个有顺序的动作 → 一种运镜 → 对白与环境音 → 必要时明确剪辑。

先写清楚,再写丰富。保存随机种子,每轮只修改一条指令,才能判断究竟是哪种表达改变了结果。

全部文章

作者

avatar for LTX-2.5 编辑团队

LTX-2.5 编辑团队

负责 ltx-23.org 上 LTX 模型指南与工作流内容的编辑团队。

分类

  • 产品
从一个清晰镜头开始把情绪写成可见动作每个镜头只给摄影机一个任务把剪辑后的内容写成新镜头把声音作为场景的一部分谨慎使用负面提示词可复用公式

更多文章

开放的 AI 模型锁连接许可文件、天平、独立工作室和企业建筑

LTX-2.5 License 详解:商业使用、微调与模型分发规则

了解 LTX-2.5 license 的 1000 万美元收入门槛、商业使用、微调模型、LoRA 分发和署名要求。

avatar for LTX-2.5 编辑团队
LTX-2.5 编辑团队
2026/09/10
LTX-2.5 在 8GB、12GB 和 16GB 显存设备上的低显存工作流

LTX-2.5 Low VRAM 指南:8GB、12GB、16GB 能跑吗?

LTX-2.5 需要多少显存?结合官方要求和社区低显存工作流,分析 8GB、12GB、16GB GPU 的运行条件、速度代价与常见问题。

avatar for LTX-2.5 编辑团队
LTX-2.5 编辑团队
2026/09/10
非线性剪辑软件中正在对齐 LTX-2.3 原生音频与人物嘴型生成的波形图

解决 LTX-2.3 Native Audio 翻车:最全唇形同步 (Lip Sync) 自救指南

你生成的 LTX-2.3 native audio 声音不仅像电音,连嘴型都对不上?别急,这里有来自 Reddit 高玩社区的最全避坑指南:修好分辨率 Bug,找回完美的口型同步。

avatar for LTX-2.5 编辑团队
LTX-2.5 编辑团队
2026/03/20
LogoLTX-2.5

专业级高可控 AI 视频生成平台。支持精准多模态控制与角色一致性,助你将文字与图片一键转化为电影级爆款视频。

产品

  • 生成
  • 提示词
  • 博客
  • 价格

帮助

  • 关于我们
  • 常见问题
  • 联系我们

法律

  • Cookie政策
  • 隐私政策
  • 服务条款

© 2026 • LTX-2.5 All rights reserved.