如何使用文生视频 AI 生成器
文生视频从一段文字开始,不需要先准备图片。这种文字生成视频的方式适合探索尚未存在的场景、氛围和镜头,但也意味着提示词需要同时建立主体、环境、构图和时间变化。没有参考图替你固定开场画面时,越能把信息按重要程度组织清楚,第一次结果就越容易判断。
Genify 的生成器提供提示词输入、模型选择、按模型变化的设置、提示词优化、积分提示和任务提交。下面还会解释镜头运动提示词如何组织,帮助你减少无效试错,而不是把生成器变成只看不能用的营销页面。
- 01
先定义一个镜头
写清主要人物或物体、所在环境,以及在当前时长内能看懂的一个核心动作。不要把完整剧情压缩进一次生成。 - 02
补充时间变化
说明动作从什么状态开始、向哪个方向发展、速度如何、最后停留在哪里。只有风格形容词,往往只能得到一张“会动的静态画面”。 - 03
决定镜头如何观察
选择固定机位、推近、拉远、横移、跟拍或轻微环绕中的一个主方向,并说明镜头始终关注什么。 - 04
选择模型并检查参数
当前模型决定哪些比例、清晰度、时长和音频选项可见。切换模型会恢复该模型默认值,因此每次都要重新核对。 - 05
提交并查看任务
确认积分、提示词和设置后生成。成功提交会打开统一工作区,用于查看进度和完成结果。
文生视频 AI 生成器的提示词结构
有效提示词不一定很长,但信息要有顺序。先说明主体和必须保持的特征,再描述动作和镜头,最后补充光线、质感与其他限制。可以把它写成自然段,不必机械套用模板;下面的结构只是帮助你检查信息是否完整。
文生视频最常见的问题,是多个主体同样重要、镜头指令相互矛盾,或者一条短片里同时要求转场、换景、变装和复杂对白。先把目标缩小到“观众能用一句话复述的单镜头”,再扩展细节。
1. 主体与识别特征
先写谁或什么是画面中心,再给出少量真正影响识别的特征,例如年龄范围、服装、材质、颜色、轮廓和画面位置。不要罗列在当前景别中看不清的小细节。
2. 场景与时间
说明地点、时间、天气、光线方向和背景层次。只有当环境细节会影响动作、氛围或构图时才加入,避免把模型注意力从主体上分散。
3. 动作与过程
使用具体动词,说明动作如何推进:先静止,随后缓慢转头;抬起物体并向门口移动;远处列车逐渐靠近站台。方向、速度和结束状态都比“更生动”更有用。
4. 镜头与构图
写清景别和一个主要镜头运动,例如固定广角、缓慢推近、横向跟随、俯拍漂移或轻微手持,并说明主体应保持居中还是逐渐揭示环境。
5. 视觉风格与保持项
最后补充光线、色彩、纹理、节奏和情绪,并指出最重要的稳定要求,例如保持人物面部、商品比例、Logo 区域、服装或背景结构不变。
提示词示例与拆解
示例的价值在于观察结构,而不是照抄。替换主体和场景,保留清晰的动作逻辑,并根据当前模型实际提供的画面比例调整构图。
环境氛围镜头
蓝调时刻的山间铁路站台,湿润地面反射暖色站灯。薄雾缓慢掠过铁轨,一列空车从远处逐渐靠近。固定广角,镜头非常缓慢地推近,冷色环境光,真实尺度,前景不要出现人物。
这个提示词只有一个主要事件,环境运动与镜头运动都很克制,同时给出了不希望发生的前景变化。
商品揭示镜头
哑光黑色旅行水杯放在深色摄影棚的石质台座上。一道窄光从左向右扫过表面,后方有轻微雾气。镜头缓慢做半环绕,保持近景商品构图,控制反射,保持水杯比例和标签区域稳定。
主体、光线动作、背景运动、镜头和保持项彼此分开,模型更容易理解优先级。
人物情绪镜头
一位年长钟表匠坐在摆满小工具的木桌前,暖色窗光照亮空气中的灰尘。他停下手中的工作,抬头并露出轻微微笑,镜头温和推近。手部动作自然,纪录片质感,保持面部特征,背景不要突然变化。
动作幅度适合短片,情绪节点清晰,镜头只负责加强注意力。
一条完整提示词与它要实现的镜头
完整镜头提示词
蓝调时刻的安静山谷,细雪掠过山间。云层在山峰之间缓慢移动,镜头克制地向前推近。冷色自然光、真实尺度、平静的电影节奏,保持地形稳定,不要突然换景。
一个环境、一种主要氛围运动和一个镜头动作,让短片容易理解。稳定约束负责保护山体结构,雪和云层则提供清楚的时间变化。
选择模型、时长、比例和清晰度
提示词必须与设置一起考虑。竖屏会改变主体的运动空间,短时长会限制可以清楚呈现的动作,切换模型也可能让清晰度或音频选项出现或消失。选择模型后,页面实际显示的选项就是当前可用范围。
切换模型时,系统会使用新模型自己的默认设置,避免把不支持的旧参数继续带过去。提交前仍要重新检查整个设置栏。积分也会根据当前模型和设置计算,而不是所有任务使用同一个固定数值。
- 画面比例:只从当前显示的选项中选择,并在提示词里为主体运动预留对应空间。
- 时长:让一个主要动作适应当前时长。时间越短,越需要删掉多余剧情。
- 清晰度:有些模型提供多个选项,有些模型不显示该行,说明这一项由模型固定或内部处理。
- 音频:以当前界面为准。显示开关时再写对白或声音意图;没有开关时,不要假设行为完全相同。
- 模型选择:围绕具体场景、动作、语言、风格和所需设置进行测试,而不是只按品牌名称决定。
让镜头指令与主体动作一致
镜头语言既能增强叙事,也最容易产生冲突。要求固定机位同时快速环绕,就是直接矛盾;要求人物向左冲刺、镜头向右移动并非一定错误,但需要足够画幅空间和明确目的。
先判断镜头是要揭示信息、跟随动作、拉近情绪,还是保持观察。然后选择能完成该目的的最小运动。
固定或接近固定的镜头
当画面内部已有烟雾、布料、水面、机械、表情或商品光线变化时,稳定镜头能让细微运动更清楚。
推近与拉远
推近用于集中注意力,拉远用于揭示环境。说明主体是否始终居中,以及镜头最终要展示什么新信息。
横移、跟拍与环绕
适合表现方向、空间关系和形体。写清主体和镜头分别如何移动,并指出焦点始终落在哪里。
手持与强运动
说明强度。轻微手持质感与剧烈抖动完全不同。运动越快,主体动作和背景越要简化。
文生视频适用场景
当你没有现成关键帧,或者希望先探索画面方向时,文生视频最有价值。它可以把文字想法变成便于团队讨论的动态参考,也可以作为社交素材、概念镜头或后续制作的起点。结果能否直接使用,仍需根据实际输出和项目标准判断。
- 营销概念探索:比较环境、光线、视觉隐喻和镜头方向。
- 情绪与转场镜头:表现雾、粒子、光线变化、环境揭示等单一视觉事件。
- 社交内容开场:测试竖屏或横屏中的简洁钩子和一个明确动作。
- 分镜动态参考:展示计划镜头可能如何运动,辅助沟通而不是假装已经完成最终制作。
- 没有商品图时的创意预演:探索台座、摄影棚、自然场景或抽象揭示方式。
- 说明性视觉:生成一个简化的概念画面,同时由人工承担事实核验和最终编辑责任。
首次结果不理想时怎么改
高效迭代从诊断开始。先看整体意思,再分别检查主体、动作、镜头、构图和不希望发生的变化,找到最早出错的位置。先修改这一类问题,再决定是否更换模型或全面重写。
提示词优化可以帮助整理结构,但优化文本仍需人工复核。删除新增的第二个动作、无关物体和与时长冲突的复杂镜头。
画面有风格但缺少动作
补充起始状态、动作方向、速度和结束状态。与其写“更生动”,不如写“人物先静止,随后缓慢转向窗外”。
人物外观持续变化
减少视角跳变,写明少量必须保持的人物特征,并降低动作幅度。如果精确外观非常重要,可以先准备参考图,再使用图生视频。
出现多余人物或物体
简化环境,明确主体数量,并删除没有必要的“繁忙”“人群”“大片感”等宽泛词。保护干净前景和稳定背景。
动作太赶或没有完成
让动作适配时长,删除准备步骤,改用更接近目标状态的开场。只有当前模型确实提供更长时长时,再比较是否值得调整。
镜头跟丢主体
写清景别、跟随对象和主体位置,降低镜头速度,避免同时要求环绕与变焦,并在运动方向留出空间。
相关创作路径
- 把现有图片生成视频当静态图片需要固定人物、商品或构图时,切换到图生视频。
- 比较全部 AI 视频模式返回 AI 视频生成器总入口,直接比较文字和图片两种工作流。
- 先生成一张关键帧如果希望先确定人物、插画、商品图或场景,再进入 AI 生图工具。
- 查看 Genify 四种创作模式返回首页,比较文字和图片生成图片与视频的现有功能。