Genify logoGenify

文字驱动的视频工作流

文生视频 AI 生成器

通过提示词生成视频:输入视觉描述,并使用模型设置完成文字生成视频。

  • 文字场景转短视频
  • 支持提示词优化
  • 参数由当前模型决定
提示词
0 / 2000
模型
比例
分辨率
时长

如何使用文生视频 AI 生成器

文生视频从一段文字开始,不需要先准备图片。这种文字生成视频的方式适合探索尚未存在的场景、氛围和镜头,但也意味着提示词需要同时建立主体、环境、构图和时间变化。没有参考图替你固定开场画面时,越能把信息按重要程度组织清楚,第一次结果就越容易判断。

Genify 的生成器提供提示词输入、模型选择、按模型变化的设置、提示词优化、积分提示和任务提交。下面还会解释镜头运动提示词如何组织,帮助你减少无效试错,而不是把生成器变成只看不能用的营销页面。

  1. 01

    先定义一个镜头

    写清主要人物或物体、所在环境,以及在当前时长内能看懂的一个核心动作。不要把完整剧情压缩进一次生成。
  2. 02

    补充时间变化

    说明动作从什么状态开始、向哪个方向发展、速度如何、最后停留在哪里。只有风格形容词,往往只能得到一张“会动的静态画面”。
  3. 03

    决定镜头如何观察

    选择固定机位、推近、拉远、横移、跟拍或轻微环绕中的一个主方向,并说明镜头始终关注什么。
  4. 04

    选择模型并检查参数

    当前模型决定哪些比例、清晰度、时长和音频选项可见。切换模型会恢复该模型默认值,因此每次都要重新核对。
  5. 05

    提交并查看任务

    确认积分、提示词和设置后生成。成功提交会打开统一工作区,用于查看进度和完成结果。

文生视频 AI 生成器的提示词结构

有效提示词不一定很长,但信息要有顺序。先说明主体和必须保持的特征,再描述动作和镜头,最后补充光线、质感与其他限制。可以把它写成自然段,不必机械套用模板;下面的结构只是帮助你检查信息是否完整。

文生视频最常见的问题,是多个主体同样重要、镜头指令相互矛盾,或者一条短片里同时要求转场、换景、变装和复杂对白。先把目标缩小到“观众能用一句话复述的单镜头”,再扩展细节。

1. 主体与识别特征

先写谁或什么是画面中心,再给出少量真正影响识别的特征,例如年龄范围、服装、材质、颜色、轮廓和画面位置。不要罗列在当前景别中看不清的小细节。

2. 场景与时间

说明地点、时间、天气、光线方向和背景层次。只有当环境细节会影响动作、氛围或构图时才加入,避免把模型注意力从主体上分散。

3. 动作与过程

使用具体动词,说明动作如何推进:先静止,随后缓慢转头;抬起物体并向门口移动;远处列车逐渐靠近站台。方向、速度和结束状态都比“更生动”更有用。

4. 镜头与构图

写清景别和一个主要镜头运动,例如固定广角、缓慢推近、横向跟随、俯拍漂移或轻微手持,并说明主体应保持居中还是逐渐揭示环境。

5. 视觉风格与保持项

最后补充光线、色彩、纹理、节奏和情绪,并指出最重要的稳定要求,例如保持人物面部、商品比例、Logo 区域、服装或背景结构不变。

提示词示例与拆解

示例的价值在于观察结构,而不是照抄。替换主体和场景,保留清晰的动作逻辑,并根据当前模型实际提供的画面比例调整构图。

环境氛围镜头

蓝调时刻的山间铁路站台,湿润地面反射暖色站灯。薄雾缓慢掠过铁轨,一列空车从远处逐渐靠近。固定广角,镜头非常缓慢地推近,冷色环境光,真实尺度,前景不要出现人物。

这个提示词只有一个主要事件,环境运动与镜头运动都很克制,同时给出了不希望发生的前景变化。

商品揭示镜头

哑光黑色旅行水杯放在深色摄影棚的石质台座上。一道窄光从左向右扫过表面,后方有轻微雾气。镜头缓慢做半环绕,保持近景商品构图,控制反射,保持水杯比例和标签区域稳定。

主体、光线动作、背景运动、镜头和保持项彼此分开,模型更容易理解优先级。

人物情绪镜头

一位年长钟表匠坐在摆满小工具的木桌前,暖色窗光照亮空气中的灰尘。他停下手中的工作,抬头并露出轻微微笑,镜头温和推近。手部动作自然,纪录片质感,保持面部特征,背景不要突然变化。

动作幅度适合短片,情绪节点清晰,镜头只负责加强注意力。

一条完整提示词与它要实现的镜头

这个示例把完整镜头需求与 Genify 的代表视频结果放在一起,用于观察主体、动作、镜头和氛围如何配合,而不是要求直接照抄文字。

完整镜头提示词

蓝调时刻的安静山谷,细雪掠过山间。云层在山峰之间缓慢移动,镜头克制地向前推近。冷色自然光、真实尺度、平静的电影节奏,保持地形稳定,不要突然换景。

一个环境、一种主要氛围运动和一个镜头动作,让短片容易理解。稳定约束负责保护山体结构,雪和云层则提供清楚的时间变化。

具有氛围运动的代表性文生视频山景结果

选择模型、时长、比例和清晰度

提示词必须与设置一起考虑。竖屏会改变主体的运动空间,短时长会限制可以清楚呈现的动作,切换模型也可能让清晰度或音频选项出现或消失。选择模型后,页面实际显示的选项就是当前可用范围。

切换模型时,系统会使用新模型自己的默认设置,避免把不支持的旧参数继续带过去。提交前仍要重新检查整个设置栏。积分也会根据当前模型和设置计算,而不是所有任务使用同一个固定数值。

  • 画面比例:只从当前显示的选项中选择,并在提示词里为主体运动预留对应空间。
  • 时长:让一个主要动作适应当前时长。时间越短,越需要删掉多余剧情。
  • 清晰度:有些模型提供多个选项,有些模型不显示该行,说明这一项由模型固定或内部处理。
  • 音频:以当前界面为准。显示开关时再写对白或声音意图;没有开关时,不要假设行为完全相同。
  • 模型选择:围绕具体场景、动作、语言、风格和所需设置进行测试,而不是只按品牌名称决定。

让镜头指令与主体动作一致

镜头语言既能增强叙事,也最容易产生冲突。要求固定机位同时快速环绕,就是直接矛盾;要求人物向左冲刺、镜头向右移动并非一定错误,但需要足够画幅空间和明确目的。

先判断镜头是要揭示信息、跟随动作、拉近情绪,还是保持观察。然后选择能完成该目的的最小运动。

固定或接近固定的镜头

当画面内部已有烟雾、布料、水面、机械、表情或商品光线变化时,稳定镜头能让细微运动更清楚。

推近与拉远

推近用于集中注意力,拉远用于揭示环境。说明主体是否始终居中,以及镜头最终要展示什么新信息。

横移、跟拍与环绕

适合表现方向、空间关系和形体。写清主体和镜头分别如何移动,并指出焦点始终落在哪里。

手持与强运动

说明强度。轻微手持质感与剧烈抖动完全不同。运动越快,主体动作和背景越要简化。

文生视频适用场景

当你没有现成关键帧,或者希望先探索画面方向时,文生视频最有价值。它可以把文字想法变成便于团队讨论的动态参考,也可以作为社交素材、概念镜头或后续制作的起点。结果能否直接使用,仍需根据实际输出和项目标准判断。

  • 营销概念探索:比较环境、光线、视觉隐喻和镜头方向。
  • 情绪与转场镜头:表现雾、粒子、光线变化、环境揭示等单一视觉事件。
  • 社交内容开场:测试竖屏或横屏中的简洁钩子和一个明确动作。
  • 分镜动态参考:展示计划镜头可能如何运动,辅助沟通而不是假装已经完成最终制作。
  • 没有商品图时的创意预演:探索台座、摄影棚、自然场景或抽象揭示方式。
  • 说明性视觉:生成一个简化的概念画面,同时由人工承担事实核验和最终编辑责任。

首次结果不理想时怎么改

高效迭代从诊断开始。先看整体意思,再分别检查主体、动作、镜头、构图和不希望发生的变化,找到最早出错的位置。先修改这一类问题,再决定是否更换模型或全面重写。

提示词优化可以帮助整理结构,但优化文本仍需人工复核。删除新增的第二个动作、无关物体和与时长冲突的复杂镜头。

画面有风格但缺少动作

补充起始状态、动作方向、速度和结束状态。与其写“更生动”,不如写“人物先静止,随后缓慢转向窗外”。

人物外观持续变化

减少视角跳变,写明少量必须保持的人物特征,并降低动作幅度。如果精确外观非常重要,可以先准备参考图,再使用图生视频。

出现多余人物或物体

简化环境,明确主体数量,并删除没有必要的“繁忙”“人群”“大片感”等宽泛词。保护干净前景和稳定背景。

动作太赶或没有完成

让动作适配时长,删除准备步骤,改用更接近目标状态的开场。只有当前模型确实提供更长时长时,再比较是否值得调整。

镜头跟丢主体

写清景别、跟随对象和主体位置,降低镜头速度,避免同时要求环绕与变焦,并在运动方向留出空间。

根据是否已有关键帧,进入图片驱动工作流、视频总入口或先完成图片创作。

文生视频 AI 生成器常见问题

下面的回答对应当前的文生视频流程,具体模型的设置与限制以生成器实际显示内容为准。
文生视频提示词应该包含什么?
至少包含主体、场景、一个主要动作、一个镜头运动、光线或氛围,以及必须保持稳定的关键细节。顺序和清晰度通常比单纯增加字数更重要。
一条提示词能直接完成长视频吗?
当前页面围绕不同模型的短片生成,不承诺一条提示词自动完成完整长片。较大故事应拆成独立镜头,再进行筛选、编辑和后续制作。
所有模型的时长和清晰度一样吗?
不一样。每个模型单独声明能力,Genify 只显示当前模型支持的参数。切换模型后会恢复新模型默认值,提交前要重新检查。
可以写对白或要求音频吗?
音频能力因模型而异。请以当前页面显示的音频选项和提示为准;即使某个模型支持音频,也不能保证它一定产生特定声音或准确口型。
为什么积分数量会变化?
积分由当前模型和设置计算。模型、时长、清晰度或音频选择变化时,界面显示的积分也可能变化。
什么时候应该改用图生视频?
当人物外观、商品造型、插画风格或开场构图已经确定,并希望它们指导视频时,图生视频更合适。想让模型从文字重新创造开场画面时,继续使用文生视频。