文生视频和图生视频怎么选
需要模型先创造画面:选择文生视频
需要保留既有画面:选择图生视频
Genify 的视频生成流程
- 01
选择输入模式
在文生视频与图生视频标签之间切换。不同模式决定你只需要文字,还是还要上传模型标记为必填的图片。 - 02
写清一个镜头
说明主体、动作、环境、镜头运动和氛围。短视频更适合一个主要动作和一个主要镜头指令,不要把完整剧情压进一次生成。 - 03
选择模型并复核参数
切换模型后会应用该模型的默认设置。重新检查比例、时长、清晰度、音频和图片输入,避免沿用旧模型的假设。 - 04
查看积分并提交
界面会根据当前模型和设置计算所需积分。确认输入、提示词和参数描述的是同一个目标镜头后再生成。 - 05
在工作区跟踪结果
提交成功后工作区会自动打开。后续进度、完成状态和结果操作都在统一界面中进行。
模型和参数会随工作流变化
不同 AI 视频模型支持的输入和参数并不相同。Genify 会根据所选模型显示对应设置,不支持的选项不会出现,切换模型时也会恢复该模型的默认值。因此,请以当前生成器中实际显示的选项为准。
不同模型可能提供不同的画面比例、清晰度、时长和音频设置。图生视频的上传区域会标出哪些图片必填、哪些可以选填;部分模型支持结束帧、角色或物体图片,以及额外的图片、视频或音频参考,另一些模型只需要一张起始图。
参数多不等于一定更适合。设置较少的模型可能会自动完成更多决策;设置较多的模型则需要提示词、图片和各项参数彼此一致。选择时应围绕具体镜头,而不是只看功能数量。
- 画面比例影响构图和运动方向。横屏、竖屏或方形画面需要不同的留白与主体位置。
- 时长决定一个镜头能容纳多少动作。时间较短时,减少动作节点比堆叠更多描述更有效。
- 清晰度只在当前模型提供对应选项时可选,不应把某一种输出规格写成所有模型的固定能力。
- 音频能力按模型变化。只有界面显示相关控制时,才应围绕对白、环境声或音频开关设计提示词。
- 需要上传的图片也会随模型变化。开始帧、结束帧、角色或物体图片及其他参考素材是否可用,请以页面显示内容为准。
生成前先规划动作、镜头和画幅
视频提示词的重点是描述时间变化,而不是把一连串形容词堆在一起。先区分主体动作和镜头动作:人物转身、商品旋转、云雾移动属于画面内部动作;推近、拉远、横移、环绕属于镜头动作。两者可以配合,但每次只保留一个主要动作和一个主要镜头方向,更容易得到可判断的结果。
可以把提示词想成一个单镜头时间线:开场是什么状态,中间发生什么变化,结尾停留在哪个视觉或情绪节点。节奏平缓时使用缓慢、轻微、稳定等明确动词;节奏强烈时也应说明加速、跟随、快速横移或手持感的程度,而不是只写“更有动感”。
先确定主体和必须保持的特征
把主要人物或物体放在提示词前部,并指出少量必须保持的特征,例如服装颜色、材质、轮廓、面部特征或画面位置。图生视频中可以依靠原图表达可见事实,只补充最重要的保持要求。
镜头运动要有明确目的
推近适合集中注意力,拉远适合揭示环境,环绕适合展示形体,固定机位适合突出主体或环境内部的细微变化。不要在短镜头里同时要求推、拉、摇、移、环绕和强烈抖动。
根据发布位置安排构图
竖屏通常需要更集中的主体和更谨慎的横向运动;宽画幅更适合展示环境和横向关系。字幕、Logo、商品细节和人物脸部需要提前留出安全区域。具体可选比例请以选择模型后页面显示的设置为准。
AI 视频生成适合哪些场景
更实际的用法,是解决一个清晰的视觉任务,而不是承诺一条提示词自动完成全部制作。短视频生成可以用于概念验证、提案展示、社交内容、运动探索和分镜沟通,也适合在正式拍摄或深度后期前比较不同方向。输出质量会受到输入素材、提示词、模型和设置共同影响。
- 概念片与情绪片:先验证场景、光线、镜头语言和节奏,再决定是否进入正式制作。
- 商品动态测试:围绕商品做轻微环绕、光线扫过、雾气、粒子或背景揭示,同时把商品造型设为保持项。
- 插画与概念图动画:让天气、布料、发丝、植物、光效或角色产生适度运动。
- 社交短视频版本:比较竖屏与横屏构图、不同开场动作或镜头方向,保持信息集中。
- 分镜与预演:把文字镜头或关键帧转成动态参考,帮助团队理解运动意图。
- 环境探索:表现雾、雨、水面、交通、树叶、光影或镜头在建筑与虚构空间中的移动。
实用的迭代与问题排查方法
第一版结果更适合用于发现问题,不必马上当作成片。先找出画面从哪一刻开始偏离预期,再只修改一类内容,例如源图、主体动作、镜头指令、构图、时长或模型设置。一次改动所有内容,很难判断哪项调整真正有效。
生成器提供提示词优化,但优化后的文字仍需要人工检查。删除与源图冲突的新物体、额外动作或过度电影化描述,保留你真正需要的镜头信息。
画面很漂亮但几乎不动
把“让画面动起来”改成可见动作,说明谁先动、向哪个方向、移动幅度和速度,以及镜头是否跟随。可以加入一项辅助环境运动,但不要抢走主体。
人物、商品或形状发生漂移
减少大幅转身、剧烈变形和极端环绕,强调少量稳定特征。图生视频优先换用主体更清晰、遮挡更少的源图,并先测试轻微动作。
镜头指令过多
保留一个主镜头运动,删除没有叙事作用的推拉摇移词。缓慢推近配合一个小动作,通常比同一段里同时环绕、变焦、升降和手持抖动更容易理解。
构图被破坏或主体出框
检查源图与所选比例,在运动方向预留空间,把重要信息远离边缘,并说明镜头应保持当前构图还是逐步揭示更多环境。
音频结果或音频入口不符合预期
先确认当前模型是否显示音频相关能力,再分别写清对白、环境声、音乐和静默段落。不要把某个模型的音频开关当成所有模型共有功能。
为什么把两种视频模式放在一个入口
同一入口可以让你在文生视频和图生视频之间连续调整思路。先用文字探索场景,确定关键帧后再转为图生视频;也可以先从现有图片尝试运动,当发现源图限制过强时,再回到文字重新设计整个画面。
两种模式沿用相同的模型选择、积分计算、任务提交和工作区逻辑,减少在不同产品之间来回切换。不过,它们仍需要不同的专业内容:文生视频重点是组织场景描述,图生视频重点是准备源图、设计运动并降低视觉漂移。
可以把这个 AI 视频生成器当作选择与创作中心,再根据具体问题进入两个子页面。这样既不会把宽泛品类词和任务词混在一起,也能让每个页面提供真正不同的帮助。
继续选择合适的 Genify 工具
- 用文字描述生成视频进入文生视频页面,学习提示词结构、镜头语言、示例和文字工作流的问题排查。
- 让一张静态图片动起来进入图生视频页面,了解源图准备、动作描述、可选帧控制和一致性方法。
- 先创建或优化关键帧当人物、插画、商品图或场景构图还没准备好时,先使用 AI 生图工具。
- 查看全部图片与视频模式返回 Genify 首页,在同一入口比较四种现有创作方式。