2026年9月11日指南

如何使用 Fish Creative 生成 AI 图像、视频和对口型视频 - 完整教程

如何使用 Fish Creative 生成 AI 图像、视频和对口型视频 - 完整教程

根据提示词生成图像,将其转化为视频,并让屏幕中的人物自然地开口说话。您可以在 Fish Creative 中完成这三个步骤。

Fish Creative 将您的 AI 创意工具整合在一个工作区中,包括图像生成、视频生成和对口型。无需在不同工具之间下载和上传文件,即可重复使用已创建的任何内容。无论您是在制作虚拟主持人、产品演示、社交媒体视频,还是具有独特声音的角色,都可以从同一个基础工作流程开始。

本教程将带您走完从开始到结束的整个过程。

跟随教程开始创建您自己的图像和视频。试用 Fish Creative


使用 Fish Creative 您可以做些什么?

登录 Fish Audio 并在左侧边栏中选择 Image & Video 以打开 Fish Creative。本教程重点介绍三个核心工具:

  • Image (图像): 从文本生成图像或上传参考图来引导新创作。您还可以使用 Topaz HD 放大单个图像并恢复细节。
  • Video (视频): 从文本、图像、首末帧、参考图、参考视频或包括音频在内的混合输入中创建视频。
  • Lip Sync (对口型): 为图像或视频添加音频,使屏幕中的人物说话口型与音频同步。 您的作品会自动保存到您的资产库中。制作完图像后,您可以直接将其发送到视频生成。视频准备就绪后,再发送到 Lip Sync。您可以全程留在同一个工作区内。

注册 Fish Audio 账户 开始使用 Fish Creative。新用户将获得免费积分来尝试图像生成、视频创建和对口型功能。


1. 从创意到成品视频:完整工作流程

在上方完整教程中观看此章节:00:19–01:06

在开始之前,您不需要学习每一个模型和按钮。先了解一段内容是如何组合而成的,然后再深入研究下面各章节的细节,这会有所帮助。

在本教程中,我们将制作一个包含虚拟主持人的短视频。以下是基本序列:

规划视频 → 创建角色图像 → 为图像添加动画 → 准备语音 → 添加口型同步

请按照以下步骤操作:

  1. 登录 Fish Audio 并从左侧边栏打开 Image & Video
  2. 确定视频的用途并选择宽高比。例如,对于社交媒体上的垂直出镜讲解视频,从 9:16 开始。
  3. 打开 Image 并编写提示词,描述角色、场景、构图、风格和光影。
  4. 选择模型和设置,生成图像,并挑选一张主体定义明确且构图适合动态效果的图像。
  5. 点击 Generate Video 直接将所选图像发送到视频工具。
  6. 编写提示词,描述角色的动作和表情、镜头运动以及节奏。
  7. 设置视频的宽高比、时长、分辨率和输出数量,然后生成视频。
  8. 检查面部、动作的连续性以及嘴部的可见度。选择一个适合进行对口型的视频。
  9. 在 Fish Audio 中打开 Text to Speech,输入脚本,并选择库中的声音或克隆的声音来生成音频。您也可以使用自己的录音。
  10. 将角色视频直接发送到 Lip Sync,然后从资产库中选择音频或上传音频文件。
  11. 设置宽高比、分辨率和输出数量,然后生成最终视频。
  12. 预览对口型效果。在这里,您可以重新生成、延长、下载或将结果重复用作参考。

提示: 您可以根据项目调整此工作流程。对于简单的出镜说话视频,可以跳过视频生成,直接在 Lip Sync 中使用角色图像和音频。对于电影或电商广告,创建多个参考图和视频镜头,然后将它们编辑成完整的作品。

接下来的章节将详细介绍图像生成、视频生成和对口型,并提供获得符合您创意的稳定结果的技巧。


2. 创建您的第一张 AI 图像

在上方完整教程中观看此章节:01:07–01:43

第 1 步:打开图像工具

打开 Fish Creative 并在页面顶部选择 Image。使用中心的提示词框描述您想要创建的内容。您还可以添加参考图来引导角色、产品、构图或视觉风格。

提示: 如果您已经有了想法,只需输入文本即可。您不需要先准备图像。

第 2 步:编写图像提示词

图像提示词告诉模型要创建什么。一个清晰的提示词通常涵盖:

  • 主体 (Subject): 图像中的人物、产品或物体。
  • 场景 (Setting): 主体所处的位置。
  • 构图 (Composition): 特写、全身照、顶视图、广角镜头或其他取景选择。
  • 风格 (Style): 摄影、插画、3D、电影感或其他视觉风格。
  • 光影 (Lighting): 柔光、自然光、霓虹灯、黄金时刻或类似的方向。 我们将使用一个正对镜头的虚拟创作者,以便在进入视频和对口型阶段时,图像易于处理。

提示词示例:

A young tech content creator standing in a modern creative studio.
Medium close-up, facing the camera with a confident, friendly expression.
A clean, uncluttered background, soft cinematic lighting, and a photorealistic style.
Clear facial features and rich detail throughout the image.

提示: 如果您计划制作垂直短视频,请在提示词中指定垂直取景,并在设置中选择匹配的宽高比。

第 3 步:根据需要添加参考图

如果您脑海中已经有了角色、产品或视觉风格,请上传参考图。参考图能帮助模型理解您想要保留的特征、构图或风格。在创建包含同一个角色的系列作品时,它们也非常有用。

选择具有以下特征的参考图:

  • 主体清晰且分辨率高。
  • 面部或产品无遮挡。
  • 取景接近您想要的最终结果。
  • 光影和色彩一致。

提示: 如果不需要参考,请跳过此步骤。

第 4 步:选择模型和设置

Fish Creative 目前提供多种图像模型,包括:

  • Nano Banana 2 Lite
  • GPT Image 2
  • Nano Banana 2
  • Nano Banana Pro
  • Seedream 5.0
  • Seedream 4.5

提示: 模型阵容会随着时间更新,请查看 Fish Creative 以获取当前选择。

您还可以调整:

  • 宽高比 (Aspect ratio): 横屏、竖屏或正方形。
  • 分辨率 (Resolution): 输出图像的尺寸。
  • 质量 (Quality): 结果的质量级别。
  • 输出数量 (Number of outputs): 一次生成一张或多张图像。

提示: “生成 (Generate)”按钮会显示预估的积分消耗,以及在当前设置下您的余额还能支持生成多少张图像。在提交前请检查该信息,并根据需要调整模型、质量或输出数量。

第 5 步:生成并选择图像

对提示词和设置感到满意后,点击 Generate。预览结果并选择最适合您视频的图像。

对于每张生成的图像,您可以:

  • 将其用作参考。
  • 重新创建。
  • 放大。
  • 用于对口型。
  • 从中生成视频。
  • 公开分享生成记录。
  • 下载。

提示: 如果主体看起来正确但您需要更大的图像或更多细节,请在继续下一步之前使用 Topaz HD 放大图像。

关于用于视频或对口型的图像建议

为后续步骤创建角色图像时:

推荐避免
正面视角或微侧角度,眼睛、鼻子和嘴巴清晰可见嘴部附近有手、头发或其他物体
提前为发布平台选定宽高比(9:16 常用于竖屏短视频)背景杂乱或拥挤

清晰的主体和平衡良好的构图能为您提供自然动作的更好起点。


3. 将静态图像转化为视频

在上方完整教程中观看此章节:01:44–02:22

第 1 步:打开视频工具

在页面顶部选择 Video。您可以仅凭文本提示词生成视频,也可以添加图像、视频或音频作为参考材料。

Fish Creative 支持多种生成视频的方式:

  • 文生视频。
  • 图生视频。
  • 首末帧生视频。
  • 参考图生视频。
  • 视频参考。
  • 音频参考结合其他输入。 在本教程中,我们将使用图生视频,从我们刚刚创建的角色图像开始。

第 2 步:添加您的图像或其他参考材料

直接从资产库中选择图像。无需下载再重新上传。根据模型和生成模式的不同,您可能还可以添加首帧、末帧、参考图、参考视频或参考音频。

每种类型的参考都有不同的用途:

  • 单张图像: 确立角色、场景和起始构图。
  • 首末帧: 定义视频的开始和结束方式。
  • 参考图: 帮助引导角色、物体或整体外观。
  • 参考视频: 为动作、镜头运动或节奏提供引导。
  • 参考音频: 为支持该功能的模型提供声音和时机提示。

第 3 步:编写视频提示词

图像提示词描述画面中的内容。视频提示词应侧重于场景如何移动和变化。有用的细节包括:

  • 主体的动作。
  • 表情或眼神的变化。
  • 镜头运动。
  • 背景或环境的变化。
  • 节奏和视觉风格。

提示词示例:

The person looks naturally into the camera, making small movements with their head and shoulders while maintaining a confident, friendly expression.
Movements are relaxed, smooth, and realistic.
The camera slowly pushes in, and the studio lighting stays consistent.
The video should feel natural and professional.

提示: 如果您打算添加对口型,请从简单的、受控的动作开始。剧烈的头部转动、快速的镜头移动以及在脸前经过的物体都会增加对口型的难度。

第 4 步:选择视频模型

Fish Creative 支持不断扩充的视频模型范围。以下是一些可用选项:

  • MiniMax H3
  • Seedance 2.0
  • Seedance 2.5
  • Kling O3 Pro
  • Seedance 2.0 Mini
  • Kling 2.6 Pro
  • Hailuo 2.3
  • Veo 3.1
  • Kling V3 Pro
  • Seedance 2.0 Fast
  • Seedance 1.5 Pro

提示: 随着时间的推移会添加更多模型,请查看 Fish Creative 以获取最新选择。模型可能支持不同的输入、时长和宽高比。先选择模型,然后从其提供的设置中进行选择。

第 5 步:设置视频参数

根据模型的不同,您可以调整:

  • 宽高比 (Aspect ratio): 选项包括 21:9、16:9、4:3、1:1、3:4、9:16 和自适应。
  • 时长 (Duration): 支持的时长因模型而异,目前可用选项的范围约为 4 到 30 秒。
  • 分辨率 (Resolution): 选择适合预览或最终输出的分辨率。
  • 输出数量 (Number of outputs): 一次生成一个或多个视频。

提示: “生成 (Generate)”按钮显示预估的积分消耗,以及您剩余余额在这些设置下可以覆盖多少个视频。

第 6 步:生成并审查您的视频

点击 Generate 并等待视频完成。预览时,检查以下各项:

  • 面部保持一致。
  • 动作看起来自然且流畅。
  • 没有明显的畸变。
  • 镜头运动和节奏与提示词匹配。
  • 嘴部在片段的大部分时间内保持清晰可见。 您可以将结果用作参考、重新创建、发送到 Lip Sync、延长、公开分享生成记录或下载。如果您对视频满意,点击 Use for Lip Sync 继续。

4. 通过对口型让您的角色开口说话

在上方完整教程中观看此章节:02:23–02:44

Fish Creative 的 Lip Sync 工具同时适用于图像和视频。添加角色的图像或视频,配以音频,即可生成嘴部动作与语音同步的视频。

第 1 步:准备您的角色图像或视频

您可以:

  • 从您的设备上传图像或视频。
  • 从资产库中选择您已经创建的内容。
  • 对图像或视频结果点击 Use for Lip Sync

第 2 步:使用文本转语音准备音频

对口型需要现有的音轨。您可以上传录音,或使用 Fish Audio 的 Text to Speech 工具创建一个。

要在 Fish Audio 中创建音频:

  1. 打开 Text to Speech
  2. 输入或粘贴您想让角色说的话。
  3. 从 Fish Audio 语音库中选择声音,或使用您创建的克隆声音。
  4. 生成音频并将其保存到资产库。
  5. 返回 Fish Creative 并在 Lip Sync 中选择该音频。

提示: 您也可以下载生成的音频并将文件上传到 Lip Sync。

在本教程中,尝试一个短脚本:

Welcome to Fish Creative.
Start with a single image, turn it into a video, and make your character speak naturally.

提示: 第一次测试时,保持在一两句话。简短的音频片段更容易检查角色的外观、说话节奏和对口型效果。

第 3 步:添加视觉效果和音频

返回 Fish Creative,选择 Lip Sync,并添加您的角色图像或视频。然后从资产库中选择音频或上传音频文件。

提示: 还有一个可选的提示词字段。如果您不需要额外指令,请留空。如果您想指定有关视觉效果的内容,请按照界面中的指导添加简短描述。

第 4 步:选择您的设置并生成

输入就绪后,设置:

  • 宽高比。
  • 分辨率。
  • 输出数量。 检查您是否选择了正确的角色和音频,然后点击 Generate

从头到尾观看完成的视频并检查:

  • 嘴部动作遵循语音的时机。
  • 面部保持一致。
  • 开始和结束感觉自然。
  • 视频和音频是完整的。
  • 角色的动作符合语音的基调。 您可以将结果用作参考、重新创建、再次应用对口型、延长视频、公开分享生成记录或下载。

获得更好对口型效果的建议

推荐避免
正面角色或微侧角度嘴部附近的头发、手或物体
背景噪音小的清晰语音,从自然说话节奏的简短脚本开始视频输入中突然的动作和快速的头部转动

提示: 如果效果不佳,请在添加大量详细指令之前尝试不同的图像、视频或音轨。


5. 三个尝试项目:出镜讲解视频、AI 电影和电商广告

在上方完整教程中观看此章节:02:45–03:39

这些项目使用相同的图像、视频和对口型工具,但每个项目都需要稍微不同的方法。出镜讲解视频取决于一致的角色和良好的语音表达。AI 电影需要镜头之间的连续性。电商广告需要准确展示产品并快速传达卖点。

以下是如何将这些工具结合用于每个项目的方法。

项目 1:AI 主持人视频

假设您正在制作一段 15 秒的垂直讲解视频,关于如何为短视频编写更强的开头。您需要一位正对镜头的主持人,以自然的声音表达一段简短的脚本。

您将需要:

  • 一个正面对或微侧角度的角色图像。
  • 一段阅读时间约为 15 秒的脚本。
  • Fish Audio 库中的声音、克隆声音或您自己的录音。
  • 9:16 的输出设置。

建议工作流程:

  1. Image 中创建您的角色,使用正对镜头的人物中特写。
  2. 对于动作极少的直接出镜视频,将图像直接发送到 Lip Sync
  3. 如果您希望在人开始说话之前有细微的呼吸、点头或肩膀移动,请先生成一段动作克制的小视频。
  4. Text to Speech 中生成脚本音频并将其保存到资产库。
  5. 将图像或视频以及音频添加到 Lip Sync,然后生成成品。

角色图像提示词:

A young content creator sitting in a clean, modern studio.
Medium close-up, facing the camera with a relaxed, confident, approachable expression.
Soft side lighting, a slightly blurred background, and a photorealistic style.
Vertical 9:16 composition.

脚本示例:

不要在短视频开头就自我介绍。
直接告诉观众他们能从中获得什么。
在最初的三秒钟内给他们一个留下来的理由。

提示: 保持眼神、表情、嘴部动作和声音的协同工作。角色不需要移动太多。稳定的呈现有助于观众专注于所说的内容。

项目 2:AI 短片

想象一个 20 到 30 秒的悬疑场景:一名侦探在一个雨夜进入一个废弃的车站,并在远处发现了一个神秘的身影。将其规划为一系列短镜头,而不是一次性生成整个序列。

从三个镜头开始:

  1. 全景镜头 (Establishing shot): 雨夜里一个废弃的车站。摄像机缓慢移向入口。
  2. 动作镜头 (Action shot): 侦探从画面侧面进入车站,停下,抬头观察空间。
  3. 对白特写 (Dialogue close-up): 侦探说出关键台词的特写。

建议工作流程:

  1. 使用 Image 创建侦探的角色参考,然后创建车站的图像。
  2. 使用 As Reference 将选定的角色和场景带入后续图像中,帮助镜头看起来保持一致。
  3. 分别生成三个镜头。对于全景镜头,使用文生视频或参考图。对于动作镜头,尝试单张图像、首末帧或视频参考。在对白特写中保持侦探正面对或微侧角度。
  4. 在 Fish Audio 中生成对白音频,然后仅对角色说话的特写镜头应用对口型。
  5. 下载镜头并在您常用的视频编辑器中进行组装:场景、动作,然后是对白。

角色参考提示词:

A detective in their early forties, wearing a long, dark trench coat.
Short hair, a tired but alert expression, and rain droplets on the collar.
Cinematic, photorealistic character reference with cool blue tones.
Clearly defined facial features in front and three-quarter views.

镜头 1 的视频提示词:

An abandoned train station on a rainy night.
Puddles reflect dim lights as fine rain continues to fall.
A thin mist drifts slowly in the distance.
The camera moves smoothly from outside the station toward the entrance.
A suspenseful cinematic atmosphere with cool blue tones.

对白示例:

我知道你一直在等我。

提示: AI 电影的一个常见问题是每个镜头单独看起来都不错,但角色、服装和地点在剪切之间不匹配。建立角色参考并一次生成一个镜头,比反复从头描述同一个角色更容易保持一致性。

项目 3:电商产品广告

假设您正在为一款面部精华液制作 15 秒的垂直广告。观众需要清晰地看到瓶子和质地,同时主持人简要解释主要功效。

规划四个镜头:

  • 0–3 秒: 瓶子的特写,让观众立即识别出产品。
  • 3–7 秒: 一个人拿起产品,展示使用情况。
  • 7–11 秒: 精华液质地或产品细节的特写。
  • 11–15 秒: 主持人对着镜头说话,随后是展示产品和品牌的结束画面。

建议工作流程:

  1. 上传一张清晰的产品照片作为其外观的参考。
  2. Image 中创建产品静物图、有人拿着产品的图像以及质地特写。一旦有了喜欢的结果,使用 As Reference 以相同风格创建更多资产。
  3. 将静物和使用图像转化为短视频。保持产品镜头简单:缓慢的推近、旋转或光影变化。复杂的动作可能会扭曲瓶子或包装上的文字。
  4. 为主持人准备一个单独的正面图像或稳定的视频,并在 Fish Audio 中为产品信息生成音频。
  5. 使用 Lip Sync 创建主持人片段,然后下载片段,将它们编辑在一起,并添加字幕和修饰。

产品图像提示词:

A premium facial serum in a clear glass bottle on a pale stone countertop.
The front of the bottle faces the camera.
Soft morning light falls from behind and to one side, with a few water droplets and clean reflections around the product.
High-end skincare advertising photography, a clearly defined product silhouette, and space for copy.
Vertical 9:16 composition.

产品视频提示词:

The camera slowly moves toward the serum bottle as water droplets slide gently down the glass.
The background lighting shifts softly.
The product remains steady and clearly defined, with restrained movement and the look of a high-end skincare ad.

脚本示例:

一步到位,轻盈补水,快速吸收。
早晚使用,简化您的护肤流程。

提示: 产品辨识度在电商内容中最为重要。使用清晰的参考图,并在画面中给产品留出足够的空间。如果包装文字、标志或瓶身形状必须非常精确,请在发布前逐帧检查视频,并在后期制作中使用实际的产品资产纠正任何偏差。


6. 有用的按钮及其使用时机

在上方完整教程中观看此章节:03:40–04:32

Fish Creative 不仅仅只有“生成”这一下。每个结果下方的按钮让您可以将图像或视频发送到下一个工具,或者继续完善您喜欢的版本。以下是您最常使用的按钮。

Prompt Optimization (提示词优化):为初步构思添加细节

如果您的提示词非常简短,例如“咖啡馆里的人”或“产品广告视频”,提示词优化可以帮助您扩展它。它会添加有关主体、场景、构图、光影、动作或镜头运动的细节。

分三步使用它:

  1. 写下必须保持不变的核心要素,例如角色的身份、产品名称、要求的动作和宽高比。
  2. 使用提示词优化添加视觉细节。
  3. 在生成之前阅读修改后的提示词。删除您不需要的任何内容,并确保角色、产品和动作仍然符合您的初衷。

提示: 提示词优化在您知道自己想要什么但不知道如何描述时非常有用。将结果视为在生成前需要审查的草案。

Recreate (重新生成):尝试另一个版本

当结果很接近但表情、构图、动作或镜头运动需要调整时,使用 Recreate。它让您可以在现有生成的基础上进行构建,而无需重新从空白页开始设置任务。

在重新生成之前,确定需要更改的内容:

  • 主体或场景错误: 修改提示词中的核心描述。
  • 构图需要改进: 指定取景、相机位置和主体的摆放。
  • 动作太大: 要求减少动作,并使用“细微 (subtle)”、“缓慢 (slow)”和“稳定 (steady)”等词。
  • 您只是想要另一个变体: 保持主要设置并再次生成。

提示: 重新生成最适合对您已经满意的创意进行小幅调整。

As Reference (作为参考):在您喜欢的结果基础上构建

点击 As Reference 将当前图像或视频添加到新的生成任务中。使用它来延续您已经确立的角色、产品、场景、视觉风格或动作。

常见用途包括:

  • 将同一个角色置于不同的场景中。
  • 为同一个产品创建多个广告资产。
  • 使用现有的镜头或动作来引导后续视频。
  • 从一个成功的结果中构建一个系列。

提示: 参考图是引导下一次生成;它不是简单地复制原始图。您的提示词仍然需要说明应该保留什么以及应该改变什么。例如:“保持角色的面部和服装一致,将背景改为夜晚的街道。”

Image Upscaling (图像放大):使用 Topaz HD 恢复细节

当您对主体和构图满意但需要更高的分辨率或更精细的细节时,使用图像放大。Fish Creative 使用 Topaz HD 来放大单个图像并恢复细节。

提示: 这在下载最终图像、创建封面图或进入视频生成之前非常有用。如果角色的解剖结构或产品的形状已经错了,放大通常无法修复它。请先重新创建图像或修改提示词。

Generate Video (生成视频):为您喜欢的图像添加动画

图像下方的 Generate Video 按钮将该结果直接发送到视频工具,省去了下载和上传的麻烦。

提示: 到达那里后,将提示词重点放在动作、镜头运动和随时间的变化上。您不需要再次对静态图像进行冗长的描述。尝试:“人物微微抬头,镜头缓慢移近,背景灯光逐渐变亮。”

Use for Lip Sync (用于对口型):给您的角色一个声音

您可以对图像和视频结果都选择 Use for Lip Sync。使用图像时,该工具会根据图像和音频创建一个说话视频。使用视频时,它会在保持现有动作的同时使嘴部动作与音频同步。

提示: 直接从图像进行对口型非常适合稳定的出镜讲解视频。从视频开始在您想要呼吸、点头或身体动作时非常有用。无论哪种情况,确保面部清晰且嘴部无遮挡。

Extend Video (延长视频):延续现有片段

当您喜欢一段片段的动作、镜头运动和风格但需要它运行更长时间时,使用 Extend Video。延长功能让您可以继续现有的场景和动作。

提示: 在延长之前检查最后一帧。畸变的角色、快速的动作或即将离开画面的主体可能会在延续中导致问题。以稳定、清晰的帧结束的片段通常更容易平滑延长。

Asset Library and History (资产库与历史记录):查找并重复使用您的作品

您的作品会自动保存在资产库和生成历史中。从那里,您可以找到之前的图像、视频和音频,并将它们直接添加到新任务中。

提示: 保留几个关键版本:您的原始参考图、第一个可用的结果、最终的高质量输出,以及您用于对口型的稳定视频。这样可以更轻松地修改某个阶段,而无需重新启动整个过程。

Public Sharing and Download (公开分享与下载):检查最终结果

下载功能将结果保存到您的设备,以便您进行编辑、用于设计或发布。公开分享生成记录让其他人可以看到您的创作。只有在您准备好公开内容时才使用该选项。

提示: 在下载之前,检查宽高比、分辨率、角色和产品细节以及对口型效果。确定视频在后期制作中是否还需要字幕或品牌标识。

Credit Cost and Remaining Generations (积分消耗与剩余生成次数):生成前检查

“生成”按钮显示当前设置下的预估积分消耗,以及您的余额可以支持生成多少图像或视频。在更改分辨率、时长或输出数量时,请在提交前检查预估值的变化。

提示: 这有助于您规划测试运行和最终输出。使用早期生成来确定构图和动作,一旦对方向满意,再选择最终设置。


开始使用 Fish Creative 进行创作

Fish Creative 将您的创意工具整合在一个工作区中。在本教程中,您使用了图像生成、视频生成和对口型,从一个简单的提示词发展到使用 Fish Audio 语音说话的角色。

您的第一个项目可以很简单:一个取景清晰的角色,一点动作,以及一两句话。一旦您熟悉了流程,就可以尝试参考图、首末帧、视频参考或更具雄心的运镜。

开始使用 Fish Creative 创作您自己的作品 →

常见问题解答

我能仅通过文本生成图像和视频吗?
是的。图像工具接受文本提示词,视频工具支持文生视频。您还可以添加图像、视频或音频参考以获得更多控制。
我能使用静态图像进行对口型吗?
是的。Lip Sync (对口型) 接受图像和视频。如果您希望最终结果中有更多的身体动作,可以先将图像转化为视频,然后再应用对口型。
所有模型都有相同的设置吗?
不是。支持的输入、宽高比、时长和分辨率因模型而异。请查看选择模型后显示的选项。
我需要手动保存生成的结果吗?
您的结果会自动保存到资产库中,您可以跨工具重复使用它们。您也可以将它们下载到您的设备上。
Frank Lu

Frank Lu

Product, Operation & Data Engineer

阅读Frank Lu的更多内容

创造真实感的声音

立即开始生成最高质量的音频。

已有账号? 登录