2026年9月11日ガイド

Fish Creative で AI 画像、動画、リップシンク動画を生成する方法 - 完全チュートリアル

Fish Creative で AI 画像、動画、リップシンク動画を生成する方法 - 完全チュートリアル

プロンプトから画像を生成し、それを動画に変え、画面上の人物を自然に話させる。これらすべてを Fish Creative で行うことができます。

Fish Creative は、画像生成、動画生成、リップシンクなど、AI クリエイティブツールを 1 つのワークスペースに統合します。ツール間でファイルをダウンロードしたりアップロードしたりすることなく、作成済みのものを再利用できます。バーチャルプレゼンター、製品デモ、ソーシャルメディア動画、独自のキャラクター制作など、どのような場合でも同じ基本的なワークフローから始めることができます。

このチュートリアルでは、最初から最後までの一連のプロセスを説明します。

チュートリアルに沿って、自分だけの画像や動画の作成を始めましょう。Fish Creative を試す


Fish Creative で何ができる?

Fish Audio にサインインし、左側のサイドバーで 画像 & 動画 を選択して Fish Creative を開きます。このチュートリアルでは、3 つの主要ツールに焦点を当てます:

  • 画像: テキストから画像を生成したり、参照画像をアップロードして新しい制作のガイドにしたりできます。また、Topaz HD を使用して個々の画像をアップスケールし、細部を復元することも可能です。
  • 動画: テキスト、画像、最初と最後のフレーム、参照画像、参照動画、または音声を含む入力の組み合わせから動画を作成します。
  • リップシンク: 画像や動画に音声を追加して、画面上の人物がその音声に合わせて話すようにします。 制作物はアセットライブラリに自動的に保存されます。画像を作成したら、そのまま動画生成に送ることができます。動画の準備ができたら、リップシンクに送ります。終始同じワークスペース内で作業を完結できます。

Fish Audio アカウントに登録して、Fish Creative の利用を開始しましょう。新規ユーザーには、画像生成、動画作成、リップシンクを試せる無料クレジットが付与されます。


1. アイデアから完成した動画まで:フルワークフロー

上記の完全チュートリアルでこのセクションを確認する: 00:19–01:06

始める前にすべてのモデルやボタンを覚える必要はありません。まずコンテンツがどのように組み上がるかを確認し、その後に以下のセクションで詳細を確認するのが効率的です。

このチュートリアルでは、バーチャルプレゼンターが登場する短い動画を作成します。基本的な手順は以下の通りです:

動画の計画 → キャラクター画像の作成 → 画像のアニメーション化 → 音声の準備 → リップシンクの追加

以下のステップに従ってください:

  1. Fish Audio にサインインし、左側のサイドバーから 画像 & 動画 を開きます。
  2. 動画の使用場所を決め、アスペクト比を選択します。例えば、SNS 用の縦型のトーク動画なら、9:16 から始めます。
  3. 画像 を開き、キャラクター、設定、構図、スタイル、ライティングを説明するプロンプトを書きます。
  4. モデルと設定を選択して画像を生成し、被写体がはっきりしていて、動きをつけた時にうまく機能しそうな構図のものを 1 つ選びます。
  5. 動画を生成 をクリックして、選択した画像を直接動画ツールに送ります。
  6. キャラクターの動きや表情、カメラワーク、テンポを説明するプロンプトを書きます。
  7. 動画のアスペクト比、再生時間、解像度、出力数を設定し、生成します。
  8. 顔、動きの連続性、口の視認性を確認します。リップシンクに適した動画を選びます。
  9. Fish Audio の テキスト読み上げ を開き、スクリプトを入力し、ライブラリの音声またはクローン音声を選択して音声を生成します。自分の録音を使用することもできます。
  10. キャラクター動画を直接 リップシンク に送り、アセットライブラリから音声を選択するか、音声ファイルをアップロードします。
  11. アスペクト比、解像度、出力数を設定し、完成した動画を生成します。
  12. リップシンクをプレビューします。そこから、再生成、延長、ダウンロード、または参照としての再利用が可能です。

ヒント: プロジェクトに合わせてこのワークフローを調整できます。カメラに向かって話す人の素早い動画が必要な場合は、動画生成をスキップして、キャラクター画像と音声をリップシンクで使用します。映画や EC 広告の場合は、複数の参照画像や動画カットを作成し、それらを編集して完成品にします。

次のセクションでは、画像生成、動画生成、リップシンクについて詳しく説明し、アイデア通りの一貫した結果を得るためのヒントを紹介します。


2. 最初の AI 画像を作成する

上記の完全チュートリアルでこのセクションを確認する: 01:07–01:43

ステップ 1: 画像ツールを開く

Fish Creative を開き、ページ上部の 画像 を選択します。中央のプロンプトボックスを使用して、作成したい内容を説明します。キャラクター、製品、構図、またはビジュアルスタイルをガイドするための参照画像を追加することもできます。

ヒント: アイデアから始める場合、必要なのはテキストだけです。事前に画像を用意する必要はありません。

ステップ 2: 画像プロンプトを書く

画像プロンプトは、何を制作するかをモデルに伝えます。明確なプロンプトには通常、以下が含まれます:

  • 被写体: 画像内の人物、製品、または物体。
  • 設定: 被写体がどこにいるか。
  • 構図: クローズアップ、全身ショット、俯瞰、広角、またはその他のフレーミングの選択。
  • スタイル: 写真、イラスト、3D、シネマティックな外観、またはその他のビジュアルスタイル。
  • ライティング: ソフトライト、自然光、ネオン、ゴールデンアワー、または同様の指示。 動画やリップシンクに進んだ際に作業しやすいよう、カメラを向いたバーチャルクリエイターを使用します。

プロンプト例:

モダンなクリエイティブスタジオに立つ、若いテック系コンテンツクリエイター。
ミディアムクローズアップ、自信に満ちたフレンドリーな表情でカメラを向いている。
すっきりとして整理された背景、ソフトでシネマティックなライティング、フォトリアルなスタイル。
明確な顔の特徴と画像全体の豊かなディテール。

ヒント: 縦型のショート動画を計画している場合は、プロンプトで縦型のフレーミングを指定し、設定で対応するアスペクト比を選択してください。

ステップ 3: 必要に応じて参照画像を追加する

すでにキャラクター、製品、またはビジュアルスタイルのイメージがある場合は、参照画像をアップロードします。参照画像は、保持したい特徴、構図、またはスタイルをモデルが理解するのに役立ちます。同じキャラクターが登場するシリーズを作成する場合にも便利です。

以下の特徴を持つ参照画像を選んでください:

  • 被写体が明確で、解像度が良いもの。
  • 顔や製品が遮られていないもの。
  • 最終結果に近いフレーミングのもの。
  • 一貫したライティングと色味。

ヒント: 参照が必要ない場合は、このステップをスキップしてください。

ステップ 4: モデルと設定を選択する

Fish Creative では現在、以下を含む複数の画像モデルを提供しています:

  • Nano Banana 2 Lite
  • GPT Image 2
  • Nano Banana 2
  • Nano Banana Pro
  • Seedream 5.0
  • Seedream 4.5

ヒント: モデルのラインナップは随時更新されるため、最新の選択肢については Fish Creative を確認してください。

以下の調整も可能です:

  • アスペクト比: 横長、縦長、または正方形。
  • 解像度: 出力画像の寸法。
  • 品質: 結果の品質レベル。
  • 出力数: 1 枚または数枚を一度に生成。

ヒント: 「生成」ボタンには、推定クレジットコストと、現在の設定で残高からあと何枚生成できるかが表示されます。送信前に確認し、必要に応じてモデル、品質、または出力数を調整してください。

ステップ 5: 生成して画像を選択する

プロンプトと設定に満足したら、生成 をクリックします。結果をプレビューし、動画に最適な画像を選びます。

生成された各画像に対して、以下の操作が可能です:

  • 参照として使用。
  • 再作成。
  • アップスケール。
  • リップシンクに使用。
  • そこから動画を生成。
  • 生成記録を公開共有。
  • ダウンロード。

ヒント: 被写体は良いが、より大きな画像や詳細が必要な場合は、次に進む前に Topaz HD を使用して画像をアップスケールしてください。

動画やリップシンクで使用する画像へのアドバイス

次のステップのためにキャラクター画像を作成する際:

推奨避けるべきこと
目、鼻、口がはっきりと見える正面またはわずかな角度口の近くの手、髪、またはその他の物体
投稿プラットフォームに合わせて最初から選択されたアスペクト比(ショート動画では 9:16 が一般的)ごちゃごちゃした背景や混雑した背景

明確な被写体とバランスの取れた構図は、自然な動きを作るためのより良い出発点となります。


3. 静止画を動画に変換する

上記の完全チュートリアルでこのセクションを確認する: 01:44–02:22

ステップ 1: 動画ツールを開く

ページ上部の 動画 を選択します。テキストプロンプトのみから動画を生成することも、画像、動画、または音声をリファレンスとして追加することもできます。

Fish Creative は、動画を生成するためのいくつかの方法をサポートしています:

  • Text to Video (テキストから動画)
  • Image to Video (画像から動画)
  • 最初と最後のフレームから動画
  • 参照画像から動画
  • 動画リファレンス
  • 他の入力と組み合わせた音声リファレンス このチュートリアルでは、先ほど作成したキャラクター画像を使用して「画像から動画」を作成します。

ステップ 2: 画像やその他のリファレンス素材を追加する

アセットライブラリから画像を直接選択します。ダウンロードして再度アップロードする必要はありません。モデルや生成モードによっては、最初のフレーム、最後のフレーム、参照画像、参照動画、または参照音声を追加することもできます。

各リファレンスには異なる目的があります:

  • 単一の画像: キャラクター、設定、開始時の構図を確立します。
  • 最初と最後のフレーム: 動画の始まりと終わりを定義します。
  • 参照画像: キャラクター、オブジェクト、または全体的なルックのガイドとなります。
  • 参照動画: アクション、カメラの動き、またはテンポのガイドとなります。
  • 参照音声: 対応するモデルにおいて、音とタイミングの合図を提供します。

ステップ 3: 動画プロンプトを書く

画像のプロンプトはフレーム内にあるものを説明しますが、動画のプロンプトはシーンがどのように動き、変化するかに焦点を当てる必要があります。役立つ詳細には以下が含まれます:

  • 被写体のアクション。
  • 表情や視線の変化。
  • カメラの動き。
  • 背景や環境の変化。
  • テンポとビジュアルスタイル。

プロンプト例:

人物は自信に満ちたフレンドリーな表情を保ちながら、頭や肩をわずかに動かし、自然にカメラを見ている。
動きはリラックスしており、滑らかでリアル。
カメラはゆっくりと寄り、スタジオのライティングは一定に保たれる。
動画は自然でプロフェッショナルな印象を与えるべきである。

ヒント: リップシンクを追加する予定がある場合は、シンプルで制御された動きから始めてください。急な振り向き、速いカメラの動き、顔の前を横切る物体などは、リップシンクを難しくする可能性があります。

ステップ 4: 動画モデルを選択する

Fish Creative は、進化し続ける幅広い動画モデルをサポートしています。利用可能なオプションの一部を以下に示します:

  • MiniMax H3
  • Seedance 2.0
  • Seedance 2.5
  • Kling O3 Pro
  • Seedance 2.0 Mini
  • Kling 2.6 Pro
  • Hailuo 2.3
  • Veo 3.1
  • Kling V3 Pro
  • Seedance 2.0 Fast
  • Seedance 1.5 Pro

ヒント: モデルは随時追加されるため、最新の選択肢については Fish Creative を確認してください。モデルによって、サポートする入力、再生時間、アスペクト比が異なる場合があります。まずモデルを選択してから、そのモデルが提供する設定の中から選択してください。

ステップ 5: 動画パラメータを設定する

モデルに応じて、以下を調整できます:

  • アスペクト比: 21:9、16:9、4:3、1:1、3:4、9:16、Adaptive などのオプションがあります。
  • 再生時間: サポートされる長さはモデルによって異なり、現在は約 4 秒から 30 秒の範囲です。
  • 解像度: プレビューまたは最終出力に適した解像度を選択します。
  • 出力数: 1 つまたは複数の動画を一度に生成します。

ヒント: 「生成」ボタンには、推定クレジットコストと、残高で生成可能な動画数が表示されます。

ステップ 6: 生成して動画を確認する

生成 をクリックして、動画が完成するまで待ちます。プレビューする際は、以下を確認してください:

  • 顔に一貫性があるか。
  • 動きが自然でスムーズか。
  • 明らかな歪みがないか。
  • カメラの動きとテンポがプロンプトと一致しているか。
  • クリップの大部分で口がはっきりと見えているか。 結果を参照として使用したり、再作成、リップシンクへの送信、延長、生成記録の公開共有、またはダウンロードしたりできます。動画に満足したら、リップシンクに使用 をクリックして続行します。

4. リップシンクでキャラクターを話させる

上記の完全チュートリアルでこのセクションを確認する: 02:23–02:44

Fish Creative のリップシンクツールは、画像と動画の両方で使用できます。キャラクターの画像または動画を追加し、音声とペアリングすると、話し方に合わせた口の動きを持つ動画が生成されます。

ステップ 1: キャラクターの画像または動画を準備する

以下のことが可能です:

  • デバイスから画像または動画をアップロードする。
  • アセットライブラリから作成済みのものを選択する。
  • 画像または動画の結果で リップシンクに使用 をクリックする。

ステップ 2: テキスト読み上げで音声を準備する

リップシンクには既存のオーディオトラックが必要です。録音をアップロードするか、Fish Audio の テキスト読み上げ ツールで作成できます。

Fish Audio で音声を作成するには:

  1. テキスト読み上げ を開きます。
  2. キャラクターに話させたいセリフを入力または貼り付けます。
  3. Fish Audio のボイスライブラリから声を選択するか、作成したクローン音声を使用します。
  4. 音声を生成し、アセットライブラリに保存します。
  5. Fish Creative に戻り、リップシンクでその音声を選択します。

ヒント: 生成した音声をダウンロードして、そのファイルをリップシンクにアップロードすることもできます。

このチュートリアルでは、短いスクリプトを試してみてください:

Fish Creative へようこそ。
1 枚の画像から始めて、それを動画にし、キャラクターを自然に話させましょう。

ヒント: 最初のテストでは、1〜2 文程度に留めてください。短いオーディクリップの方が、キャラクターの外見、話すペース、リップシンクを確認しやすくなります。

ステップ 3: ビジュアルと音声を追加する

Fish Creative に戻り、リップシンク を選択して、キャラクターの画像または動画を追加します。次に、アセットライブラリから音声を選択するか、音声ファイルをアップロードします。

ヒント: オプションのプロンプトフィールドもあります。追加の指示が必要ない場合は空欄のままにしてください。ビジュアルについて何か指定したい場合は、インターフェースのガイダンスに従って短い説明を追加してください。

ステップ 4: 設定を選択して生成する

入力が完了したら、以下を設定します:

  • アスペクト比。
  • 解像度。
  • 出力数。 正しいキャラクターと音声が選択されていることを確認し、生成 をクリックします。

完成した動画を最初から最後まで視聴し、以下を確認してください:

  • 口の動きが話すタイミングと一致しているか。
  • 顔が一貫しているか。
  • 始まりと終わりが自然か。
  • 動画と音声が完全か。
  • キャラクターの動きが声のトーンに合っているか。 結果を参照として使用したり、再作成、リップシンクの再適用、動画の延長、生成記録の公開共有、またはダウンロードしたりできます。

より良いリップシンクのためのアドバイス

推奨避けるべきこと
正面を向いたキャラクターまたはわずかな角度口の近くの髪、手、または物体
背景ノイズが少なく、自然な話し方のペースで始まる短いスクリプト動画入力における突然の動きや速い頭の回転

ヒント: 結果がうまくいかない場合は、詳細な指示をたくさん追加する前に、別の画像、動画、またはオーディオトラックを試してみてください。


5. 試してみるべき 3 つのプロジェクト:トーク動画、AI 映画、EC 広告

上記の完全チュートリアルでこのセクションを確認する: 02:45–03:39

これらのプロジェクトでは同じ画像、動画、リップシンクツールを使用しますが、それぞれ少しずつ異なるアプローチが必要です。トーク動画は一貫したキャラクターと優れた音声デリバリーが重要です。AI 映画はカット間の一貫性が必要です。EC 広告は製品を正確に見せ、セールスポイントを素早く伝える必要があります。

それぞれのツールをどのように組み合わせるかを紹介します。

プロジェクト 1: AI プレゼンター動画

ショート動画の強力なオープニングの書き方についての 15 秒の縦型解説動画を作成するとします。カメラに向かった 1 人のプレゼンターが、自然な声で短いスクリプトを話すようにします。

必要なもの:

  • 前面またはわずかな角度を向いたキャラクター画像。
  • 読むのに約 15 秒かかるスクリプト。
  • Fish Audio ライブラリの声、クローン音声、または自分の録音。
  • 9:16 の出力設定。

推奨ワークフロー:

  1. 画像 でキャラクターを作成し、人物がカメラを向いているミディアムクローズアップを使用します。
  2. 動きの少ないシンプルなトーク動画の場合は、画像を直接 リップシンク に送ります。
  3. 人が話し始める前に微妙な呼吸、頷き、または肩の動きを入れたい場合は、まず控えめな動きで動画を生成します。
  4. テキスト読み上げ でスクリプト音声を生成し、アセットライブラリに保存します。
  5. 画像または動画と音声を リップシンク に追加し、完成品を生成します。

キャラクター画像プロンプト:

清潔でモダンなスタジオに座っている若いコンテンツクリエイター。
ミディアムクローズアップ、リラックスして自信があり、親しみやすい表情でカメラを向いている。
ソフトなサイドライティング、わずかにぼかした背景、フォトリアルなスタイル。
垂直 9:16 構図。

スクリプト例:

ショート動画を自己紹介から始めないでください。
視聴者に、見ることで何が得られるかを伝えてください。
最初の 3 秒間で、視聴者がとどまる理由を与えるのです。

ヒント: 視線、表情、口の動き、そして声を連動させましょう。キャラクターはあまり動く必要はありません。安定した存在感は、視聴者が話されている内容に集中するのを助けます。

プロジェクト 2: AI 短編映画

20〜30 秒のサスペンスシーンを想像してください:雨の夜、刑事が廃駅に入り、遠くに謎の人影を見つけます。これを 1 回で生成するのではなく、一連の短いカットとして計画します。

3 つのカットから始めます:

  1. エスタブリッシング・ショット: 雨の夜の廃駅。カメラはゆっくりと入り口に向かって移動する。
  2. アクション・ショット: 刑事がフレームの端から駅に入り、立ち止まって周囲を見渡す。
  3. 台詞のクローズアップ: 刑事が重要なセリフを言うクローズアップ。

推奨ワークフロー:

  1. 画像 を使用して刑事のキャラクターリファレンスを作成し、次に駅の画像を作成します。
  2. 参照として使用 を選択して、選択したキャラクターと設定を後の画像に引き継ぎ、カット間の一貫性を保ちます。
  3. 3 つのカットを別々に生成します。エスタブリッシング・ショットには Text-to-Video または参照画像を使用します。アクション・ショットには、単一の画像、最初と最後のフレーム、または動画リファレンスを試してください。台詞のクローズアップでは、刑事を正面またはわずかな角度に向けさせます。
  4. Fish Audio で台詞音声を生成し、キャラクターが話すクローズアップにのみリップシンクを適用します。
  5. カットをダウンロードし、通常使用している動画編集ソフトで、設定、アクション、台詞の順に組み立てます。

キャラクターリファレンスプロンプト:

長いダークトレンチコートを着た 40 代前半の刑事。
短髪、疲れているが警戒を怠らない表情、襟元には雨のしずく。
シネマティックでフォトリアルなキャラクターリファレンス、冷たいブルーのトーン。
正面および斜め前からの構図で明確に定義された顔の特徴。

カット 1 の動画プロンプト:

雨の夜の廃駅。
細かい雨が降り続く中、水たまりが鈍い光を反射している。
遠くで薄い霧がゆっくりと漂っている。
カメラは駅の外から入り口に向かってスムーズに移動する。
冷たいブルーのトーンのサスペンスフルなシネマティックな雰囲気。

台詞サンプル:

君が私を待っていたのは分かっている。

ヒント: AI 映画でよくある問題は、個々のカットは良くても、キャラクター、服装、場所がカット間で一致しないことです。キャラクターリファレンスを確立し、1 カットずつ生成することで、同じキャラクターを一から繰り返し説明するよりも一貫性を保ちやすくなります。

プロジェクト 3: EC 商品広告

フェイスセラムの 15 秒の縦型広告を作成するとします。視聴者にボトルとテクスチャをはっきりと見せつつ、プレゼンターが主なメリットを簡潔に説明する必要があります。

4 つのカットを計画します:

  • 0–3 秒: 視聴者がすぐに製品を認識できるよう、ボトルのクローズアップ。
  • 3–7 秒: 人が製品を手に取り、使用している様子を見せる。
  • 7–11 秒: セラムのテクスチャまたは製品の詳細のクローズアップ。
  • 11–15 秒: プレゼンターがカメラに向かって話し、最後に製品とブランドを表示するフレーム。

推奨ワークフロー:

  1. 外観の参照として、鮮明な製品写真をアップロードします。
  2. 画像 で、製品の静物写真、誰かが製品を持っている画像、テクスチャのクローズアップを作成します。気に入った結果が得られたら、参照として使用 を選択して同じスタイルのアセットをさらに作成します。
  3. 静物写真と使用シーンの画像を短い動画に変換します。製品カットはシンプルに保ちます:ゆっくりとしたプッシュイン、回転、またはライティングの変化。複雑な動きは、ボトルやパッケージのテキストを歪ませる可能性があります。
  4. プレゼンター用に別の正面画像または安定した動画を用意し、Fish Audio で製品メッセージの音声を生成します。
  5. リップシンク を使用してプレゼンターセグメントを作成し、クリップをダウンロードして編集し、キャプションや仕上げを追加します。

製品画像プロンプト:

薄い石のカウンターの上にある、透明なガラス瓶に入ったプレミアムフェイスセラム。
ボトルの正面がカメラを向いている。
柔らかな朝の光が後ろと横から差し込み、製品の周囲にはいくつかの水滴と綺麗な反射がある。
高級スキンケア広告写真、明確に定義された製品のシルエット、コピーを入れるためのスペース。
垂直 9:16 構図。

製品動画プロンプト:

水滴がガラスを優しく滑り落ちる中、カメラはゆっくりとセラムのボトルに向かって移動する。
背景のライティングが柔らかく変化する。
製品は安定して明確に定義されており、高級スキンケア広告のような控えめな動き。

スクリプト例:

軽やかで素早く浸透する保湿を、これ一本で。
朝晩使って、よりシンプルなスキンケア習慣を。

ヒント: EC コンテンツでは製品認識が最も重要です。明確な参照画像を使用し、フレーム内で製品に十分なスペースを与えてください。パッケージのテキスト、ロゴ、ボトルの形状を正確にする必要がある場合は、公開前に動画をフレーム単位で確認し、ポストプロダクションで実際の製品アセットを使用して不一致を修正してください。


6. 便利なボタンとその使用タイミング

上記の完全チュートリアルでこのセクションを確認する: 03:40–04:32

Fish Creative には、最初の「生成」クリック以上の機能があります。各結果の下にあるボタンを使用すると、画像や動画を次のツールに送ったり、気に入ったバージョンをさらに洗練させたりできます。ここでは、特によく使うものを紹介します。

プロンプトの最適化: アイデアに詳細を追加する

「カフェにいる人」や「製品広告動画」といった短いプロンプトの場合、プロンプトの最適化を使用して拡張できます。被写体、設定、構図、ライティング、アクション、カメラの動きに関する詳細が追加されます。

3 つのステップで使用します:

  1. キャラクターのアイデンティティ、製品名、必要なアクション、アスペクト比など、変えてはいけない必須事項を書き留めます。
  2. プロンプトの最適化を使用して、視覚的な詳細を追加します。
  3. 生成する前に修正されたプロンプトを読みます。不要なものを削除し、キャラクター、製品、アクションが元のアイデアと一致していることを確認します。

ヒント: プロンプトの最適化は、やりたいことは決まっているが、それをどう説明すればいいか分からない時に便利です。結果は生成前の下書きとして扱ってください。

再作成: 別のバージョンを試す

結果は惜しいけれど、表情、構図、アクション、カメラの動きを修正したい時は 再作成 を使用します。白紙の状態からやり直すことなく、既存の生成物をベースに作り直すことができます。

再作成する前に、何を変えるべきか考えます:

  • 被写体や設定が違う: プロンプトの核心的な記述を修正します。
  • 構図を直したい: フレーミング、カメラ位置、被写体の配置を指定します。
  • 動きが多すぎる: アクションを減らすよう指示し、「控えめな」「ゆっくりとした」「安定した」といった言葉を使います。
  • 単に別のバリエーションが欲しい: 主要な設定はそのままに、もう一度生成します。

ヒント: 再作成は、すでに満足しているアイデアに小さな調整を加えるのに最適です。

参照として使用: 気に入った結果をベースにする

参照として使用 をクリックして、現在の画像や動画を新しい生成タスクに追加します。すでに確立したキャラクター、製品、設定、ビジュアルスタイル、または動きを次に引き継ぐために使用します。

一般的な用途は以下の通りです:

  • 同じキャラクターを異なる設定に配置する。
  • 同じ製品に対して複数の広告アセットを作成する。
  • 既存のカットや動きを使用して、後の動画をガイドする。
  • 1 つの成功した結果からシリーズを構築する。

ヒント: 参照は次の生成をガイドするものであり、単にオリジナルを複製するものではありません。プロンプトには、何を維持し、何を変えるべきかを記述する必要があります。例えば:「キャラクターの顔と服装は一定に保ち、背景を夜の通りに変えてください」などです。

画像のアップスケール: Topaz HD で詳細を復元する

被写体や構図には満足しているが、より高い解像度や細かいディテールが必要な場合に画像のアップスケールを使用します。Fish Creative は Topaz HD を使用して個々の画像をアップスケールし、細部を復元します。

ヒント: これは、最終画像をダウンロードする前、カバー画像を作成する前、または動画生成に進む前に役立ちます。キャラクターの解剖学的構造や製品の形状がすでに間違っている場合、通常アップスケールでは修正できません。先に画像を再作成するか、プロンプトを修正してください。

動画を生成: 気に入った画像をアニメーション化する

画像の下にある 動画を生成 ボタンをクリックすると、その結果がそのまま動画ツールに送られ、ダウンロードとアップロードの手間を省けます。

ヒント: 動画ツールに移動したら、プロンプトではアクション、カメラの動き、時間の経過に伴う変化に集中してください。静止画に関する長い説明を繰り返す必要はありません。例:「人物がわずかに頭を上げ、カメラがゆっくりと近づき、背景のライトが徐々に明るくなる」など。

リップシンクに使用: キャラクターに声を与える

画像と動画の両方の結果に対して リップシンクに使用 を選択できます。画像の場合、ツールはその画像と音声からトーク動画を作成します。動画の場合、既存の動きを活かしつつ、口の動きを音声と同期させます。

ヒント: 画像から直接リップシンクに進むのは、安定したトーク動画に適しています。動画から始めるのは、呼吸、頷き、または体の動きを入れたい場合に有効です。いずれの場合も、顔がはっきり見え、口が遮られていないことを確認してください。

動画の延長: 既存のクリップを続ける

クリップのアクション、カメラワーク、スタイルは気に入っているが、もっと長くしたい場合に 動画の延長 を使用します。延長することで、既存のシーンと動きを継続させることができます。

ヒント: 延長する前に最後のフレームを確認してください。キャラクターが歪んでいたり、動きが速すぎたり、被写体がフレームから外れそうになっていたりすると、継続部分で問題が発生する可能性があります。安定した鮮明なフレームで終わるクリップは、通常スムーズに延長できます。

アセットライブラリと履歴: 作品を見つけて再利用する

制作物はアセットライブラリと生成履歴に自動的に保存されます。そこから過去の画像、動画、音声を見つけて、新しいタスクに直接追加できます。

ヒント: 主要なバージョンをいくつか保存しておきましょう:元のリファレンス、最初の使用可能な結果、最終的な高品質出力、そしてリップシンクに使用する安定した動画などです。これにより、プロセス全体をやり直すことなく、特定の段階を修正しやすくなります。

公開共有とダウンロード: 最終結果を確認する

「ダウンロード」は結果をデバイスに保存し、編集、デザインへの使用、または公開ができるようにします。生成記録の公開共有は、作成したものを他の人が見られるようにします。そのオプションは、コンテンツを公開する準備ができた時にのみ使用してください。

ヒント: ダウンロードする前に、アスペクト比、解像度、キャラクターと製品の詳細、そしてリップシンクを確認してください。ポストプロダクションで動画にキャプションやブランディングを追加する必要があるかどうかも検討してください。

クレジットコストと残り生成数: 生成前に確認する

「生成」ボタンには、現在の設定での推定クレジットコストと、その設定で残高から何枚の画像や動画を生成できるかが表示されます。解像度、再生時間、出力数を変更する際は、送信前に見積もりがどのように変わるかを確認してください。

ヒント: これはテスト生成と最終出力を計画するのに役立ちます。初期の生成で構図と動きを固め、方向に満足してから最終的な設定を選択するようにしましょう。


Fish Creative で制作を始めよう

Fish Creative は、クリエイティブツールを 1 つのワークスペースにまとめます。このチュートリアルでは、画像生成、動画生成、リップシンクを使用して、1 つのプロンプトから Fish Audio の声で話すキャラクターを作成する方法を学びました。

最初のプロジェクトはシンプルで構いません:フレーミングの明確なキャラクター 1 人、少しの動き、そして 1〜2 文のセリフです。プロセスに慣れてきたら、参照画像、最初と最後のフレーム、動画リファレンス、あるいはより野心的なカメラワークに挑戦してみてください。

Fish Creative で自分の作品作りを始める →

よくある質問

テキストだけで画像や動画を生成できますか?
はい。「画像」ツールはテキストプロンプトを受け付け、「動画」ツールは Text-to-Video に対応しています。より細かく制御するために、画像、動画、または音声をリファレンスとして追加することも可能です。
静止画をリップシンクに使用できますか?
はい。リップシンクは画像と動画の両方に対応しています。完成した動画でより多くの体の動きが必要な場合は、まず画像を動画に変換してからリップシンクを適用できます。
すべてのモデルで設定は同じですか?
いいえ。対応している入力、アスペクト比、再生時間、解像度はモデルによって異なります。モデルを選択した後に表示されるオプションを確認してください。
生成された結果を手動で保存する必要がありますか?
結果は自動的にアセットライブラリに保存され、ツール間で再利用できます。デバイスにダウンロードすることも可能です。
Frank Lu

Frank Lu

Product, Operation & Data Engineer

Frank Luの他の記事を読む

自然で感情豊かな声を生み出す

今日から、最高品質の音声作成を始めましょう

すでにアカウントをお持ちですか? ログイン