
先に書いて録音、配役はあと
音声主導のクリエイターは、誰もカメラの前に立つ前に読み上げを仕上げます。上の階でプレゼンターを生成し、両方のファイルをリップシンクAIに渡して、読み上げに顔を選ばせます。
よくある実行例
- 生成したホストに仮読みを合わせる
- 同じ音声で配役を2パターン試す
- エントリーティアで粗く、上位ティアで本番
- 1つの残高で毎週繰り返す
映像と声が同じワークスペースにあるからこそ成り立つ3つの仕事。
司会役、イラストの代役、マスコットが、まったく同じ読み上げを共有できます。隣で顔を生成し、その音声をキャラクターごとに1回ずつリップシンクAIにかければ ー 話し方はそのまま、配役だけが変わります。
ボイスメモや仮録りのボーカルは、多くの人が持っている映像の数を上回ります。リップシンクAIは、その場にいなかった演者にその音声を貼り付けるので、音声だけの素材が動画として出荷されます。
台詞が1つ間違っていれば、通常はセットの照明を組み直すことになります。修正した台詞を録音し、既存のショットをリップシンクAIにかければ、修正はレッスンにすでに合っていた映像の中に収まります。
入力は2つのファイルです ー 顔が映ったクリップと、音声トラック。エンジンはそのトラックから口が形作るべき音を読み取り、新しいタイミングに合わせて話者の顎と口元だけを再レンダリングします ー 衣装、照明、カメラの動きは撮影時のまま残ります。この狭い範囲だけを書き換えるからこそ、リップシンクAIの出力は元の映像とつなげてもカットとして成立します。出力は720p。音声はLipsync 1.0で15秒、それ以上のティアでは2分が上限です。

ファイルがどこから来るか、どのティアで実行するか、タイミングはどう解決されるか。

カメラのファイルをアップロードするか、動画スタジオで作ったばかりのクリップをそのまま送るか ー 書き出しも、再アップロードも、別のサブスクリプションも不要です。リップシンクAIは、生成された演者と実写の演者を同じように扱います。
自分の映像素材
カメラのファイルとスマホのクリップ
あるいは隣で作ったクリップ
スタジオの出力がそのままリップシンクAIに入ります
一貫して1つの残高
生成も同期も、同じプールから
リップシンクAIのコントロールと出力仕様 ー 方針でも約束でもありません。
クリップとトラック、それだけです
1.0、2.0、3.0が1つのパネルと残高の上に
選んだティアに応じて音声の上限が上がります
2つが食い違う箇所で何が起きるかを決められます
どのリップシンクAIの実行も、確定前に見積もりが出ます
どのテイクも、その裏にあるティアを記録しています
顔より先に声が存在する6つの現場。

音声主導のクリエイターは、誰もカメラの前に立つ前に読み上げを仕上げます。上の階でプレゼンターを生成し、両方のファイルをリップシンクAIに渡して、読み上げに顔を選ばせます。

コーチたちは、1行だけ古くなった何時間分もの使える映像を抱えています。その一文を録音し直し、そのショットをリップシンクAIにかければ、修正箇所は周囲のモジュールにそのまま馴染みます。

キャラクターチャンネルは、誰も収録していない日にもペルソナを喋らせる必要があります。アバターは一度作り、新しい音声を与え続ければ、リップシンクAIが口の動きを本物らしく保ちます。

映像はすでに承認済みで、変わるのは言語だけです。翻訳した読み上げごとに同じショットを実行すれば、各市場でそのトラックに合った口の動きが手に入ります。

エピソードは、誰も動画のことを考えるより何時間も前に音声として存在しています。セグメントを切り出し、顔を与えれば、クリップ配信チャンネルにカメラは要らなくなります。

台本を書いて読むのは得意でも、カメラの前になると固まってしまう人は少なくありません。デスクで声だけ録音し、プレゼンターに渡せば、アップデートはリハーサル済みの状態で仕上がります。
リップシンクAIパネルで実際に触る内容を、順番に。
顔が映った動画を添付し、次にそれが話すべき音声を添付します。プロンプトは任意のままです。
音声の長さに必要なリップシンクAIのティアを選び、継ぎ目の処理方法を決めます。ボタンの価格が更新されます。
生成してトラックに対する口の動きを確認し、通ったものを上位ティアでリップシンクAIに再実行します。
初めて実行する前に知っておきたい仕組み、ティア、コスト、同意について。
書き換わるのは、トラッキングされた話者の顎と口だけです。背景、衣装、カメラの動きはそのまま残ります ー だからこそ、出力を元の映像とつなげてもカットとして成立します。
できます ー それこそが、単独サービスではなくワークスペースの中でリップシンクAIを動かす意味です。スタジオの出力はそのまま乗り入れます ー 書き出しも、再アップロードも、別の残高も不要です。
エディタは、既存の口の動きにおおよそ合うまで波形をずらすだけです。どんなタイムラインを使っても、撮影された口が一度も形作ったことのない音を作ることはできません ー 台詞を書き換えるということは、撮り直しを意味します。
読み取れる口が映っていないフレームが弱点です ー 強い横顔のアングル、顔にかかった手、モーションブラーは一致度を下げます。顔を正面に向けたままにしてください。
Lipsync 1.0はエントリーの入り口で、音声は15秒まで対応します。Lipsync 2.0と3.0は有料プラン上にあり、2分まで対応し、ほかのシンクモードも解放します。
音声の長さとティアで数字が決まり、クレジットが残高から引かれる前に実行ボタンに表示されます。登録時に付与される10クレジットは、5秒までのエントリーティアのテイク1回分をカバーし、30日間有効です。
商用条件はご自身のプランに従うので、キャンペーンを出す前に料金ページを確認してください。それとは別に、顔の持ち主の同意が必要です ー ご自身が権利を持ち、話者が声の差し替えに同意した映像だけをアップロードしてください。
サインイン済みのアカウント、顔が映ったクリップ、音声ファイルです。生成はサインイン後に始まり、未完了のジョブは下書きとして待機します。台本は不要です。

そのクリップを作ったスタジオの隣にあるリップシンクAI
パネルに動画と音声ファイルを渡すだけ ー それ以外は不要です。リップシンクAIは音声トラックに合わせて口元を再構築し、3つのティアが15秒から2分までの音声をカバー。どの実行も、ほかの生成ツールと同じ残高から差し引かれます。
0 / 5000