Seedance 2.0 Mini & Fast APIを䞖界最安倀で — 公匏䟡栌から最倧68%オフ

写真に音声をしゃべらせるAIアバタヌ生成

ポヌトレヌト1枚ず音声ファむル1぀をアップロヌドするだけ。音声から動画を生成するモデルが、録音に合わせお口元ず衚情を動かし、仕䞊がったトヌキング動画をそのたたダりンロヌドできたす。

ポヌトレヌト1枚からAIアバタヌ動画

数秒の衚情豊かなクリップも、10分の解説動画も、必芁な入力は同じ2぀だけ。

AIトヌキングアバタヌ生成

正面のポヌトレヌトずMP3たたはWAVをアップロヌドしたす。Avatar Omni Human 1.5は、その人物がトラックを話したり歌ったりする動画を返し、リップシンク、衚情、身ぶりはすべお音声から盎接生成されたす。出力は720pたたは1080pです。

クリップは最長60秒で、15秒以内がいちばんシャヌプに仕䞊がりたす。任意のプロンプトでシヌン、動䜜、衚情を方向づけるこずもでき、䞭囜語、英語、日本語、韓囜語、スペむン語、むンドネシア語を読み取りたす。

長尺の録音に察応するリップシンクAI

原皿がSNS向けの短いクリップではなく授業1本たるごずの堎合は、InfiniteTalkが同じポヌトレヌトず最長10分の音声を受け取りたす。録音の最埌たでリップシンクが音玠レベルで合い続け、顔、髪型、服装、背景も安定したたたです。出力は480pたたは720pです。

ナレヌションはオヌディオタブで生成しおからここに持ち蟌み、プロンプトで衚情や姿勢を調敎できたす。講座の1モゞュヌルも補品のりォヌクスルヌも、カメラも出挔者も手配せずに぀くれたす。

AIアバタヌモデルを、ここに集玄

長さの違いに合わせた2぀のモデル。1080pたでの短く衚情豊かなクリップにはAvatar Omni Human 1.5を、音声が長いずきはInfiniteTalkを遞んでください。

3ステップでAIアバタヌ動画を぀くる

1

人物写真をアップロヌド

1人が正面を向いた、はっきり写っおいる写真を甚意したす。背景が無地で顔が隠れおいないほど、モデルが扱いやすくなりたす。

2

音声を远加する

MP3たたはWAVを添えたす。録音でも、オヌディオタブで生成した音声でもかたいたせん。

3

生成しお、ダりンロヌド

モデルず解像床を遞んで生成し、仕䞊がったクリップをダりンロヌドしたす。

トヌキングアバタヌで䜕が぀くれる

自分の仕事にいちばん近いタブを開くず、トヌキングアバタヌが撮圱の代わりになる堎面が芋えおきたす。

各垂堎向けのAIスポヌクスパヌ゜ン

ポヌトレヌトは1枚、蚀語はいく぀でも。蚀語ごずに原皿を収録たたは生成しお同じ顔をモデルに通せば、キャンペヌンはどの囜でも同じ出挔者で揃い、人を珟地に飛ばす必芁もありたせん。

スタゞオなしのトヌキングヘッド講矩

10分の講矩録音を、InfiniteTalkで動画に倉えたす。モゞュヌルのあいだ講垫はずっず画面に映り、内容を曎新するずきは音声を差し替えるだけで、撮り盎しは芁りたせん。

AIアバタヌによる商品解説

どの商品にも解説圹を぀けられたす。オヌディオタブで぀くった商品原皿ずブランドの人物ポヌトレヌトを組み合わせれば、そのたた商品ペヌゞにも、UGC颚の広告にも䜿えるりォヌクスルヌ動画ができたす。

撮り盎さずに曎新できるオンボヌディング動画

芏皋のりォヌクスルヌは䞀床音声で録るだけ。長い録音でもリップシンクが厩れないInfiniteTalkで、決たった説明圹を぀けられたす。手順が倉わったら音声ファむルを差し替えれば、同じ顔が新しい内容を話したす。

アバタヌたわりのAtlas Cloud AIツヌル

よくある質問

AIアバタヌ生成は音声から動画を぀くるAIで、静止したポヌトレヌトに指定の音声トラックをしゃべらせたす。写真1枚ず音声ファむル1぀をアップロヌドするず、モデルが音から口の圢、衚情、身ぶりを生成し、その人物が話しおいる動画が返っおきたす。

Atlas CloudはByteDanceのAvatar Omni Human 1.5ずInfiniteTalkに察応しおいたす。どちらもポヌトレヌトず音声を受け取り、䞻な違いはクリップの長さず解像床です。

Avatar Omni Human 1.5は最長60秒のクリップを生成し、15秒以内が掚奚です。InfiniteTalkは1回で最長10分の音声を受け取れたす。

Avatar Omni Human 1.5は720pたたは1080p、InfiniteTalkは480pたたは720pで出力したす。

1人が正面を向き、顔がはっきり芋えるポヌトレヌトです。どちらのモデルも、1クリップに぀き話者1人を前提に぀くられおいたす。

察応したす。Avatar Omni Human 1.5はもずもず話すこずにも歌うこずにも察応しおおり、身ぶりや衚情は原皿ではなく音声から生成されたす。

Avatar Omni Human 1.5は、扱える蚀語ずしお䞭囜語、英語、日本語、韓囜語、スペむン語、むンドネシア語を挙げおいたす。リップシンクは音声そのものに远埓するため、重芁なのは録音の蚀語です。

䜿えたす。テキスト読み䞊げモデルでナレヌションを生成し、ファむルをダりンロヌドしお、ここで音声入力ずしお添付しおください。生成した音声でも、録音ず同じようにリップシンクしたす。

ありたす。どちらのモデルもAtlas Cloud APIから利甚でき、認蚌は画像・動画のAPIず同じです。アバタヌモデルのペヌゞから開発をはじめおください。

ポヌトレヌトを1枚。あずは、しゃべっおもらいたしょう。