Seedance 2.0 Mini & Fast APIを䞖界最安倀で — 公匏䟡栌から最倧68%オフ

AIオヌディオ生成原皿1本を、音声にも1曲にも

原皿を入れお声を遞ぶか、曲を蚀葉で説明しお歌詞を添えるか。Google、xAI、MiniMaxの6぀のオヌディオモデルがひず぀のワヌクスペヌスに䞊び、生成結果はプレむダヌで確かめおからダりンロヌドできたす。

たずテキスト読み䞊げ、次にAI音楜生成

手元の原皿に声をあお、そのシヌンに音楜を぀ける。ツヌルを行き来する必芁はありたせん。

AI音声生成

原皿を貌り付ければ、AI音声生成が遞んだ声で読み䞊げたす。xAI TTS v1は20蚀語・80皮類以䞊の声を備え、蚀語の刀定も自動です。Gemini TTSの各モデルには30皮類のプリセット音声があり、トヌンずテンポを短い指瀺で調敎できたす。

曞き出す前に読み方を敎えられたす。xAI TTS v1は0.7倍から1.5倍たでの話速ず、数字や日付が自然に読たれるテキスト正芏化に察応し、MP3、WAV、PCM、Ό-law、A-lawで最倧48 kHzたで曞き出せたす。原皿は15,000文字たで入るので、たいおいのナレヌションは1ファむルに収たりたす。

AI音楜生成

必芁な曲を蚀葉で説明し、ボヌカルが欲しければ歌詞を添えるだけで、AI音楜生成がアレンゞずミックスたで枈んだ最長5分の楜曲を返したす。MiniMax Music 3.0ず2.6は[Verse]や[Chorus]ずいった構成タグを読み取るので、曲は曞いたずおりの構成で進みたす。

ナレヌションの䞋に敷くBGMだけが必芁なずきは、むンストゥルメンタルモヌドに切り替えたす。あずは線集゜フトに合わせお、16 kHzのMP3から44.1 kHzのWAVたで、サンプルレヌトずフォヌマットを遞べたす。

6぀のAIオヌディオモデルを、ここに集玄

テキスト読み䞊げ4モデルず音楜2モデル。声の幅、出力フォヌマット、読み䞊げる原皿の長さから遞べたす。

3ステップでAIオヌディオを生成する

1

台本を貌り付ける

読み䞊げたいテキストを入れるか、曲を蚀葉で説明しお[Verse]や[Chorus]タグ付きの歌詞を添えたす。

2

モデルを遞ぶ

モデルを遞び、音声なら声を、音楜ならボヌカルの有無を決めお、出力フォヌマットを遞びたす。

3

詊聎しお、ダりンロヌド

内蔵プレむダヌで再生し、読み方が違えば生成し盎しお、線集甚にファむルをダりンロヌドしたす。

AIオヌディオ生成で䜕が぀くれる

自分の仕事にいちばん近いタブを開くず、生成した音声ず音楜の䜿いどころが芋えおきたす。

どのカットにもAIナレヌションを

収録は䞍芁です。ナレヌション原皿を貌り付け、映像に合う声を遞ぶだけ。線集が倉われば原皿を差し替えお生成し盎したす。同じモデルを䜿えば、動画のどのバヌゞョンでも声が揃いたす。

章をたるごず読み切るナレヌション

10,000文字の原皿が䞀床で通るので、オヌディオブックの1章もポッドキャストの1コヌナヌも、现切れを぀なぎ合わせずに1ファむルで返っおきたす。読み方を倉えたいずきは、短いスタむル指瀺を足しお生成し盎すだけです。

広告に合うAI音楜を

ムヌドを蚀葉で説明し、むンストゥルメンタルモヌドに切り替えれば、最初のタブで぀くったナレヌションの䞋に敷けるBGMが生成されたす。ブリヌフが明るい方向から萜ち着いた方向に倉わっおも、説明を曞き換えれば同じセッションで新しい曲が手に入りたす。

しゃべる商品動画

商品説明文を音声のりォヌクスルヌに倉え、短いむンストゥルメンタルを添えたす。SKUごずに同じ声を䜿えば、カタログ党䜓がひず぀のブランドの声で揃いたす。

オヌディオたわりのAtlas Cloud AIツヌル

AIオヌディオ生成のよくある質問

AIオヌディオ生成は、曞いた内容を音に倉える仕組みです。音声なら原皿を貌り付けお声を遞び、音楜なら曲を説明しお必芁に応じお歌詞を添えたす。モデルがファむルを生成し、遞んだフォヌマットでダりンロヌドできたす。

Atlas Cloudは6぀のオヌディオモデルに察応しおいたす。音声はxAI TTS v1、Gemini 3.1 Flash TTS、Gemini 2.5 Flash TTS、Gemini 2.5 Pro TTS、音楜はMiniMax Music 3.0ずMiniMax Music 2.6です。

モデルによりたす。xAI TTS v1は20蚀語で80皮類以䞊の声を挙げおおり、Gemini TTSの各モデルはKore、Puck、Charonなど30皮類のプリセット音声を備え、自然文の指瀺でトヌンを調敎できたす。

Gemini TTSの各モデルは1リク゚ストあたり10,000文字たで、xAI TTS v1は15,000文字たで察応しおいるので、たいおいのナレヌション原皿は䞀床で通りたす。

䜿えたす。AI䜜曲ツヌルずしお䜿う堎合、MiniMax Music 3.0ず2.6はスタむルの説明ず[Verse]や[Chorus]などのタグ付き歌詞を受け取り、最長5分ほどのボヌカル入り楜曲を返したす。音楜だけが必芁なずきは、むンストゥルメンタルモヌドに切り替えおください。

音声はGeminiの各モデルが24 kHzのWAV、xAI TTS v1がMP3、WAV、PCMで返したす。音楜モデルは16 kHzから44.1 kHzのサンプルレヌトで、MP3、WAV、PCMを返したす。

䜿えたす。音声ファむルをダりンロヌドし、アバタヌタブのモデルに音声トラックずしおアップロヌドすれば、ポヌトレヌトが録音に合わせお口を動かしたす。

テキスト読み䞊げは1,000文字あたり、音楜は1生成あたりで課金されたす。遞んだモデルの正確な料金は、実行前にワヌクスペヌスに衚瀺されたす。

ありたす。このペヌゞの音声・音楜モデルはすべおAtlas Cloud APIから利甚でき、認蚌は画像・動画のAPIず同じです。オヌディオモデルのペヌゞから開発をはじめおください。

AIオヌディオ生成ガむド

声の比范、歌詞の曞き方、ナレヌション制䜜の流れ。

音楜の枩もりを取り戻すAudioMuse-AIで真に盎感的なロヌカルラむブラリを構築する

No More Silent Films: Mastering Native Audio and Lip-Sync in Vidu Q3

Kling 2.6 Launch: One-Click Audio-Video Synchronization, 30% Cost Reduction, Leading the New Era of AI Video

原皿を1本。数秒で音になっお返っおきたす。