Gemini Audio AI オーディオ生成

AI オーディオ

Gemini Audio は音楽、音声合成(TTS)、短い効果音に使う AI 音声生成モデルです。曲を説明するか、原稿を貼って声を出すか、一つの出来事を効果音にします。長さと声は生成前に決めます。

Gemini Audio で音声を生成する方法

音楽、音声、効果音のどれかを選ぶ

それらは Gemini Audio 配下の別エントリであり、同じもののモードではありません。本当にやりたい仕事を選ぶと、そのエントリが受け付ける欄が出ます。

何のためかを書く

音楽ならジャンル、テンポ、気分。音声なら原稿を貼る。効果音なら一つの出来事と、それが起きる部屋を書く。

長さを決めてから生成

長さと声は実行前に選ぶ。近いテイクなら文言を変えて再実行し、新しい説明から始めない。

Gemini Audio の用途

説明から AI 音楽

ジャンル、テンポ、気分が楽器リストより効きます。曲が何のためかを書く。Gemini Audio の一部のエントリは歌詞を書いてくれます。言葉が具体である必要があるときはカスタムです。

音声合成と声

原稿を貼って声を選ぶ。それが TTS で、書いた文字を読みます。声の複製のエントリがあるときは、短いサンプルを写すのであって、新しい話者を作るのではありません。

効果音

効果音は短い単発の音であり、曲ではありません。音源と空間を書き、一件につき一つの出来事にします。

Gemini Audio についてよくある質問

Gemini Audio とは何ですか?

Gemini Audio は AI 音声モデルです。名前付きエントリによって、説明から曲を書く、原稿を音声(TTS)として読む、短い効果音を出す、のいずれかです。

Gemini Audio は音楽と音声の両方を出せますか?

名前付きエントリ次第であり、ベンダー名だけでは決まりません。曲を書くもの、原稿を読むもの、短い音を出すものがあります。やりたい仕事を選ぶ。

歌詞は自分で書かないといけませんか?

カスタムまたは歌詞のエントリを選んだときだけです。インスピレーション系の音楽エントリは気分とジャンルから言葉を書きます。言葉が具体である必要があるときにカスタムを使う。

音楽と効果音の違いは何ですか?

音楽は構造のある一曲です。効果音は一つの短い出来事です。ノック、ヒューッ、部屋の気配。効果音のエントリに曲を求めない。

Suno

MiniMax Audio

Vidu Audio

Kling Audio