Lyria 3 は、Gemini API を通じて利用できる Google の音楽生成モデル ファミリーです。Lyria 3 を使用すると、テキスト プロンプトや画像から、高品質の 44.1 kHz ステレオ音声を生成できます。これらのモデルは、ボーカル、タイミングに合わせた歌詞、完全なインストゥルメンタル アレンジなど、構造的な一貫性を提供します。
Lyria 3 ファミリーには次の 2 つのモデルが含まれています。
| モデル | モデル ID | 最適な用途 | 所要時間 | 出力 |
|---|---|---|---|---|
| Lyria 3 Clip | lyria-3-clip-preview |
ショート クリップ、ループ、プレビュー | 30 秒 | MP3 |
| Lyria 3 Pro | lyria-3-pro-preview |
フルレングスの曲(バース、コーラス、ブリッジを含む) | 数分(プロンプトで制御可能) | MP3 |
どちらのモデルも新しい Interactions API を使用して利用できます。マルチモーダル入力(テキストと画像)をサポートし、44.1 kHz の高忠実度ステレオ音声を生成します。
音楽クリップを生成する
Lyria 3 Clip モデルは、常に 30 秒のクリップを生成します。クリップを生成するには、テキスト プロンプトを使用して interactions.create メソッドを呼び出します。レスポンスには、常に生成された歌詞と楽曲の構成が、steps スキーマの音声とともに含まれます。
Python
import