アドビが先月末に公開した生成型人工知能(AI)搭載の音楽生成ツール「Generate Soundtrack」。/アドビ提供

アドビは人工知能(AI)による画像・動画生成ツール「ファイアフライ」に、音楽と音声、サウンド(効果音)を作成できるオーディオ機能を正式リリースしたと21日明らかにした。

今回追加された機能は音楽生成、音声生成、サウンド効果生成の計3種類だ。アドビ関係者は「今回のオーディオ機能のリリースを通じて、ファイアフライのコンテンツ生成AIの能力を一段と強化した」と述べた。

音楽生成機能はファイアフライ・ミュージックモデルを基盤に、映像の長さと雰囲気に合わせてオリジナル音楽を作り出す。音声生成はファイアフライ・スピーチモデルを基盤に、自然言語で入力した文章を自然な音声に変換する。声質、話す速度、感情などを精緻に調整できる点が特徴だ。音声AI専門スタートアップのイレブンラボの機能も利用できる。

サウンド効果生成は、コンテンツの動作やテイストに合うカスタム効果音を生成する。

アドビはファイアフライで生成したオーディオを商用利用できるよう設計した。映像から音声までアドビ・ファイアフライで一括してコンテンツを制作し、完成した作品に直ちに適用できるようになった。

アドビはファイアフライと連動する外部AIモデルの選択肢も拡充した。今回はグーグルの「Gemini Omni Flash」を新たに追加した。これにより、グーグル、Kling AI、Luma AI、OpenAI、Runwayに続き、Gemini Omni Flashも利用できる。

※ 本記事はAIで翻訳されています。ご意見はこちらのフォームから送信してください。