
Adobeは3つのAI音声生成ツール—音楽、音声、効果音—をFireflyプラットフォーム全体でロール出し中であり、すべて商用利用が可能。
同社はGoogle Gemini Omni Flashモデルも統合し、このモデルは動画、音声、画像、テキストプロンプトに対応する。
これらの追加によりFireflyの創作機能はテキストと画像生成の範囲を超え、クリエイターは単一プラットフォーム内で完全なマルチメディアコンテンツを制作できる。
何が起きたか
Adobeは3つのAI音声ツール—Generate Music(動画用ロイヤリティフリー音楽)、Generate Speech(スクリプト→ナレーション変換)、Generate Sound Effects(シーン音声)—をFireflyプラットフォーム全体で公開し、すべて商用利用が可能。Firefly AI Assistantは無料の日次生成を提供開始し、AdobeはGoogle Gemini Omni Flashモデルを統合した。このモデルは動画、音声、画像、テキスト入力に対応し、Kling AI、Luma AI、Runwayなどの既存の第三者モデルと並行して利用できる。
なぜ重要か
音声ツールはFireflyの創作スイートをテキストと画像生成の範囲を超えて拡張し、クリエイターは単一プラットフォーム内でビデオサウンドトラックとナレーションを制作できるようになり、ライセンス上の懸念もない。Gemini Omni Flashの多モーダル入力(動画、音声、画像、テキスト)はFireflyが対応可能な創作タスクの幅を広げ、コンテンツプロデューサーのワークフロー効率化を実現する可能性がある。日本のコンテンツクリエイターがAdobe Fireflyで音声ナレーションや効果音を商用利用可能な形で単一プラットフォーム内で制作できるようになる可能性があります。
注目点
Adobeは「Create Storyboard」と「Create Brand Kit」がFireflyの最頻使用機能の一部であることを報告しており、統合型創作ツールへのニーズを示唆している。音声ツールの採用状況は、ユーザーが同様のペースでこれらの機能を導入するかを示す指標となる。
Firefly音声ツールによるAdobeの拡張は、同社の創作プラットフォームの空白に対応している。Fireflyはテキスト→画像生成と画像編集をサポートしていたが、ナレーションと音声設計は通常別のツールか外注が必要だった。Generate Speech、Generate Music、Generate Sound Effectsを既存機能と組み合わせることで、Adobeはビデオ制作ワークフローの統合を試みており、現在複数ベンダー間で切り替えるクリエイターにとって意味のある効率化につながる。
Gemini Omni Flash統合はこの戦略を補完する。単一モーダルモデルと異なり、Omni Flashは動画、音声、画像をテキストと共に取り込む能力があり、クリエイターは前処理なしに生素材や音声をFireflyに入力して、創作提案や編集を受け取れる。この多モーダル機能はKling AI、Luma AI、Runwayとの既存パートナーシップと共存し、AdobeはFireflyを複数の生成モデルのためのオーケストレーションレイヤーとして位置付けており、独自モデルへの全面依存ではないことを示唆している。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Apple Musicは年内に、「かなりの部分」をAIで制作した楽曲に「Made With AI」ラベルを追加する

Asicsは9月1日からAI搭載のクマ検知アプリ(AI-App クマ検知)の提供を開始すると発表した

ソフトウェアエンジニアが「By-Its-Cover」という推薦システムを開発した

DeepSeekが4月にリリースしたV4 Flashアルゴリズムに基づくマルチモーダルモデル「V4 Flash Vision Exp」を公開した
あるソフトウェアエンジニアがSchmaudioを開発した

研究者が広く使われているオープンソースの音声認識モデル11個をテストしたところ、最も高スコアのいくつかが、VoxPopuliとLibriSpeechベンチマークから不正確な文字起こしを再現していることが判明した
