何が起きたか:三菱電機と米国子会社Mitsubishi Electric Research Laboratoriesは、テキストによる指示で混合音声から指定した音を分離・抽出できる単一のAIモデルを開発した。複数話者の分離、音声強調、環境音の抽出などのタスクに対応する。


EDMプロデューサーのMax "H4RRIS" Harrisと、イタリアのターンテーブリストからプロデューサーに転身したNihil Youngが、EDMシーンにおけるAI生成音楽を公然と批判している

Beatportは、全体または大部分をAIで制作されたトラックを禁止した

消防庁は2027年度に119番通報のAI活用に関するモデル事業を始める計画だ
AWSは、エージェント型AIワークスペース「Amazon Quick」が、Model Context Protocol(MCP)を通じてfalの生成メディアプラットフォームと連携する統合を発表した

LeafnetとBBIXは2026年8月、音声とAIを組み合わせた新サービスの構築に向けた協業を開始した

Deepgramは、Amazon SageMaker AI上の音声認識・音声合成モデル向けに、課金と使用状況の透明性を高めるDeepgram Enhanced Metricsと、エンジン単位・GPU単位の可視化を実現する…

AWS、NVIDIA、Heidi Healthが、自動音声認識(ASR)推論のGPUインフラを75%削減するソリューションを公開

PlaudがAIイヤホン「Plaud One Explorer Edition」を発表

ユーザー数250万人超のPlaudが「Plaud One」を発表

Googleが音声認識モデル「Gemini 3.5 Transcribe」を公開

Nothingの元従業員2人が設立したRelayが、高忠実度の音声文字変換向け専用マイクを発表します

Netflixが「Wonka's The Golden Ticket」の予告編を公開した

Netflixは『夢のチョコレート工場』を題材にした競技リアリティ番組を制作中で、主人公の声をAIで再現する

Googleは、言い間違いや「えーと」を編集して整ったテキストを出力するAIモデル「Gemini 3.5 Transcribe」を発表した

元Twitterエンジニアらが創業したAIニュースリーダー企業Particleが、ポッドキャスト検索エンジン「Radar」を発表した

Stability AIは、ソニー・ミュージックグループ、ユニバーサル ミュージック グループ、ワーナー ミュージック グループ、AMDベンチャーズ、エレクトロニック・アーツなどから7,600万ドルを調達した
オーストラリアの音楽業界は来週から、完全にAIで生成されたトラックを公式チャートから除外する

AWSが、レストランの電話受付を自動化する音声注文システムの構築手順を公開

Apple Musicは年内に、「かなりの部分」をAIで制作した楽曲に「Made With AI」ラベルを追加する

あるソフトウェアエンジニアがSchmaudioを開発した

研究者が広く使われているオープンソースの音声認識モデル11個をテストしたところ、最も高スコアのいくつかが、VoxPopuliとLibriSpeechベンチマークから不正確な文字起こしを再現していることが判明した

Appleの研究者は、反復的疑似ラベル付けトレーニング手法を初めてマンダリン・英語コードスイッチングASR(自動音声認識)に適用した

Adobeは3つのAI音声ツール—Generate Music(動画用ロイヤリティフリー音楽)、Generate Speech(スクリプト→ナレーション変換)、Generate Sound Effects(シーン音声)—…

AdobeはFirefly(同社のAI創作ツール)に音声生成機能を一般向けに提供開始した
詐欺師がAI音声クローンとディープフェイク技術を駆使して信頼できる連絡先になりすまし、個人情報を含むフィッシングメールを送信し、メール、電話、メッセージングプラットフォーム、ソーシャルメディアにわたって同時に組織的な攻撃…

Redditのスレッドで、外交官や政府高官を狙ったAI音声クローン技術への懸念が浮上

音声をテキストに変換する「Flow」を開発するWispr AIが、Series Bで2億8000万ドルを調達し、評価額は20億ドルに達した
VocalCodeは、マイク入力を端末のCPUで処理し、エディタやターミナルなど主要デスクトップアプリに直接テキストを入力する音声ディクテーションツール

Suno が Studio 2.0 をリリースし、MIDI対応、オートメーション、ビルトイン・エフェクト(ディストーション、ディレイ、リバーブ、コンプレッション、EQ)、チャットボット機能を追加しました

Twitchがセキュリティとプライバシー設定にトグルを追加し、配信者は自分のコンテンツ(ライブ配信、VOD、クリップ、チャット、チャンネルのテキストと画像)をAmazonの生成AI モデルの学習に使用させないようにできる…

プライベート音声リングStreamの開発企業Sandbarが、AdjacentとKindred VenturesがリードするシリーズAで2300万ドル を含む、合計3600万ドルの資金を調達した

音声対応リングStreamの開発企業Sandbarが、Adjacent とKindred Venturesが主導した2300万ドルのシリーズAを含め、合計3600万ドルを調達した

ギター弦メーカーのD'Addarioは、新しい弦のプロモーション動画でSuno AIを使用してトラックを再生成したことを認めた

元リードライターのStella Saccoが「Rideshare Stimulatorゲーム開発中盤でSaberに自分をChatGPTで置き換えられた」とBlueSkyに投稿したことを受け、CEO Matthew Kar…

Meetilyというアプリケーションが、オープンソースのAIモデルを使用してミーティングをリアルタイムで文字起こし・要約できるようになりました

LAのラッパーFenix Flexinが、ヒット曲「Rubberz」の制作にAIを使用したことを認めました

アーティストたちがAIの学習を妨げるため、意図的に奇妙で低品質な音楽を録音・公開する動きが出ています

AIニュースを追う時間を、毎朝5分に。
200以上のソースから、その日の要点だけをEmail・LINE・Slackへ。ずっと無料です。
月間読者 30,000+SunoがAI生成音楽の蔓延を抑制し透明性を高めるため、ウォーターマーク・フィンガープリント技術の導入と、ダウンロード規制の更新を発表した

音声入力スタートアップのWispr Flowが、Notetakerという新機能を発表した

iOSとAndroidで利用可能なWrinklesは、位置情報データを活用して周辺の場所に関する音声ストーリーを自動表示する

SpotifyがMerlinと提携し、同社ネットワークの30,000以上のレーベルをAIカバー・リミックス制作ツールに追加することを発表しました

AGIBOTのWITA-Omni Previewファウンデーションモデルが、Daily-Omniオーディオビジュアル推論ベンチマークで平均精度85.21%を達成し、Alibabaの Qwen3.5-Omni-Plus、G…

2024年後半に設立されたSmallest.aiが、Seligman Venturesが主導するシリーズAで1300万ドルを調達した

AI音声ペンダントのスタートアップ Friend が、ユーザーと会話できるスピーカーを内蔵した製品を再発売し、価格を129ドルから249ドルに引き上げた

元Nvidia研究員の廖世嘉が創業したAIスタートアップFish Audioが、Coreline VenturesとCapital Todayが主導するシードラウンドで5200万ドルを調達した
Googleが音楽生成モデル「Lyria 3.5」をリリースした

OpenAIがAPI経由で音声認識モデルGPT TranscribeとGPT Live Transcribeを公開した

OpenAIが音声文字変換モデル「GPT Transcribe」を発表した

パロアルト拠点のFish Audioは、ユーザー数800万人超、年間経常収益2100万ドルを生み出している企業で、火曜日にCoreline VenturesとCapital Todayが主導するシードラウンドで5200万…

日本の法務省の専門家委員会が月曜日、生成AIを用いた著名人の音声の無断使用について、有名人が自らのアイデンティティの商業的価値を管理できる法的保護である肖像権に基づいて民事責任を問えると定めた答申案を承認した

ポッドキャスト検索データベースのListen Notesが、新たに作成されたポッドキャストの30%以上が人間制作ではなくAI生成音声で構成されていると報告した

Deepgram は AWS IAM の新機能である一時委譲を、Amazon SageMaker AI 上で Deepgram の音声AI モデルを実行する顧客向けのサポートワークフローに統合しました

Amazonの元Distinguished Scientistアレックス・スモーラ氏がBoson AIを設立し、競合他社の音声システムよりも大幅に低価格な音声間翻訳モデル「Higgs RealTime」をリリースする

開発者がARIA(音声制御型セキュリティオペレーションコックピット)をリリースした

OpenAIは木曜日にChatGPTデスクトップアプリをアップデートし、ChatGPT Voiceに対応させた

Anthropicが音声モード対応を、それまでのHaikuに限定されていたOpusとSonnetモデルに拡張した

OpenAIがデスクトップおよびノートパソコン向けにChatGPT Voiceをリリースした

Skipperはインターネット接続なしで動作するAIコンパニオン

AnthropicがClaudeの音声モード機能をOpusとSonnetモデルに拡大し、Gmail、Slack、Canvaなどのアプリにも対応させました

Anthropicが音声モードをアップデートし、ユーザーがOpus、Sonnet、Haikuから選択できるようにしました

ドイツのAI企業Black Forest Labs(BFL)が、画像・動画・音声を統合学習するマルチモーダル基盤モデル「Flux 3」を発表しました

SORABITOとEleventh Labsは、「アームの動きが鈍い」といった口頭での説明から設備の故障を診断する対話型音声AIシステムを開発した

音楽ストリーミングプラットフォームの Deezer は、AI生成音楽が同サービスの日次アップロードの50%以上を占めるようになったと発表した

Sony Music Entertainment は月曜日、AI音楽生成ツール Udio を相手に、Beyoncé、Britney Spears、Elvis Presley、Harry Styles ら著作の3万曲以上の…

アーティスト1010Benjaは最新EPで「Semiramis' Dream」という楽曲をSunoの生成AIを使って制作したが、従来の使い方とは異なり、歌詞を自分で書き、自らボーカルを録音し、プロデューサーとビート制作で…

AI音楽生成ツールのSunoがYouTube Music、Deezer、Genius、Pond5、Jamendo、Freesound、International Music Score Library Project(I…

AI音楽生成サービスのSunoが2025年11月にハッキング被害を受けました

Telnyx は、Telnyx Call Control と Llama 3.3 70B AI を使用したオープンソース Python アプリケーション(102行)をリリースした

AWS Partner の ScienceSoft が、Amazon Nova Sonic と Amazon Bedrock Guardrails を活用し、HIPAA準拠のAI音声予約アシスタントを構築しました

AppleがiOS 27をパブリックベータとしてリリースし、刷新された「Siri AI」をiPhoneユーザーに初めて提供した

パリ拠点の音声AIスタートアップGradiumが、Nvidiaを含む新たな投資家を加えてシード資金調達を再開し、総額$100 million(約160億円)を調達しました

200以上のソースから厳選したAIニュースを毎日無料でお届けします。
月間読者 30,000+
無料で始める登録無料・30秒で完了・いつでも解除できます