AIToday

毎朝1分で、AIの今日に追いつく。

無料ではじめる月間読者 30,000+

最終更新: 10時間前

今日のピック

三菱電機、汎用音分離AIを開発

何が起きたか:三菱電機と米国子会社Mitsubishi Electric Research Laboratoriesは、テキストによる指示で混合音声から指定した音を分離・抽出できる単一のAIモデルを開発した。複数話者の分離、音声強調、環境音の抽出などのタスクに対応する。

Top Companies AI10時間前
三菱電機、汎用音分離AIを開発

最新のAIニュース

それ以前

AWSとfalが創造的ワークフローで提携

AWSは、エージェント型AIワークスペース「Amazon Quick」が、Model Context Protocol(MCP)を通じてfalの生成メディアプラットフォームと連携する統合を発表した

Amazon AI Blog4日前

LeafnetとBBIX、音声AIサービスで提携

LeafnetとBBIXは2026年8月、音声とAIを組み合わせた新サービスの構築に向けた協業を開始した

Top Companies AI4日前

Deepgram、SageMaker AI可観測性拡張

Deepgramは、Amazon SageMaker AI上の音声認識・音声合成モデル向けに、課金と使用状況の透明性を高めるDeepgram Enhanced Metricsと、エンジン単位・GPU単位の可視化を実現する…

Amazon AI Blog4日前Top Companies AIも報道

NVIDIA MPSでASRのGPU需要を75%削減、AWSで実現

AWS、NVIDIA、Heidi Healthが、自動音声認識(ASR)推論のGPUインフラを75%削減するソリューションを公開

Amazon AI Blog4日前

Plaud、会話録音対応のAIイヤホン投入

PlaudがAIイヤホン「Plaud One Explorer Edition」を発表

The Verge AI4日前

Plaud、eSIMケース付きAIメモイヤホン発表

ユーザー数250万人超のPlaudが「Plaud One」を発表

TechCrunch AI4日前

Gemini 3.5 Transcribe、85言語対応

Googleが音声認識モデル「Gemini 3.5 Transcribe」を公開

THE DECODER4日前

スタートアップRelayが音声文字変換専用マイクを開発

Nothingの元従業員2人が設立したRelayが、高忠実度の音声文字変換向け専用マイクを発表します

WIRED AI4日前

NetflixがAIでワイルダー声を復元

Netflixが「Wonka's The Golden Ticket」の予告編を公開した

Top Companies AI5日前

Netflix、AIで故ジーン・ワイルダー声を再現

Netflixは『夢のチョコレート工場』を題材にした競技リアリティ番組を制作中で、主人公の声をAIで再現する

Top Companies AI5日前

Google、音声入力を磨くGemini 3.5 Transcribe発表

Googleは、言い間違いや「えーと」を編集して整ったテキストを出力するAIモデル「Gemini 3.5 Transcribe」を発表した

Ars Technica AI5日前

Particleがポッドキャスト検索エンジン「Radar」発表

元Twitterエンジニアらが創業したAIニュースリーダー企業Particleが、ポッドキャスト検索エンジン「Radar」を発表した

TechCrunch AI5日前

AMDとレコード3社、Stability AIへ出資

Stability AIは、ソニー・ミュージックグループ、ユニバーサル ミュージック グループ、ワーナー ミュージック グループ、AMDベンチャーズ、エレクトロニック・アーツなどから7,600万ドルを調達した

SiliconANGLE AI6日前

豪州、AI生成曲をチャートから除外

オーストラリアの音楽業界は来週から、完全にAIで生成されたトラックを公式チャートから除外する

Fortune AI6日前

AIホストがレストランの電話注文をAmazon Connectで対応

AWSが、レストランの電話受付を自動化する音声注文システムの構築手順を公開

Amazon AI Blog2026年8月24日

Apple Music、AI制作曲にラベル導入へ

Apple Musicは年内に、「かなりの部分」をAIで制作した楽曲に「Made With AI」ラベルを追加する

Top Companies AI2026年8月23日

AIオーディオストーリーをソフトウェアエンジニアが開発

あるソフトウェアエンジニアがSchmaudioを開発した

Hacker News2026年8月21日

高性能音声AI、ベンチマーク最適化の兆候

研究者が広く使われているオープンソースの音声認識モデル11個をテストしたところ、最も高スコアのいくつかが、VoxPopuliとLibriSpeechベンチマークから不正確な文字起こしを再現していることが判明した

Hugging Face Blog2026年8月21日

Appleがコードスイッチング音声認識を改善

Appleの研究者は、反復的疑似ラベル付けトレーニング手法を初めてマンダリン・英語コードスイッチングASR(自動音声認識)に適用した

Apple Machine Learning2026年8月21日

Adobe、AI音声ツールとGemini統合を発表

Adobeは3つのAI音声ツール—Generate Music(動画用ロイヤリティフリー音楽)、Generate Speech(スクリプト→ナレーション変換)、Generate Sound Effects(シーン音声)—…

THE DECODER2026年8月20日

Adobe、Fireflyに音声生成機能を追加 音楽・スピーチ・効果音を商用利用可

AdobeはFirefly(同社のAI創作ツール)に音声生成機能を一般向けに提供開始した

SiliconANGLE AI2026年8月20日

AI音声クローン、詐欺攻撃急増

詐欺師がAI音声クローンとディープフェイク技術を駆使して信頼できる連絡先になりすまし、個人情報を含むフィッシングメールを送信し、メール、電話、メッセージングプラットフォーム、ソーシャルメディアにわたって同時に組織的な攻撃…

Top Companies AI2026年8月19日

AI音声クローンが外交通信を脅かす

Redditのスレッドで、外交官や政府高官を狙ったAI音声クローン技術への懸念が浮上

r/artificial2026年8月18日

Wispr、音声テキスト化で2億8000万ドル調達・評価額20億ドル

音声をテキストに変換する「Flow」を開発するWispr AIが、Series Bで2億8000万ドルを調達し、評価額は20億ドルに達した

SiliconANGLE AI2026年8月17日

音声入力AIコーディング支援ツール VocalCode、オンデバイス認識で 4.99ドル買い切り

VocalCodeは、マイク入力を端末のCPUで処理し、エディタやターミナルなど主要デスクトップアプリに直接テキストを入力する音声ディクテーションツール

Hacker News2026年8月17日

Suno、MIDI対応で本格DAWに進化 Studio 2.0公開

Suno が Studio 2.0 をリリースし、MIDI対応、オートメーション、ビルトイン・エフェクト(ディストーション、ディレイ、リバーブ、コンプレッション、EQ)、チャットボット機能を追加しました

The Verge AI2026年8月13日

Twitch配信者、Amazon AI学習をオプトアウト

Twitchがセキュリティとプライバシー設定にトグルを追加し、配信者は自分のコンテンツ(ライブ配信、VOD、クリップ、チャット、チャンネルのテキストと画像)をAmazonの生成AI モデルの学習に使用させないようにできる…

The Verge AI2026年8月12日

音声リングStream、シリーズAで2300万ドル調達

プライベート音声リングStreamの開発企業Sandbarが、AdjacentとKindred VenturesがリードするシリーズAで2300万ドル を含む、合計3600万ドルの資金を調達した

TechCrunch AI2026年8月12日

Sandbar、音声リングで3600万ドル調達

音声対応リングStreamの開発企業Sandbarが、Adjacent とKindred Venturesが主導した2300万ドルのシリーズAを含め、合計3600万ドルを調達した

TechCrunch AI2026年8月12日

D'Addario、AI音楽使用を認める

ギター弦メーカーのD'Addarioは、新しい弦のプロモーション動画でSuno AIを使用してトラックを再生成したことを認めた

The Verge AI2026年8月12日

Saber、ChatGPTでライター置き換えを否定

元リードライターのStella Saccoが「Rideshare Stimulatorゲーム開発中盤でSaberに自分をChatGPTで置き換えられた」とBlueSkyに投稿したことを受け、CEO Matthew Kar…

The Verge AI2026年8月12日

Meetily、無料でミーティング記録 サブスク不要

Meetilyというアプリケーションが、オープンソースのAIモデルを使用してミーティングをリアルタイムで文字起こし・要約できるようになりました

WIRED AI2026年8月9日

ラッパーのFenix Flexin、AI使用を認める 「Rubberz」制作巡り

LAのラッパーFenix Flexinが、ヒット曲「Rubberz」の制作にAIを使用したことを認めました

The Verge AI2026年8月7日

AIを混乱させる音楽、新ジャンル化か

アーティストたちがAIの学習を妨げるため、意図的に奇妙で低品質な音楽を録音・公開する動きが出ています

Hacker News2026年8月7日

AIニュースを追う時間を、毎朝5分に。

200以上のソースから、その日の要点だけをEmail・LINE・Slackへ。ずっと無料です。

月間読者 30,000+
無料で始める

Sunoがスパム対策でウォーターマーク機能を導入へ

SunoがAI生成音楽の蔓延を抑制し透明性を高めるため、ウォーターマーク・フィンガープリント技術の導入と、ダウンロード規制の更新を発表した

The Verge AI2026年8月6日

Wispr、会議録音機能を追加、AI記録ツール競争に参入

音声入力スタートアップのWispr Flowが、Notetakerという新機能を発表した

WIRED AI2026年8月5日

スマートフォンがAI音声ガイド、地元の物語を自動再生

iOSとAndroidで利用可能なWrinklesは、位置情報データを活用して周辺の場所に関する音声ストーリーを自動表示する

TechCrunch AI2026年8月4日

Spotify、AI楽曲制作にMerlin参画 3万レーベル以上が対応へ

SpotifyがMerlinと提携し、同社ネットワークの30,000以上のレーベルをAIカバー・リミックス制作ツールに追加することを発表しました

TechCrunch AI2026年8月4日

AGIBOT、マルチモーダルAIが85.21%達成

AGIBOTのWITA-Omni Previewファウンデーションモデルが、Daily-Omniオーディオビジュアル推論ベンチマークで平均精度85.21%を達成し、Alibabaの Qwen3.5-Omni-Plus、G…

Robotics & Automation News2026年8月3日

Smallest.ai、音声AIで1300万ドル調達

2024年後半に設立されたSmallest.aiが、Seligman Venturesが主導するシリーズAで1300万ドルを調達した

TechCrunch AI2026年7月31日

Friend、音声機能付きで249ドルで再登場

AI音声ペンダントのスタートアップ Friend が、ユーザーと会話できるスピーカーを内蔵した製品を再発売し、価格を129ドルから249ドルに引き上げた

The Verge AI2026年7月30日

Fish Audio、AI音声開発で5200万ドル調達

元Nvidia研究員の廖世嘉が創業したAIスタートアップFish Audioが、Coreline VenturesとCapital Todayが主導するシードラウンドで5200万ドルを調達した

SiliconANGLE AI2026年7月30日

Google、楽曲部分編集AI「Lyria 3.5」公開

Googleが音楽生成モデル「Lyria 3.5」をリリースした

THE DECODER2026年7月29日

OpenAI、GPT Transcribeで0.7ポイント改善も競合に後塵

OpenAIがAPI経由で音声認識モデルGPT TranscribeとGPT Live Transcribeを公開した

THE DECODER2026年7月29日

OpenAIが音声文字変換モデル「GPT-Transcribe」を発表

OpenAIが音声文字変換モデル「GPT Transcribe」を発表した

Hacker News2026年7月29日

Fish Audio、5200万ドル調達

パロアルト拠点のFish Audioは、ユーザー数800万人超、年間経常収益2100万ドルを生み出している企業で、火曜日にCoreline VenturesとCapital Todayが主導するシードラウンドで5200万…

TechCrunch AI2026年7月28日

生成AI音声の無断使用に民事責任、法務省が認める

日本の法務省の専門家委員会が月曜日、生成AIを用いた著名人の音声の無断使用について、有名人が自らのアイデンティティの商業的価値を管理できる法的保護である肖像権に基づいて民事責任を問えると定めた答申案を承認した

Japan Times Tech2026年7月28日

新規ポッドキャストの30%以上がAI生成

ポッドキャスト検索データベースのListen Notesが、新たに作成されたポッドキャストの30%以上が人間制作ではなくAI生成音声で構成されていると報告した

Hacker News2026年7月28日

Deepgram、SageMaker向けAWS IAM一時委譲を統合

Deepgram は AWS IAM の新機能である一時委譲を、Amazon SageMaker AI 上で Deepgram の音声AI モデルを実行する顧客向けのサポートワークフローに統合しました

Amazon AI Blog2026年7月27日

元AWS科学者、音声AI企業を設立

Amazonの元Distinguished Scientistアレックス・スモーラ氏がBoson AIを設立し、競合他社の音声システムよりも大幅に低価格な音声間翻訳モデル「Higgs RealTime」をリリースする

Fortune AI2026年7月27日

ARIA、音声操作型3D SOCプラットフォーム始動

開発者がARIA(音声制御型セキュリティオペレーションコックピット)をリリースした

Hacker News2026年7月26日

OpenAI、ChatGPTに音声制御機能

OpenAIは木曜日にChatGPTデスクトップアプリをアップデートし、ChatGPT Voiceに対応させた

TechCrunch AI2026年7月24日

Claude音声モード、OpusとSonnetに拡大

Anthropicが音声モード対応を、それまでのHaikuに限定されていたOpusとSonnetモデルに拡張した

THE DECODER2026年7月24日

ChatGPT Voice、デスクトップで利用可能に

OpenAIがデスクトップおよびノートパソコン向けにChatGPT Voiceをリリースした

Fortune AI2026年7月23日

Skipper、オフラインAIアシスタント

Skipperはインターネット接続なしで動作するAIコンパニオン

Hacker News2026年7月23日

Claude、音声モード拡大 OpusとSonnetに対応

AnthropicがClaudeの音声モード機能をOpusとSonnetモデルに拡大し、Gmail、Slack、Canvaなどのアプリにも対応させました

The Verge AI2026年7月23日

Claude音声モード、3モデル対応で複数サービス連携

Anthropicが音声モードをアップデートし、ユーザーがOpus、Sonnet、Haikuから選択できるようにしました

TechCrunch AI2026年7月23日

Black Forest Labs、音声付き動画生成Flux 3公開

ドイツのAI企業Black Forest Labs(BFL)が、画像・動画・音声を統合学習するマルチモーダル基盤モデル「Flux 3」を発表しました

THE DECODER2026年7月23日

コマツが保守向け音声AI実証試験を開始

SORABITOとEleventh Labsは、「アームの動きが鈍い」といった口頭での説明から設備の故障を診断する対話型音声AIシステムを開発した

Top Companies AI2026年7月22日

Deezer、AI楽曲が日次アップロードの50%超に

音楽ストリーミングプラットフォームの Deezer は、AI生成音楽が同サービスの日次アップロードの50%以上を占めるようになったと発表した

TechCrunch AI2026年7月21日

Sony、Udioを3万曲以上の著作権侵害で提訴

Sony Music Entertainment は月曜日、AI音楽生成ツール Udio を相手に、Beyoncé、Britney Spears、Elvis Presley、Harry Styles ら著作の3万曲以上の…

The Verge AI2026年7月21日

Sunoで作った曲がようやくまともに聞こえる理由

アーティスト1010Benjaは最新EPで「Semiramis' Dream」という楽曲をSunoの生成AIを使って制作したが、従来の使い方とは異なり、歌詞を自分で書き、自らボーカルを録音し、プロデューサーとビート制作で…

The Verge AI2026年7月19日

Suno、数百万曲をスクレイピング学習

AI音楽生成ツールのSunoがYouTube Music、Deezer、Genius、Pond5、Jamendo、Freesound、International Music Score Library Project(I…

The Verge AI2026年7月15日

Suno、YouTubeから音声データ無断取得 ハッカーが暴露

AI音楽生成サービスのSunoが2025年11月にハッキング被害を受けました

TechCrunch AI2026年7月15日

Telnyx、AI音声エージェントで見積もり即座生成

Telnyx は、Telnyx Call Control と Llama 3.3 70B AI を使用したオープンソース Python アプリケーション(102行)をリリースした

Hacker News2026年7月15日

ScienceSoft、AWSで HIPAA準拠のAI音声予約システム構築

AWS Partner の ScienceSoft が、Amazon Nova Sonic と Amazon Bedrock Guardrails を活用し、HIPAA準拠のAI音声予約アシスタントを構築しました

Amazon AI Blog2026年7月14日

AppleがSiriをiPhoneアシスタントに拡張

AppleがiOS 27をパブリックベータとしてリリースし、刷新された「Siri AI」をiPhoneユーザーに初めて提供した

WIRED AI2026年7月14日

音声AI企業Gradium、Nvidia参加で資金調達1億ドル

パリ拠点の音声AIスタートアップGradiumが、Nvidiaを含む新たな投資家を加えてシード資金調達を再開し、総額$100 million(約160億円)を調達しました

TechCrunch AI2026年7月9日

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

月間読者 30,000+

無料で始める

登録無料・30秒で完了・いつでも解除できます