AIToday

毎朝1分で、AIの今日に追いつく。

無料ではじめる月間読者 30,000+

最新のAIニュース

それ以前

OpenAI、ChatGPTの音声モード刷新 会話中の割り込み減らす

OpenAIが新型音声モデル「GPT-Live-1」を発表しました

The Verge AI2026年7月8日

OpenAI、全二重音声モデルGPT-Live発表 割込対応・長時間対話に対応

OpenAIが新たな会話型音声モデルGPT-Live-1とGPT-Live-1 miniを発表しました

TechCrunch AI2026年7月8日

Cohere、アラビア語音声認識モデル公開 方言や混合言語に対応

Cohereが「Cohere Transcribe Arabic」という20億パラメータのオープンソース音声認識モデルを公開しました

THE DECODER2026年7月7日

屋根修理大手Vertex、Revin AI音声エージェント導入で顧客対応を自動化

屋根修理・外装サービスの大手Vertex Service Partnersが、AI音声・SMS対応プラットフォーム「Revin」を全国27の地域ブランドで導入しました

Top Companies AI2026年7月1日

Hugging Face・Cerebras、リアルタイム音声AI デモ公開

Hugging FaceとCerebasが、音声認識・言語モデル・音声合成を組み合わせたリアルタイム音声対話システムのデモを発表しました

Hugging Face Blog2026年7月1日

Netflix、ジーン・ワイルダーのAI音声で「ウィリー・ウォンカ」実写競技番組を制作

Netflixが「Wonka's The Golden Ticket」という実写競技番組を制作し、ナレーションにAI音声生成企業ElevenLabsと協力してジーン・ワイルダーのAI生成音声を使用しています

The Verge AI2026年6月30日

Jamendo、生成AI企業Sunoを米連邦裁判所に提訴

Winamp Group傘下のJamendoがSuno, Inc.を相手に米マサチューセッツ州の連邦裁判所に訴状を提出しました

Yahoo Finance AI2026年6月30日

クリエイター向けのAIボイスジェネレーター「AI Voice Studio」が登場し、スクリプトからスタジオクオリティのナレーションを数分で生成できるようになりました。

AI Voice Studioというツールが提供開始され、ユーザーはスクリプトを入力するだけで70以上の言語でナレーションを生成できます

Hacker News2026年6月20日

GoogleがGemini 3.5 Live Translateをリリース、70以上の言語でリアルタイム音声翻訳に対応

GoogleがGemini 3.5 Live Translateをリリース

THE DECODER2026年6月9日

ElevenLabs、英国政府と覚書署名し公共サービスへの音声AI導入を推進、ロンドン本部を拡張

ElevenLabs は英国科学イノベーション技術省(DSIT)と覚書を締結し、音声AIを公共サービスに活用する方法の探索、AI セキュリティ研究の深化、英国の音声・オーディオAI人材ハブとしての地位強化に協力する

ElevenLabs Blog2026年6月8日

AppleがSiri AIを発表—this fall のOS更新で多段階会話対応の新アシスタント、Google製モデル搭載

AppleはWWDCで「Siri AI」を発表

Ars Technica AI2026年6月8日

中国・香港・シンガポールの研究者が、0.4秒ごとに発話判断する音声対話モデル「Audio-Interaction」を開発

Audio-Interactionは3billion parameterの単一モデルで、音声ストリームを連続監視し、0.4秒単位で<silent>または<response>トークンを出力して、発話か沈黙かを決定する

THE DECODER2026年6月6日

AIカスタマーサービスは実用段階に達していない——音声機能は機能するが、ユーザーの信頼が課題

ElevenLabsがニューヨークでポップアップを開催し、同社の音声モデルを搭載したロボットがコーヒー注文を受け付けて飲料を準備するデモを実施

Semafor Tech2026年6月5日

Goldman SachsとMetaの元従業員が立ち上げたAethexAIが、アフリカと中東の音声AI市場向けに300万ドルの資金調達を実施

AethexAIは昨年設立され、4DX Venturesが主導する$3 millionのプリシード資金を調達

TechCrunch AI2026年6月3日

AI音楽スタートアップ Suno が資金調達により評価額を $5.4 billion に倍増、大手レーベルとの訴訟継続中

Suno が $400 million の資金調達を実施し、評価額は $5.4 billion に達した

THE DECODER2026年6月3日

SoundHound AI株が5.7%上昇、Snowflakeの好決算がSaaS業界の「apocalypse」懸念を払拭

Snowflakeが四半期で11,100から13,600へAIアカウント数が増加し、製品売上が34%成長、通年ガイダンスを$180 million引き上げたことを受け、SoundHound AI(NASDAQ:SOUN)…

Yahoo Finance AI2026年5月29日

AI音声生成市場は2031年までに$20.71 billionに達すると予測、2025年の$4.16 billionから30.7% CAGRで成長

AI音声生成市場は2025年の$4.16 billionから2031年には$20.71 billionに到達する見込み

Yahoo Finance AI2026年5月27日

Sunoのユーザーが、従来のストリーミングプラットフォームの代わりにAI生成の自分の音楽だけを聴く傾向が報告されている

Sunoのサブレディットで、ユーザーが自分で生成したAI音楽を聴くことに専念し、Spotifyなどの従来のストリーミングプラットフォームでの音楽鑑賞をやめたと述べている

The Verge AI2026年5月26日

Stripeが「AI steering」実験を公開——AIエージェントへの指示方法を探索

StripeがAI steering実験について開発者向けブログで発表

Hacker News2026年5月24日

Amazon SageMakerとvLLMが、音声ストリーミングに対応したリアルタイム音声アプリケーションの構築を実現

音声エージェント、ライブキャプショニング、コンタクトセンター分析、アクセシビリティツールは、リアルタイム音声テキスト変換に依存している

Amazon AI Blog2026年5月20日

Stability AI が Stable Audio 3.0 を発表 — 最大6分間のトラックとオープンウェイトモデルに対応

Stability AI が Stable Audio 3.0 を発表

THE DECODER2026年5月20日

AIニュースを追う時間を、毎朝5分に。

200以上のソースから、その日の要点だけをEmail・LINE・Slackへ。ずっと無料です。

月間読者 30,000+
無料で始める

ElevenLabsが教育向けの音声AI利用を拡大、アルベルト・アインシュタインの音声を再現した学習体験を提供開始

ElevenLabsが教授向けの無料アクセスプログラム「Impact Program x Professors」を立ち上げ

ElevenLabs Blog2026年5月19日

Mira Murati氏のスタートアップ Thinking Machines Lab が初のAIモデルを発表し、音声AIにおける相互作用の重要性を主張

Thinking Machines Lab が初のAIモデルを発表

THE DECODER2026年5月12日

Rivianの AI音声アシスタントが今日から車両フリートへの配信を開始

Rivian AssistantがRivian Gen 1およびGen 2の互換車両オーナーに対してソフトウェア更新経由で本日配信開始

The Verge AI2026年5月12日

欧州言語向け音声性別分類器、0.64 MBで4ms推論——LibriSpeechテストで94.4%精度

リアルタイム音声AIパイプライン向けの軽量性別分類器をリリース

Hacker News2026年5月12日

音声AI企業Vapiが$500M valuation達成、Amazon Ringを含む40社以上のライバルを抑える

Vapiのエンタープライズ事業は2025年初頭以降10倍成長

TechCrunch AI2026年5月12日

Wispr Flow、インド市場でのHinglish展開後に成長が加速

Wispr FlowがHinglish(ヒンディー語と英語の混合言語)のロールアウト後、インドでの成長加速を報告

TechCrunch AI2026年5月10日

TypeWhisper: ローカルで動作する音声認識AIが、デバイス上でプライベートに処理、オプションでクラウド対応

TypeWhisperというMac向けの音声テキスト変換ツールがGitHubで公開された

Hacker News2026年5月9日

Dikaletus — Mistral AIを使用した会議録音・文字起こしツールがR言語で開発される

Dikaletus は TUI ツールで、FFmpeg、PulseAudio、Mistral AI API を用いて会議の音声録音、文字起こし、構造化されたミーティングノート生成を自動化する

Hacker News2026年5月9日

OpenAIが音声AIの新モデル3種を発表、GPT-Realtime-2は128Kトークンコンテキストとマルチツール対応を実装

OpenAIはRealtime APIで3つの新しいストリーミング音声モデルを提供開始:GPT-Realtime-2(音声対音声推論エージェント向け)、GPT-Realtime-Translate(70以上の入力言語から…

Latent Space2026年5月8日

OpenAIが3つの新しい音声モデルを発表——リアルタイム推論、70言語以上への翻訳、音声転写に対応

OpenAIがGPT-Realtime-2、GPT-Realtime-Translate、GPT-Realtime-Whisperという3つの新しい音声モデルを提供開始

THE DECODER2026年5月7日

GoogleのスマートホームエコシステムがGeminiボイスアシスタントの強化とカメラ操作の新機能を獲得

Googleのスマートホーム向けAI統合が、2025年のAI刷新以来、最大規模のアップデートを受けた

Ars Technica AI2026年5月5日

ElevenLabsが$500M ARRを達成、BlackRock、Jamie Foxx、Eva Longoria を新投資家として発表

ElevenLabsが新たな投資家としてBlackRock、Jamie Foxx、Eva Longoria を獲得し、年間経常収益(ARR)が$500M に到達した

TechCrunch AI2026年5月5日

PAVO-Bench:音声認識からLLMへの処理を含む5万ターンのデータセットと8万5千パラメータのルーターを公開

GitHub上で公開されたPAVO-Benchは、音声認識(ASR)からLLM(文章を理解・生成するAI)を経由してテキスト音声変換(TTS)に至る一連の処理を評価するためのベンチマークデータセット

Hacker News2026年4月28日

VoiceGoat — LLM攻撃の練習用に設計された脆弱な音声エージェント

GitHubで公開されたVoiceGoatは、音声エージェント(ユーザーの音声指示に応じて自分で判断して作業するAI)に対するLLM(大規模言語モデル)攻撃を練習するためのツール

Hacker News2026年4月28日

Microsoftがオープンソースの音声AI「VibeVoice」をGitHubで公開

MicrosoftがVibeVoiceという音声AIモデルをGitHubで公開

Hacker News2026年4月28日

Canonicalが今後1年間にUbuntu Linuxへのai機能追加を計画

Ubuntu開発元のCanonicalのエンジニアリング担当VP Jon Seagerが月曜日にブログ投稿を公開し、Linux ディストリビューションへのai機能追加計画を発表した

The Verge AI2026年4月27日

ComfyUI、3000万ドル調達で評価額5億ドルに — クリエイターがAI生成メディアをコントロールできるツールへの需要が急増

ComfyUI は AI 画像・動画・音声生成ツールの開発企業で、今回 3000 万ドルの資金調達を実施し、企業価値が 5 億ドルに達した

TechCrunch AI2026年4月24日

AIが職場の日常業務に浸透 — 米国の労働者の半数以上が週単位でAIを仕事に活用

調査によると、米国の成人の50%以上が過去1週間の間に仕事でAI(ChatGPTなどの文章生成AI)を使用している

LessWrong AI2026年4月21日

新しいテキスト音声変換サービス「TTS.ai」がHacker Newsで紹介される

TTS.aiは新しいテキスト音声変換プラットフォームとして発表された

Hacker News2026年4月18日

開発者がWebGPUを使用してブラウザ内で完全にローカルに動作するAIワークスペース「PrivaKit」を構築し、クラウドAPIを使わずに機密データを処理可能に

transformers.js、Whisper、WebGPUを使用してクライアント側で完全にローカルで動作するAIワークスペースを開発

Hacker News2026年4月18日

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

月間読者 30,000+

無料で始める

登録無料・30秒で完了・いつでも解除できます