
ソフトウェアエンジニアがSchmaudioを立ち上げた。リスナーの選択がリアルタイムでナラティブを再形成するAI駆動の双方向オーディオストーリープラットフォームだ。
生成AIにより、分岐ストーリーが単一の開発者にとって実現可能になった。従来は可能なパス数が指数関数的に増加するため不可能だった。
3つの無料ストーリーが今利用できる。
何が起きたか
あるソフトウェアエンジニアがSchmaudioを開発した。リスナーの選択がリアルタイムでストーリーを変える双方向オーディオストーリー生成プラットフォームである。ChatGPTでストーリーを執筆し、ElevenLabsで音声合成を行い、ストーリー全体を事前構築する代わりにリスナーがそこに到達した時点でのみエピソードを生成する。
なぜ重要か
従来の双方向ストーリーには実質的な限界がある。分岐パスが指数関数的に増加するため、人間の著者が全ての結果を執筆することは不可能である。生成AIはこの制約を排除し、同じエピソードから始めた2人のリスナーが選択に基づいてますます異なる冒険を経験できるようにする。また別のパスを再生して探索できる。日本の視聴者は、生成AIを活用した双方向オーディオストーリープラットフォームにより、従来の固定的なストーリー構成の制約を超えた、選択肢に基づいて分岐するコンテンツを体験できる可能性がある。
注目点
3つのストーリーがschmaudio.netで複数言語により無料で利用可能だ。The Alibi(大人向けミステリー)、The Map Awakens(若年リスナー向け冒険)、Who Comes Tonight?(幼い子ども向け)である。開発者はAIモデルの改善と双方向ストーリーテリング構造の習得により、プラットフォームが本来の可能性に達するかどうかが決まると指摘している。
Schmaudioの開発者は、このプラットフォームを2つの子ども時代の好物に遡る。テーブルトークRPGと、リスナーの選択によってどのページをめくるか決まるインタラクティブな冒険書籍だ。これらの書籍には避けられない限界があった。全ての可能なパスを事前に執筆する必要があり、分岐は指数関数的に増加する。1エピソードあたり3つの選択肢があると、9、27、81のパスへと増える。人間の著者が1つのストーリーのために数百万エピソードを執筆することはできなかった。数年後、開発者自身の子どもたちがオーディオストーリーを聴き始めた時、このアイデアが戻ってきた。もしオーディオストーリーが決定ポイントで一時停止し、リスナーに選択させ、その選択に基づいて異なるように続いたら?生成AIはそれを実現可能にした。開発者はAIを置き換えとしてではなく、フレームワーク内で動作するアシスタントと説明している。ストーリーには定義された世界、キャラクター、テーマがあり、AIは先行するイベントを尊重し、キャラクターの一貫性を保つエピソードを生成する。このアプローチにより、1人の開発者が他の方法では不可能な規模で作成できる。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
トムソン・ロイターは1日、初の独自大規模言語モデル「Thomson」を発表した
小米(Xiaomi)が、折りたたみスマートフォン向けに加え、AIアクセラレーションと自動運転向けの3つのXringプロセッサを発表した

アマゾンは投資家に対し、2026年の設備投資額が従来計画より200億ドル多い2200億ドルになるとの見通しを表明した

トムソン・ロイターは、アリババのQwenを基にした初の自社言語モデルを公開した

Canonicalはブリストル大学での3年間の博士課程プロジェクトに共同出資し、大規模なCコードベースを安全で動作的に正しく、保守可能なRustへ翻訳するLLMの活用を調査する

8月10日から9日間で、Meta(Muse Glimmer)、NVIDIA(Nemotron 3.5 Lightning)、Alibaba Cloud(Qwen3.8-27B)が約30Bパラメータのオープンウェイトモデル…
