AIToday
動画生成ロボティクスオープンソースAIRobotics & Automation News掲載日時: 2026年8月13日 19:006分で読める

LTX、オープンソース動画生成モデルLTX-2.5を無料公開

LINEで送る
LTX、オープンソース動画生成モデルLTX-2.5を無料公開

要点

  • LTXがオープンソース動画生成モデル「LTX-2.5」を公開しました。

  • ユーザーは自分のハードウェアで実行・カスタマイズでき、知的財産を保持したまま運用できます。

  • NvidiaやComfyUIとの統合により、ローカルGPUでの推論がより効率的になり、ロボティクスや映画製作など幅広い分野での活用が広がると見られます。

3つのポイント

  1. 何が起きたか

    LTXがオープンウェイト世界モデル「LTX-2.5」を発表しました。Hugging FaceとComfyUIを通じて無料で利用でき、動画生成、ロボティクス、物理AI向けの機能を備えています。同社の世界モデルは3300万回以上ダウンロードされ、映画製作、ロボティクス、リアルタイムレンダリングなど幅広い分野で使われています。

  2. なぜ重要か

    開発者と企業が独自のハードウェア上でモデルを実行・カスタマイズできるため、クラウド依存を減らし、知的財産を社内に保持できます。NvidiaとComfyUIとの統合により、ローカルGPUでの推論がより効率的になり、より多くの開発者や組織がアクセス可能になる可能性があります。ロボティクス業界では、環境の振る舞いをモデル化する能力がロボット学習に重要とされています。

  3. 注目点

    年間経常収益が1000万ドル未満の組織は無料で利用できます。LTX-2.5はHugging Face、ComfyUI、LTX APIを通じて即座に利用可能です。Nvidiaとの最適化により、RTX GPUとDGX Sparkでのメモリ要件が削減されています。

詳細

全文を読む

LTXは動画生成と物理AIの基盤となるオープンウェイト世界モデル「LTX-2.5」を発表しました。このモデルはHugging FaceとComfyUIを通じて無料で利用可能で、視覚品質、プロンプト理解、生成速度、効率性の向上をもたらします。LTXの世界モデルはこれまでに3300万回以上ダウンロードされ、映画製作、ロボティクス、リアルタイムレンダリングなど多様な分野で活用されています。

LTX-2.5は従来のアーキテクチャへの機能追加ではなく、生成パイプラインの大部分を再構築しました。主要な追加機能には、複数シーンを通じてキャラクター、背景、音声の一貫性を保持するネイティブマルチショット生成があります。プロンプト理解はカスタムGemma 4言語バックボーンと専用プロンプトエンハンサーにより強化され、複数の主体を含む複雑なプロンプト解釈が可能になりました。視覚出力では、新しい拡散ビデオデコーダが高動作シーンでのアーティファクトを削減しながら高い圧縮率を保持します。Diffusion Fidelity Renderingというアプローチにより、8倍時間圧縮潜在空間で動きと構造を構築し、重要な視覚的詳細を保持するより高忠実度のキーフレームを生成します。

ロボティクスと物理AI分野では、LTX-2.5がロボットの学習を支援するために特別に調整された事前学習チェックポイントを含んでいます。開発者は独自ドメイン固有データを使用してモデルをファインチューニングできます。Markov RoboticsのCEO兼共同創設者Atharva Gundawarは、「LTX-2.5は当社にとってオープンモデルの中で最も物理世界の実際の振る舞いをとらえるモデルであり、独自ハードウェアで実行・ファインチューニング可能である点が実際のロボティクス作業に欠かせない」とコメントしています。

Nvidiaとの協業により、LTX-2.5はNvidia RTX GPUおよびDGX Sparkシステムでのローカル推論に最適化されました。メモリ要件が削減され、より多くの開発者と企業がクラウド依存を減らしてローカルで実行できるようになります。NvidiaのローカルAI製品シニアディレクターであるGerardo Delgado Cabreraは、「ローカルGPUにより、クリエイターと開発者は自由に発想を探索でき、ComfyUIなどの人気フレームワークでの最適化により、RTX GPUとDGX Sparkユーザーは大幅にVRAM消費を削減しながら最高のパフォーマンスが得られる」と述べています。LTX-2.5はデータセンターGPUからMacまで幅広いハードウェアで実行可能です。

ComfyUIとの統合により、開発者は実験から本番ワークフローへと移行する際に別の専有プラットフォームにコードを転送する必要がなくなります。ComfyUI共同創設者兼CEOのYoland Yanは「ComfyUIとLTXはオープンモデルがより良いツールをより速く構築するという単純な信念を共有している。LTX-2.5がComfyUIでネイティブ実行されることで、開発者は午後1回で構想から動作する世界モデルパイプラインへ進み、企業は同じパイプラインを独自ハードウェアで本番運用に直結できる」とコメントしています。また、Reactorなどのリアルタイム生成動画開発プラットフォームも協業しており、インタラクティブアバター、ライブ生成環境、リアルタイムロボティクスワークロードへの活用が進みます。LTXは最終的に世界モデルがメディア、シミュレーション、インタラクティブアプリケーション、物理マシンにまたがるインフラストラクチャレイヤーを提供すると見込んでいます。LTX-2.5は年間経常収益1000万ドル未満の組織に対して無料で利用できます。

背景と解説

LTXの世界モデルは、従来の大規模言語モデル(次の単語を予測するAI)とは異なり、環境内の次の状態を予測する技術です。この能力はロボティクス業界で急速に注目を集めており、ロボットが物理世界の振る舞いを学習し、行動がどう影響するかを予測するのに役立ちます。LTXの共同創設者兼CEOであるZeev Farbmanは、世界モデルが「時間軸を通じて動き、空間、音を一貫させる」という固有の課題を抱えていると指摘しています。

LTX-2.5のオープンソース戦略は、企業がクラウド依存を減らし、データと知的財産を社内のハードウェアで保護できるという実利的な利点を提供します。NvidiaやComfyUIなどの重要なパートナーとの統合により、開発者はローカル推論でのメモリ効率と処理速度の向上が期待できます。Markov RoboticsやReactorといった企業がすでに採用を検討していることから、物理AIとロボティクス、リアルタイムメディア生成といった成長分野での採用が広がる可能性があります。

よくある質問

LTX-2.5はいくらで使えますか?
年間経常収益が1000万ドル未満の組織は無料で利用できます。Hugging Face、ComfyUI、LTX APIを通じて即座に利用可能です。
これまでのモデルとの主な違いは何ですか?
LTX-2.5は世界モデルの生成パイプラインの大部分を再構築しました。マルチショット生成により、複数シーンを通じてキャラクターと音声の一貫性を保持でき、Gemma 4言語バックボーンによりより複雑なプロンプト理解が可能になっています。新しい拡散ビデオデコーダも高動作シーン中のアーティファクト(ノイズ)を低減します。
ローカルGPUで動作させられますか?
NvidiaとLTXの最適化により、Nvidia RTX GPUおよびDGX Sparkでのメモリ要件が削減され、ローカル推論が可能になりました。LTX-2.5はデータセンターGPUからMacまで幅広いハードウェアで実行できます。
Robotics & Automation News元記事を読む

「動画生成」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へ子どもたちが語るAI、使い方から不安まで

AIニュースの要点を毎朝1分で。

無料で登録