
LTXがオープンソース動画生成モデル「LTX-2.5」を公開しました。
ユーザーは自分のハードウェアで実行・カスタマイズでき、知的財産を保持したまま運用できます。
NvidiaやComfyUIとの統合により、ローカルGPUでの推論がより効率的になり、ロボティクスや映画製作など幅広い分野での活用が広がると見られます。
何が起きたか
LTXがオープンウェイト世界モデル「LTX-2.5」を発表しました。Hugging FaceとComfyUIを通じて無料で利用でき、動画生成、ロボティクス、物理AI向けの機能を備えています。同社の世界モデルは3300万回以上ダウンロードされ、映画製作、ロボティクス、リアルタイムレンダリングなど幅広い分野で使われています。
なぜ重要か
開発者と企業が独自のハードウェア上でモデルを実行・カスタマイズできるため、クラウド依存を減らし、知的財産を社内に保持できます。NvidiaとComfyUIとの統合により、ローカルGPUでの推論がより効率的になり、より多くの開発者や組織がアクセス可能になる可能性があります。ロボティクス業界では、環境の振る舞いをモデル化する能力がロボット学習に重要とされています。
注目点
年間経常収益が1000万ドル未満の組織は無料で利用できます。LTX-2.5はHugging Face、ComfyUI、LTX APIを通じて即座に利用可能です。Nvidiaとの最適化により、RTX GPUとDGX Sparkでのメモリ要件が削減されています。
LTXは動画生成と物理AIの基盤となるオープンウェイト世界モデル「LTX-2.5」を発表しました。このモデルはHugging FaceとComfyUIを通じて無料で利用可能で、視覚品質、プロンプト理解、生成速度、効率性の向上をもたらします。LTXの世界モデルはこれまでに3300万回以上ダウンロードされ、映画製作、ロボティクス、リアルタイムレンダリングなど多様な分野で活用されています。
LTX-2.5は従来のアーキテクチャへの機能追加ではなく、生成パイプラインの大部分を再構築しました。主要な追加機能には、複数シーンを通じてキャラクター、背景、音声の一貫性を保持するネイティブマルチショット生成があります。プロンプト理解はカスタムGemma 4言語バックボーンと専用プロンプトエンハンサーにより強化され、複数の主体を含む複雑なプロンプト解釈が可能になりました。視覚出力では、新しい拡散ビデオデコーダが高動作シーンでのアーティファクトを削減しながら高い圧縮率を保持します。Diffusion Fidelity Renderingというアプローチにより、8倍時間圧縮潜在空間で動きと構造を構築し、重要な視覚的詳細を保持するより高忠実度のキーフレームを生成します。
ロボティクスと物理AI分野では、LTX-2.5がロボットの学習を支援するために特別に調整された事前学習チェックポイントを含んでいます。開発者は独自ドメイン固有データを使用してモデルをファインチューニングできます。Markov RoboticsのCEO兼共同創設者Atharva Gundawarは、「LTX-2.5は当社にとってオープンモデルの中で最も物理世界の実際の振る舞いをとらえるモデルであり、独自ハードウェアで実行・ファインチューニング可能である点が実際のロボティクス作業に欠かせない」とコメントしています。
Nvidiaとの協業により、LTX-2.5はNvidia RTX GPUおよびDGX Sparkシステムでのローカル推論に最適化されました。メモリ要件が削減され、より多くの開発者と企業がクラウド依存を減らしてローカルで実行できるようになります。NvidiaのローカルAI製品シニアディレクターであるGerardo Delgado Cabreraは、「ローカルGPUにより、クリエイターと開発者は自由に発想を探索でき、ComfyUIなどの人気フレームワークでの最適化により、RTX GPUとDGX Sparkユーザーは大幅にVRAM消費を削減しながら最高のパフォーマンスが得られる」と述べています。LTX-2.5はデータセンターGPUからMacまで幅広いハードウェアで実行可能です。
ComfyUIとの統合により、開発者は実験から本番ワークフローへと移行する際に別の専有プラットフォームにコードを転送する必要がなくなります。ComfyUI共同創設者兼CEOのYoland Yanは「ComfyUIとLTXはオープンモデルがより良いツールをより速く構築するという単純な信念を共有している。LTX-2.5がComfyUIでネイティブ実行されることで、開発者は午後1回で構想から動作する世界モデルパイプラインへ進み、企業は同じパイプラインを独自ハードウェアで本番運用に直結できる」とコメントしています。また、Reactorなどのリアルタイム生成動画開発プラットフォームも協業しており、インタラクティブアバター、ライブ生成環境、リアルタイムロボティクスワークロードへの活用が進みます。LTXは最終的に世界モデルがメディア、シミュレーション、インタラクティブアプリケーション、物理マシンにまたがるインフラストラクチャレイヤーを提供すると見込んでいます。LTX-2.5は年間経常収益1000万ドル未満の組織に対して無料で利用できます。
LTXの世界モデルは、従来の大規模言語モデル(次の単語を予測するAI)とは異なり、環境内の次の状態を予測する技術です。この能力はロボティクス業界で急速に注目を集めており、ロボットが物理世界の振る舞いを学習し、行動がどう影響するかを予測するのに役立ちます。LTXの共同創設者兼CEOであるZeev Farbmanは、世界モデルが「時間軸を通じて動き、空間、音を一貫させる」という固有の課題を抱えていると指摘しています。
LTX-2.5のオープンソース戦略は、企業がクラウド依存を減らし、データと知的財産を社内のハードウェアで保護できるという実利的な利点を提供します。NvidiaやComfyUIなどの重要なパートナーとの統合により、開発者はローカル推論でのメモリ効率と処理速度の向上が期待できます。Markov RoboticsやReactorといった企業がすでに採用を検討していることから、物理AIとロボティクス、リアルタイムメディア生成といった成長分野での採用が広がる可能性があります。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
韓国は2027年までにKorea Investment Corporation内に最低20兆ウォンの資産を有する戦略的投資口座の設立を計画しており、AI、ロボット、サプライチェーンを対象とする

ホワイトハウスは、最強力なAIモデルを公開前に政府が安全テストする枠組みを先月発表しました

ラスベガスのAi4カンファレンスで、ノーベル賞受賞者のGeoffrey Hinton、World Labs CEOのFei-Fei Li、Coursera共同創業者のAndrew Ngは、業界全体でオープンウェイトモデル…

AIニュースの要点を毎朝1分で。
無料で登録