AIToday
大規模言語モデル自動運転WIRED AI掲載日時: 2026年10月8日 6:00

GPT-6がトヨタをIn-N-Outへ

LINEで送る
GPT-6がトヨタをIn-N-Outへ

3つのポイント

  1. 何が起きたか

    AxiomのAditya Ramabadran、Simon Mahns、Tobias Gesslerの3氏が、GPT-6 Astraをチャット画面経由でカメラと2024年型トヨタ・カローラのパワーステアリングに接続し、In-N-Outまで運転させた。

  2. なぜ重要か

    テキスト出力用に作られたモデルが、事前教示なしに実車をその場で走行させた。3氏は、言語ベースのAIが物理世界の初歩的な理解を得つつあることを示唆すると話す。

  3. 注目点

    3氏は、大手AI企業が実際に運転用の訓練をしているとは考えていない。この能力は3D推論の訓練から生じた可能性が高く、一般的な運転には通用しないかもしれないという。

誰に効くかこれは、汎用モデルが物理世界で行動できるかを探るAI研究者やスタートアップの技術者、そして言語モデルが専用の運転システムに何かをもたらすかを検討するロボティクスや自動運転のチームにとって重要な意味を持つ。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

この昼食がてらの走行は週末の思いつきから始まった。Ramabadran、Mahns、Gesslerの3氏は、Astraのようなモデルが複雑な3Dシミュレーションを構築できることに気づき、その能力が実世界にも通じるのか疑問に思った。3氏はベイエリア在住でTeslaやWaymoに触れる機会があり、それがテストの選択に影響した可能性があるという。

この実験は、物理的推論を測定しようとする広範な動きの一環に位置づけられる。Elorian AIのCEOで、以前はGoogle DeepMindの研究者だったAndrew Dai氏は、視覚的推論が向上すれば、来店客が食事を楽しんでいるかを見分けるシステムや、家庭内で機能するロボットといった応用が開けると話す。ElorianとScale AIは最近、モデルが物理的な場面をどれだけ理解しているかを測るベンチマーク「Humanity's Sixth Sense」を開発した。Scale AIのXingang Guo氏は、視覚AI研究の大半は知覚に関するもので、モデルが場面を直感的に理解するには何が必要かを問うことが目的だったと話す。

カローラの走行が示すものは、聞こえほど広いものではない。モデルの運転能力は、明示的な運転指導ではなく3D推論に焦点を当てた訓練から生じた可能性が高く、3氏自身のベンチマークは、運転試験に合格するにはほど遠いことを示している。この差が縮まるかどうかは、マルチモーダル訓練の規模拡大に伴い物理的理解がどれだけ向上するか、そして技術者らが観察した文脈内学習が駐車場の先でも頼れるかどうかにかかっているかもしれない。

よくある質問
技術者らはどのモデルを試し、どれが成功したのか。
OpenAIとAnthropicの最新モデルを試す前に、SpaceXAIのGrokを試した。駐車場のコースを完走したのはGPT-6 Astraのみで、Claude Fable 5.1は45パーセント、Grokは11パーセントまでしか進めなかった。
最初に制御を任せようとしたとき、モデルはどう反応したか。
当初モデルは拒否し、道路の画像は解釈できても物理的な車に動作命令は出せないと述べた。慎重にプロンプトを与えると、さらに先へ進むよう促せた。
技術者らはなぜモデルが運転できると考えるのか。
大手AI企業が実際に車の運転を訓練しているとは考えていない。運転能力は3D推論に焦点を当てた訓練の一部として生じた可能性が高いという。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へOpenAI、GPT-6搭載ChatGPT発表