AIToday
大規模言語モデルAIコーディングThe Verge AI掲載日時: 2026年7月15日 6:004分で読める

SpaceXAI Grok Build、ユーザーのコード全体をクラウドにアップロード

LINEで送る
SpaceXAI Grok Build、ユーザーのコード全体をクラウドにアップロード

要点

  • SpaceXAI の Grok Build コーディングツールが、ユーザーのコードリポジトリ全体を Google Cloud ストレージに自動アップロードしていた。対象には開かないよう指示されたファイルや削除されたシークレットも含まれていた。

  • 月曜日にセキュリティ研究者が問題を公開した後、同社は機能を無効化した。セキュリティ専門家はデータ保持が過度であり、ソースコード、セキュリティ脆弱性、認証情報など機密情報が露出した可能性があると確認。

  • Elon Musk は以前アップロードされたデータの削除を約束したが、同社の初期対応はユーザーが利用可能なプライバシーコントロールの説明が不正確だった。

3つのポイント

  1. 何が起きたか

    SpaceXAI のAIコーディングツール「Grok Build」がユーザーのコードベース全体を Google Cloud にアップロードしていたことが判明した。アップロード対象には、ユーザーが開かないよう指示したファイルや削除されたシークレットも含まれていた。月曜日に Cereblab の報告を受け、同社は機能を無効化した。

  2. なぜ重要か

    データ保持の規模は Claude Code などの類似ツールより圧倒的に大きく、ソースコード、セキュリティ脆弱性情報、個人データ、インフラ詳細、認証情報が露出した可能性がある。ロンドン大学キングスカレッジのセキュリティ研究者 Dr. Lukasz Olejnik は、この保持は「過度」だと指摘した。

  3. 注目点

    Elon Musk は以前アップロードされたデータは「完全に削除される」と述べたが、SpaceXAI は当初 /privacy コマンドで対応可能と主張。ただし Cereblab の調査では、このコマンドはコードベースアップロード機能を実際には制御していないことが判明した。

この記事についてAIに質問する →

背景と解説

Cereblab の研究グループが実施したテストで SpaceXAI の Grok Build が予想以上に積極的なデータ収集を行っていることが判明し、同ツールは注視の対象となった。このツールは単なるセッション限定データやマスク化されたテレメトリの同期ではなく、開発者が作業するソースファイル全体(コードベース)をキャプチャし、Google Cloud ストレージに送信していた。特に注目すべきは、開発者が明示的にアクセスしないよう指示したファイルはもちろん、バージョン履歴から削除されたシークレットに対してもこの動作が続いていたことだ。これはツールがファイルシステムの低レベルでデータをキャプチャしており、ユーザーの意図や認証情報の扱いに関するベストプラクティスを尊重していないことを示唆している。

この事件は SpaceXAI の公表されたプライバシー姿勢と実際の動作の間のギャップを浮き彫りにしている。初期対応で同社は /privacy コマンドをデータ保持の無効化メカニズムとして指摘した。しかし Cereblab の分析では、/privacy はセッション単位の保持のみを切り替えるもので、デフォルトで有効化されていたコードベースアップロード機能を制御していないことが判明した。この矛盾は設計の欠陥か、ユーザーが実際にデータを制御できる場所についての誤解を招く情報提供のいずれかを示唆している。独立セキュリティ研究者としての Dr. Lukasz Olejnik の「過度」という評価は重みを持つものであり、専有ソースコードからインフラ詳細まで及ぶ彼の潜在的露出の一覧は、この動作がもたらすビジネスと運用上のリスクを強調している。

よくある質問

Grok Build は どのくらいのデータをアップロードしていたのか?
Grok Build はコードリポジトリ全体をパッケージ化してアップロードしていた。これにはアクセスしないよう指示されたファイルや、履歴から削除されたシークレットも含まれていた。このデータ保持量は Claude Code のような類似ツールと比較して圧倒的に多かった。
この問題はいつ発見され、修正されたのか?
Cereblab が月曜日にアップロード動作に関する調査結果を公開した。月曜日の時点で、SpaceXAI のサーバーは「disable_codebase_upload: true」フラグを返すようになり、コードベースアップロードは「機能しなくなった」。
どのような機密情報がリスクにさらされた可能性があるのか?
ロンドン大学キングスカレッジの独立セキュリティ研究者 Dr. Lukasz Olejnik によると、リスクの対象となる可能性のある情報には、専有ソースコード、セキュリティ脆弱性に関する情報、個人データ、インフラ詳細、認証情報が含まれる。
The Verge AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Google WikiSkill、AIが失敗記憶THE DECODER · 1時間前
  • AIによる失業は米労働者のわずか3%Fortune AI · 1時間前
  • 自宅PCで無料オフラインのチャットボットWIRED AI · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

Google WikiSkill、AIが失敗記憶

Googleの研究者が、AIエージェントに過去の失敗や成功した戦略を永続的に記憶させるフレームワーク「WikiSkill」を発表した

NEWTHE DECODER1時間前

AIによる失業は米労働者のわずか3%

2026年7月30日から8月4日にかけて実施されたYouGovの調査(米国の労働者1,250人対象)で、2023年以降にAIが原因で失職したと答えた人はわずか約3%だった

NEWFortune AI1時間前

自宅PCで無料オフラインのチャットボット

MetaやGoogleなど大手が公開する大規模言語モデル(LLM、テキストを理解・生成するAI)の多くが、今や無料でダウンロードでき、自分のパソコン上で動かせる

NEWWIRED AI1時間前

AIエージェント、Solana版提供へ

8月24日、Virtuals ProtocolはSolana上でAIエージェントの作成・所有ツールの新スイートを展開し、投資家がエージェント連動トークンを購入できるようにした

NEWYahoo Finance AI4時間前

AIの数学証明が分野の核心的価値に挑戦

AIが現在、いわゆるヤコビアン予想を含む長年の数学問題の解決を支援しており、トップ数学者たちはこれが最終的に良いことなのか悪いことなのか深く迷っている

Japan Times Tech10時間前

AI引用の38.6%が捏造との調査結果

15の言語モデルを対象に、出典付きの2件の依頼でベンチマークを実施

Hacker News10時間前
次の記事へApple、新型Siri AI パブリックベータで一般公開