AIToday
AI安全性・アラインメントオープンソースAITechCrunch AI掲載日時: 2026年9月18日 4:00

BasetenのBase Labs、Hugging Face、Goodfireがオープンウェイトの安全基準を構築へ

LINEで送る
BasetenのBase Labs、Hugging Face、Goodfireがオープンウェイトの安全基準を構築へ

3つのポイント

  1. 何が起きたか

    BasetenはBase Labs、Hugging Face、Goodfire AIと組み、abliterationで安全機構を除去され危険化しうるオープンウェイトモデルの評価・監視を構築する。

  2. なぜ重要か

    Basetenの説明によれば、狙いは安全手法を後付けではなく、モデルの学習・展開の仕組みに組み込み透明にすることにある。

  3. 注目点

    提携の技術的詳細は未公表で、基準の成否はオープンモデルへの安全の組み込み方で合意できるかにかかる。広く開発者エコシステムに枠組みへの参加を呼びかけており、動向に注目だ。

誰に効くかこれはオープンウェイトモデルを学習・展開する開発者や研究者に影響する。Basetenとパートナーが安全手法を公開し、開発者エコシステムに枠組みへの参加を呼びかけているためだ。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

BasetenはAIインフラ分野で無名の存在ではない。推論プロバイダーの同社は6月に15億ドルのシリーズFを調達して評価額を130億ドルに押し上げ、今年前半に研究グループBase Labsを立ち上げた。提携相手のGoodfire AIも同様に資金が厚く、今年前半にB Capital主導の1億5000万ドルのシリーズBを調達し、モデル解釈プラットフォームを推進している。こうした資金裏付けは、これが草創期の実験ではなく、オープンモデルの学習・展開のあり方を形作る資金豊富な取り組みであることを示す。

オープンウェイトモデルをめぐる安全の問題は、abliterationの広がりとともに切迫度を増している。オープンソースAIモデルをホストするHugging Faceは現在6,000超のabliteration済みモデルを掲載しており、安全機構がいかに容易に剥がされるかを示す具体指標だ。Basetenは自らの取り組みを、後付けではなく透明で学習・展開に組み込まれたオープンモデルの「基準」と位置づける。Xへの投稿で同社は、オープンであることがAI安全の利点になるとの考えを示し、モデル挙動の可視性が高まり、安全研究を実行可能な制御に変える手段がクローズドソースより多くなると述べた。

AIの「ブラックボックス」を開き、モデルがどう判断するかを説明することに特化するGoodfireは、解釈可能性への注力を踏まえれば、その方程式の「組み込み」部分を担う最有力候補だ。Basetenはまた、広く開発者エコシステムに枠組みへの参加を呼びかけ、誰もが安全に使えるオープンモデルのエコシステムを築いていると説明する。これが広く採用される基準になるか、資金は豊富でもニッチな取り組みにとどまるかは、呼びかけに何人の開発者が応じるかにかかりそうだ。

よくある質問
abliterationとは何か?
オープンウェイトモデルから安全機構を除去し、危険化しうる広がりつつある手法。Hugging Faceは現在6,000超のabliteration済みモデルを掲載している。
提携は技術的にどう進むのか?
提携の技術的な進め方は公表されていない。Goodfireは、オープンモデルに組み込み、提供者が担うべき安全という目標を掲げた。
TechCrunch AI元記事を読む
LINEで送る

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • DeepMind Institute発足、AGIへの備えThe Rundown AI · 3時間前
  • ザッカーバーグ、AI減速の協調を拒否The Rundown AI · 3時間前
  • トランプ発言が示すAI機関の限界Fortune AI · 3時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へ台湾・中国の登壇者、病院AIの現地化必須を主張