AIToday
大規模言語モデルAI安全性・アラインメントLessWrong AI掲載日時: 2026年9月14日 13:00

GPT-6-Astra、4ホップ課題31%

LINEで送る
GPT-6-Astra、4ホップ課題31%

Second Look Fellowshipの再現実験でGPT-6-AstraをFable 5、Opus 5、Opus 4.5、GPT-5.6-Sol、Gemini 3.1 Pro、Kimi k3、Fable 5.1と同じno-CoT問題・プロトコルで検証した。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

LessWrong AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • アモデイ氏の提言でソフトと半導体が分裂Yahoo Finance AI · 4時間前
  • AI禁止か活用か 大学で対応分かれるFortune AI · 4時間前
  • パナソニック コネクト、AIで78.8万時間削減AINOW · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へArteryがArm MCUパートナーに