AIToday
大規模言語モデルTHE DECODER掲載日時: 2026年4月26日 19:001分で読める

投資銀行家500人がAIモデルを審査、本番利用できるレベルは「ゼロ」——GPT-5.4・Claude Opus 4.6も不合格

LINEで送る
投資銀行家500人がAIモデルを審査、本番利用できるレベルは「ゼロ」——GPT-5.4・Claude Opus 4.6も不合格

3つのポイント

  1. 新しいベンチマークテストで、投資銀行の新人アナリストが日常的に行うタスクにGPT-5.4とClaude Opus 4.6を投入。500人の投資銀行家が評価した結果、クライアント納品に耐えうる出力は1件もなかった——精度不足またはデータの誤りが理由。

  2. 一方、回答者の過半数(50%超)は『最初のドラフトとしてなら使える』と答えた。つまり、AIが作った初期版を人間が修正・検証する流れなら業務に組み込める段階にある。

  3. 投資銀行業界にとって、高額報酬のアナリスト業務の一部をAIに任せる構想は『市場投入にはまだ遠い』ことが実データで確認された。当面は社員の下調べ時間を短縮するツール止まりになる見込み。

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • askpollyが300万ドル調達、SNS分析で市場調査SiliconANGLE AI · 1時間前
  • ELYZA、AIアプリ生成特許を取得ITmedia AI+ · 1時間前
  • RTX Spark搭載ノートPCが登場WIRED AI · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へ製造業が直視を避ける現実:最新AI・ロボットの陰で、数十年前の「古い機械」が工場を支えている