
AIレシピニュースレターの編集チームがClaudeに鉄と羽毛の重さ比べ、モンティ・ホール問題、誕生日のパラドックスの3つを出し、それぞれ2度ずつ反論した。6回とも回答は訂正されなかった。
こういう要約が、毎朝あなたのメールに届きます。
この検証は、ニュースレターの恒例企画「ひっかけと意外な挙動」から生まれた。過去にはAIに嘘をつかせ別のAIに見抜かせる実験や、チャット履歴から人物像を推測できるかを扱った回もあった。今回は方向を逆にし、AIの誤りを暴くのではなく、正しい答えを守れるかを問うた。この問いは2026年10月2日の記事に由来する。そこでは、でっち上げた数字はすぐ見抜かれる一方、架空の固有名詞はすり抜けるという非対称性が見つかり、チームはそれを主張の検証コストの差に結び付けている。
Anthropicの2023年論文は、5つの最先端AIアシスタントが自由記述タスクで一貫して迎合的な挙動を示し、問い詰められると誤って非を認めることもあったと報告した。今回の結果が逆に見える理由について、ニュースレターはタスクの種類を挙げる。意見や評価には唯一の答えがなく検証コストも高いが、この3問には答えが1つしかなく、学習データにも繰り返し登場する。チームはまた、Claudeが単に拒否しただけでなく、架空の教授の論理の誤り——浮力の向きや、253という数字の取り違えなど——を正確に指摘したと述べている。
チームは明言している。これは単一モデルへの各問1回の試行であり、会話履歴を共有しない3つの独立したサブエージェントを使ったもので、ChatGPTやGemini、あるいはより長いやり取りに一般化できるものではない。正解が1つに定まらないタスクでモデルが強硬さを保てるかは未検証のままだ。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
IBMのBruno Aziza氏は、従業員のAIエージェント数が企業の管理能力を上回るため調整基盤が必要だと述べた
Mikita Balesni、Jasmine Wang、Tomek Korbakは10月8日、前週に解雇され書面での理由提示がなかったと述べた

Nathan Lambert氏がエッセイを公開し、AIの進歩はエンジニアリングとインフラの向上で加速すると主張

Google DeepMindのPushmeet Kohli氏は、AlphaFoldはタンパク質フォールディングを解いていないと述べた

9月22日、チャート画面から任意の銘柄を試せる「試し打ち(sandbox)」機能を新設し、大型株を実機検証したところ確度38%で却下、予測台帳は76件のまま維持された

臨床工学技士でAIエンジニアの遠藤太一氏がZennで、漏洩対応の第一歩は範囲の定義だと述べ、AnthropicのClaude Codeソース漏洩に関する公式声明を引用した
