AIToday
大規模言語モデルヘルスケアAIAI安全性・アラインメントTHE DECODER掲載日時: 2026年7月24日 6:01

ChatGPT、有料購読者が高品質の健康相談

LINEで送る
ChatGPT、有料購読者が高品質の健康相談

3つのポイント

  1. 何が起きたか

    OpenAIが米国の18歳以上のユーザーに「Health in ChatGPT」をロールアウトしており、Apple Health、医療記録、ウェルネスアプリとの連携が可能。無料ユーザーはGPT-5.5 Instantによる低品質の健康相談を受け取り、有料購読者はフラッグシップモデルのGPT-5.6 Solにアクセスできる。

  2. なぜ重要か

    OpenAIのHealthBench Professional テストでGPT-5.6 SolはGPT-5.5 Instantを大幅に上回り、完全性は88.0%対53.2%、健康判断の有用性では83.0%対50.8%。しかし、ベンチマークテストは実際の医学診察での状況(医師による対面検査と数年間の経験)を捉えられない。OpenAI自身、ChatGPTはなお誤りを犯す可能性があり、医療アドバイスの代替にはなり得ないことを認めている。

  3. 注目点

    この機能は米国のみで利用可能。OpenAIはヨーロッパでの利用可否や時期について発表していない。1月の発表時、欧州経済領域、スイス、英国を明確に除外した。理由は、より厳格なEUデータプライバシー規制と、EU AI法の下で本機能が高リスク分類される可能性があることと考えられる。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

OpenAIの健康機能ロールアウトは、AI支援の医療ガイダンスに対する意図的な二層構造アプローチであり、同社は最も高能力の健康モデルを有料購読者に限定している。OpenAIが使用するベンチマークは実質的なパフォーマンス差を示しており、GPT-5.6 Solはテスト対象のすべてカテゴリで医師による回答と無料版モデルの両方を上回っている。しかし、同社自身の注釈はこれらの結果の限界を明らかにしている。ベンチマークテストは人工環境での知識を測定するもので、医師が非言語的合図を評価し、臨床経験に基づいて判断する対面医学診察の診断業務を再現することはできない。260人以上の医師が本機能の開発に協力したというOpenAIの開示は医学的信頼性への取り組みを示唆する一方で、同社は同時にChatGPTなお誤りを犯し、医療アドバイスに代替えられないと警告している。

実際の現実は、パフォーマンス数値が示唆するものより微妙である。AI放射線科学システム(RadLE 2.0)に関する最近の研究では、テストされた16個のAIモデルのいずれも人間の放射線科医ほどの性能を発揮せず、チャットボットが不確実性を認識する代わりに誤った所見を高い確信度で表現することが多かった。一方、MIRA、AMIEなどの他のシステムはシミュレーション診察で一次医療医師と同等のパフォーマンスを実証しており、AIは医師の監督下で日常的な業務をサポートできることを示唆している。OpenAIの初期テストによると、ユーザーの70%以上が専用の健康セクション以外で健康質問をした。その理由は、セクション間の切り替えが面倒だったためで、同社は現在、あらゆる会話内で健康機能を利用可能にすることでこの摩擦を軽減している。ヨーロッパでの機能の不在は、より厳格なデータプライバシーと潜在的なAI法分類に関連しており、同社が世界的に直面する規制上の緊張を際立たせている。現在、毎週300百万人以上がChatGPTに健康質問をしており(1月の230百万人から増加)、このロールアウトの規模と段階的な品質モデルは、何百万人の人々が予備的な健康調査にどのようにアプローチするかを形作る可能性が高い。

よくある質問
ChatGPTの健康機能にどのようなデータを連携できるか?
ユーザーはApple Health、医療記録、ウェルネスアプリを連携でき、検査結果の確認、医師の診察に向けた準備、睡眠またはアクティビティデータの分析が可能。
連携した健康データはモデルの学習や広告に使われるか?
OpenAIは、連携した健康データはモデルの学習や広告に使用しないと述べている。
無料版と有料版のパフォーマンスの違いは?
OpenAIのHealthBench Professional テストでは、GPT-5.6 Sol(有料版)の完全性スコアは88.0%、GPT-5.5 Instant(無料版)は53.2%。健康判断の有用性では、有料版が83.0%、無料版が50.8%。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • AnthropicがClaude Codeのトークン消費を解説ITmedia AI+ · 1時間前
  • SnapのSpecs Intelligence、iOSプレビュー開始The Verge AI · 1時間前
  • Intel、MLPerf v6.1でXeon推論2.4倍Top Companies AI · 5時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAI agents がオンライン利用者を上回る