AIToday

ChatGPT、有料購読者が高品質の健康相談

THE DECODER7時間前
ChatGPT、有料購読者が高品質の健康相談

要点

OpenAIがChatGPTに健康機能をロールアウトし、ユーザーは健康データを連携させて医療ガイダンスを受け取ることが可能になった。ただし、無料ユーザーはGPT-5.5 Instantによる低品質のアドバイスを受け、有料購読者はGPT-5.6 Solを利用できる。GPT-5.6 Solは健康ベンチマークで無料版モデルを大きく上回る性能を示すが、OpenAIはChatGPTなお誤りを犯し、実際の医師による医療アドバイスの代替にはなり得ないと注意している。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    OpenAIが米国の18歳以上のユーザーに「Health in ChatGPT」をロールアウトしており、Apple Health、医療記録、ウェルネスアプリとの連携が可能。無料ユーザーはGPT-5.5 Instantによる低品質の健康相談を受け取り、有料購読者はフラッグシップモデルのGPT-5.6 Solにアクセスできる。

  • なぜ重要か

    OpenAIのHealthBench Professional テストでGPT-5.6 SolはGPT-5.5 Instantを大幅に上回り、完全性は88.0%対53.2%、健康判断の有用性では83.0%対50.8%。しかし、ベンチマークテストは実際の医学診察での状況(医師による対面検査と数年間の経験)を捉えられない。OpenAI自身、ChatGPTはなお誤りを犯す可能性があり、医療アドバイスの代替にはなり得ないことを認めている。

  • 注目点

    この機能は米国のみで利用可能。OpenAIはヨーロッパでの利用可否や時期について発表していない。1月の発表時、欧州経済領域、スイス、英国を明確に除外した。理由は、より厳格なEUデータプライバシー規制と、EU AI法の下で本機能が高リスク分類される可能性があることと考えられる。

詳細

OpenAIは、1月に初公開してテスト開始した機能「Health in ChatGPT」を米国の18歳以上のユーザーにロールアウトすることで、消費者向け健康分野での足がかりを拡大している。本機能により、ユーザーはApple Health、医療記録、ウェルネスアプリをChatGPTに直接連携でき、検査結果の確認、医師診察への準備、睡眠またはアクティビティデータの分析が可能になる。OpenAIは、連携した健康データはモデルの学習または広告目的に使用しないと述べている。

重要な違いは、購読ステータスに基づきユーザーが受け取る健康相談の品質にある。無料ユーザーはGPT-5.5 Instantで利用でき、有料購読者はOpenAIの新しいフラッグシップモデルGPT-5.6 Solにアクセスできる。OpenAIのHealthBench Professional ベンチマークでは、GPT-5.6 SolはGPT-5.5 Instantと旧GPT-4oモデルの両方をテスト対象のすべてのカテゴリで大幅に上回る。最大の差は完全性(GPT-5.6 Solで88.0%対GPT-5.5 Instantで53.2%)と健康判断の有用性(83.0%対50.8%)に表れている。両モデルもこのベンチマークで医師による回答を上回っており、OpenAIはこれを二層構造システムの倫理的正当化として引用する可能性が高い。

ただし、ベンチマーク結果には重大な制限がある。人工的なテスト環境での知識を測定するもので、医師が対面で患者を検査し、非言語的合図を観察し、臨床経験を活かす実際の医学診察で何が起こるかを捉えられない。医師は時間的プレッシャー、疲労、患者記録や同僚の意見などのツールへのアクセス不足により、そのようなテストでスコアが低くなる可能性もある。OpenAI自身は発表の中で繰り返し、ChatGPTは誤りを犯す可能性があり、医療アドバイスに代替えられないと強調している。同社は260人以上の医師が健康機能の開発に貢献したと述べている。

初期テストでは利便性の課題が明らかになった。参加者の70%以上が、専用の健康セクションへの切り替えが面倒だったため、専用セクション外で健康質問をした。これに対して、OpenAIは任意のChatGPT会話内で健康機能を利用可能にしながら、データ管理と過去の健康チャットへのアクセスを維持するための専用健康セクションを保持している。プラットフォーム上での健康ガイダンスの需要規模は実質的である。OpenAIは、現在毎週300百万人以上の人々がChatGPTに健康質問をしており、1月の230百万人から増加していると報告している。

本機能の地域別ロールアウトは限定的である。OpenAIは、Health in ChatGPTがヨーロッパで利用可能になるかどうか、またいつになるかを発表していない。1月に本機能が発表された際、OpenAIは欧州経済領域、スイス、英国を明確に除外した。この決定はEUのより厳格なデータプライバシー規制とEU AI法の下で本機能が高リスク分類される可能性が推進力と考えられる。これらの規制懸念は実際のリスクを反映している。放射線科AI(RadLE 2.0)に関する最近の研究では、テストされた16個のAIモデルのいずれも人間の放射線科医ほどのパフォーマンスを発揮しなかった。その理由は、チャットボットが不確実性を認識する代わりに誤った所見を高い確信度で提示することが多かったためである。逆に、医療記録用のいくつかのAIシステム(MIRAおよびAMIEなど)はシミュレート診察で一次医療医師と同等のパフォーマンスを実証しており、AIは医師の監督下での日常的な診断業務を効果的にサポートできることを示唆している。

背景と解説

OpenAIの健康機能ロールアウトは、AI支援の医療ガイダンスに対する意図的な二層構造アプローチであり、同社は最も高能力の健康モデルを有料購読者に限定している。OpenAIが使用するベンチマークは実質的なパフォーマンス差を示しており、GPT-5.6 Solはテスト対象のすべてカテゴリで医師による回答と無料版モデルの両方を上回っている。しかし、同社自身の注釈はこれらの結果の限界を明らかにしている。ベンチマークテストは人工環境での知識を測定するもので、医師が非言語的合図を評価し、臨床経験に基づいて判断する対面医学診察の診断業務を再現することはできない。260人以上の医師が本機能の開発に協力したというOpenAIの開示は医学的信頼性への取り組みを示唆する一方で、同社は同時にChatGPTなお誤りを犯し、医療アドバイスに代替えられないと警告している。

実際の現実は、パフォーマンス数値が示唆するものより微妙である。AI放射線科学システム(RadLE 2.0)に関する最近の研究では、テストされた16個のAIモデルのいずれも人間の放射線科医ほどの性能を発揮せず、チャットボットが不確実性を認識する代わりに誤った所見を高い確信度で表現することが多かった。一方、MIRA、AMIEなどの他のシステムはシミュレーション診察で一次医療医師と同等のパフォーマンスを実証しており、AIは医師の監督下で日常的な業務をサポートできることを示唆している。OpenAIの初期テストによると、ユーザーの70%以上が専用の健康セクション以外で健康質問をした。その理由は、セクション間の切り替えが面倒だったためで、同社は現在、あらゆる会話内で健康機能を利用可能にすることでこの摩擦を軽減している。ヨーロッパでの機能の不在は、より厳格なデータプライバシーと潜在的なAI法分類に関連しており、同社が世界的に直面する規制上の緊張を際立たせている。現在、毎週300百万人以上がChatGPTに健康質問をしており(1月の230百万人から増加)、このロールアウトの規模と段階的な品質モデルは、何百万人の人々が予備的な健康調査にどのようにアプローチするかを形作る可能性が高い。

よくある質問

ChatGPTの健康機能にどのようなデータを連携できるか?
ユーザーはApple Health、医療記録、ウェルネスアプリを連携でき、検査結果の確認、医師の診察に向けた準備、睡眠またはアクティビティデータの分析が可能。
連携した健康データはモデルの学習や広告に使われるか?
OpenAIは、連携した健康データはモデルの学習や広告に使用しないと述べている。
無料版と有料版のパフォーマンスの違いは?
OpenAIのHealthBench Professional テストでは、GPT-5.6 Sol(有料版)の完全性スコアは88.0%、GPT-5.5 Instant(無料版)は53.2%。健康判断の有用性では、有料版が83.0%、無料版が50.8%。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます

毎朝1分、AIの要点だけ。

200媒体以上・Email/LINE/Slack 対応

無料で受け取る →