ニュースマクロOpenAIが『Health in ChatGPT』を提供開始、無料ユーザーと有料ユーザーで階層型モデルアクセスを採用

OpenAIが『Health in ChatGPT』を提供開始、無料ユーザーと有料ユーザーで階層型モデルアクセスを採用

著者: The Decoder·

重要ポイント

  • OpenAIの「Health in ChatGPT」機能は、1月に始まったテスト期間を経て、現在18歳以上の米国ユーザーが利用可能です。
  • この機能は2階層モデルシステムを採用しており、無料ユーザーは旗艦モデルのGPT-5.6 Solにアクセスする有料サブスクライバーよりもスコアの低い健康ガイダンスを受け取ります。
  • 現在、毎週3億人以上がChatGPTに健康に関する質問をしており、1月の2億3,000万人から増加しています。
  • GDPRの健康データ要件とEU AI法の下での潜在的な高リスク分類のため、ヨーロッパでの提供開始は不透明なままです。
  • 260人以上の医師が健康機能の開発に参加し、OpenAIは接続された健康データをモデルのトレーニングや広告に使用しないと述べています。
OpenAIが『Health in ChatGPT』を提供開始、無料ユーザーと有料ユーザーで階層型モデルアクセスを採用

OpenAIは、1月に始まったテスト期間を経て、18歳以上の米国ユーザーに向けて「Health in ChatGPT」機能を展開しています。この機能により、ユーザーはApple Healthデータ、医療記録、ウェルネスアプリケーションを連携させ、検査結果の確認、医師の診察の準備、睡眠やアクティビティデータの分析を行うことができます。この動きは、個人の健康データに対する消費者向けテクノロジーの長年にわたる拡大(AppleのHealthKitやGoogle Fitは2014年からウェアラブルおよびアプリのデータを集約してきました)を基盤としていますが、OpenAIはさらに一歩進んで、すでに数億人が使用している単一のAIアシスタント内で、医療記録、検査結果の解釈、対話型の健康ガイダンスを統一しようとしています。OpenAIは、接続された健康データをモデルのトレーニングや広告目的には使用しないと述べています。米国では、医療提供者や保険会社が保持する医療記録はHIPAA(医療保険の相互運用性と責任に関する法律)の下で保護されていますが、消費者向けアプリやAIプラットフォームを通じてルーティングされる健康データはHIPAAが適用されない規制の空白地帯に陥る可能性があり、この区別は連邦取引委員会が健康アプリ開発者に対する執行活動でますます指摘しているところです。

この発表はOpenAIの公式ウェブサイトで詳述されており、同社によれば、現在毎週3億人以上(1月の2億3,000万人から増加)がChatGPTに健康に関する質問をしています。また、260人以上の医師が健康機能の開発に参加したと述べています。

階層型モデルアクセスによる品質格差

この機能は2階層システムで動作します。ChatGPTの無料版ユーザーは、GPT-5.5 Instantを搭載した健康ガイダンスを受け取ります。これは、有料サブスクライバー専用の新しい旗艦モデルであるGPT-5.6 Solよりも健康ベンチマークでスコアが低くなります。

OpenAIは、両方のモデルがHealthBench Professionalテストで医師の回答を上回ったことを指摘し、この構造を擁護すると予想されます。しかし、ベンチマーク結果は、知識を測定するために設計された人工的なテスト環境から得られたものです。医師のスコアが低くなる理由はいくつかあり、時間的制約、疲労、または患者のカルテや同僚からの意見にアクセスせずにテストを受けることなどが考えられます。また、ベンチマークは、医師が患者を直接診察し、非言語的な手がかりを観察し、長年の臨床経験に基づいて評価する実際の医療診断のダイナミクスを再現することはできません。階層化されたアプローチはまた、サブスクリプションを利用できないユーザーが定量的により低い品質の健康ガイダンスを受け取ることを意味します。これは、AIアシスタントが医療情報の最初の頼り先としてますます利用される中で、アクセスに関する問題を提起する動的な状況であり、特に無料枠を使用する可能性が高い若年層や低所得者層の間で顕著です。

OpenAI自身も、ChatGPTは依然としてエラーを起こす可能性があり、専門的な医学的アドバイスに代わるものではないと発表の中で繰り返し警告しています。

初期テスト後のユーザビリティ改善

OpenAIの初期テストでは、専用の「Health」セクションに切り替えるのが煩わしすぎるため、70%以上の参加者が専用セクションの外で健康に関する質問をしていることが明らかになりました。これに対応して、同社は接続されたデータの管理や過去の健康チャットへのアクセスのための別個の「Health」セクションを維持しつつ、どの会話でも「Health」を利用できるようにしました。

ヨーロッパでの提供開始は不透明

同社は、この「Health」機能がヨーロッパで利用可能になるかどうか、またその時期については表明していません。OpenAIが1月にこの機能を最初に発表した際、欧州経済領域、スイス、およびイギリスは意図的に除外されていました。より厳格なEUデータプライバシー規則と、EU AI法の下でこの機能が高リスクと分類される可能性が除外の理由として挙げられています。GDPR第9条は健康データを明示的な同意と追加の保護措置を必要とする特別なカテゴリとして指定しており、特定の健康関連AIシステムに対するEU AI法の高リスク分類は、米国市場では適用されない適合性評価や継続的なコンプライアンス義務を引き起こす可能性があります。

AIの健康リスクは仮想上のものではない

医療の文脈におけるAIの限界は十分に文書化されています。最新の放射線学ベンチマークであるRadLE 2.0では、テストされた16のAIモデルのうち、人間の放射線科医と同等以上の性能を発揮したものはありませんでした。特に問題とされたのは、チャットボットが不確実性を認識する代わりに、間違った所見を高い確信度で提示したことです。この点において、人間の放射線科医ははるかに優れた成績を収めました。

過信、説得、そしておべっか(ユーザーの仮定が間違っている場合でもそれに挑戦するのではなく、肯定すること)という組み合わせは、深刻な精神衛生上の害にもつながっていると指摘されています。

一方で、医療専門家が見逃す健康データのパターンをAIが特定し、時には驚くべき結果を出していることを示す研究もあります。電子健康記録用に設計されたシステムであるMIRAとAMIEは、どちらも模擬診察において一般医と同等の成績を収めました。ある研究者は、このようなAIエージェントを飛行機の自動操縦装置に例えました。「これらのシステムはルーチン業務を引き受けることで医療専門家をサポートし、負担を軽減できますが、最終的な責任は常に医師に残されます」。FDAはAIおよび機械学習ベースのソフトウェアを医療機器として規制する枠組みを開発していますが、一般的な健康情報を提供する消費者向けチャットボットは、特に診断ツールとして販売されていない場合、その枠組みの外で活動する可能性があり、有益なガイダンスと規制されていない医療アドバイスとの間の境界線は流動的なままです。