🩺 健康相談でAIに一番求められるのは「正確さ」と「安全さ」。GPT-5は自傷・自殺に関する難しい会話で、望ましくない回答をGPT-4o比で52%も減らしました。
📰 タイトル: Improving health intelligence in ChatGPT
🔗 URL:
💡 概要
OpenAIが、ChatGPTの健康関連の応答能力を高める取り組みを公開しました。GPT-5を「これまでで最も健康の質問に強いモデル」と位置づけ、医師が定義した基準で評価するベンチマークHealthBenchで大きくスコアを伸ばしています。
🔍 解決する課題
健康の回答は誤りが利用者の安全に直結します。もっともらしい誤答(ハルシネーション)や緊急性の見落としは重大なリスクで、正確性・明確さ・適切な受診勧奨をどう担保するかが課題でした。
🛠 方法論と提案手法
・現実的なシナリオと医師定義の基準で採点するHealthBenchで評価
・難しい事例は2名以上の医師が検証するHealthBench Consensusを用意
・60か国で診療経験を持つ医師・心理職 約300名のGlobal Physician Networkを構築し安全性研究に反映
・アドバイザーが現実の利用を反映したモデル応答を70万件以上レビュー
📊 ユースケース / 実験結果
・自傷・自殺の困難な会話で望ましくない回答をGPT-4o比52%削減
・困難な会話のハルシネーションをo3からgpt-5-thinkingで8倍削減
・緊急性が高い状況での誤りをGPT-4o比50倍以上削減
症状や検査結果の理解、受診タイミングの判断、適切なフォローアップ勧奨など、自分の健康に主体的に向き合う支援に使えます。
#
ChatGPT# #
ヘルスケアAI#