ChatGPT for Clinicians リリース

OpenAIは、管理負担を軽減し、医学研究や文書作成などの臨床タスクを支援することを目的とした、プラットフォームの専門版であるChatGPT for Cliniciansを導入しました。このツールは現在、米国の認証済み医師、看護師プラクティショナー(NP)、医師助手(PA)、薬剤師に対して無料で利用可能です。

臨床機能とワークフロー統合

ChatGPT for Cliniciansは、医療ワークフロー向けに特別に設計されたツール群を提供しており、数百人の医師アドバイザーと協力して開発されました。

コア機能

  • Trusted Clinical Search: ケース推論を加速するため、数百万件の査読済み医療情報源からのエビデンスに基づくリアルタイムで引用付きの回答を提供します。
  • Deep Medical Research: 臨床医が文献レビューをAIに委任できるようにし、信頼できる情報源を指定して包括的で引用付きのレポートを受け取ることができます。
  • Repeatable Clinical Skills: 紹介状の作成、事前承認、患者への指示書などの一般的なワークフローを再利用可能なスキルに変換し、一貫した実行を可能にします。
  • Frontier Model Access: 複雑な臨床質問や文書作成をより信頼性高く処理できる、最新のフロンティアモデルへの無料アクセスを提供します。
  • CME Integration: プラットフォーム内で実施された対象となるエビデンスレビューは、継続医学教育(CME)クレジットとして自動的にカウントされます。

プライバシーとコンプライアンス

  • HIPAA Support: 多くのタスクは保護された健康情報(PHI)を必要としませんが、対象アカウントにはビジネスアソシエイト契約(BAA)を通じてHIPAAコンプライアンスが利用可能です。
  • Data Security: 会話はOpenAIのモデルの学習に使用されず、プラットフォームは機密作業を保護するために多要素認証を採用しています。

パフォーマンス評価と HealthBench Professional

安全性と正確性を確保するため、OpenAIは実際の臨床医チャットタスク(ケアコンサルト、執筆/文書作成、医学研究)に焦点を当てたオープンベンチマークであるHealthBench Professionalを開発しました。

検証指標

  • Physician Review: 医師アドバイザーはこれまでに70万件以上のモデル応答をレビューしています。ChatGPT for Cliniciansのリリース前に、アドバイザーは6,924件の会話をテストし、回答の99.6%を安全かつ正確と評価しました。
  • Citation Accuracy: 3人の独立した医師が指定した真実の引用を持つ355例のテストにおいて、ChatGPT for Cliniciansは人間の医師よりも頻繁にソースを引用しました。
  • Comparative Performance: HealthBench Professionalを使用した結果、OpenAIはChatGPT for Cliniciansワークスペース内のGPT-5.4が、ベースのGPT-5.4、他のOpenAIモデル、外部モデル、そして無制限の時間とウェブアクセスを与えられた人間の医師よりも優れていると報告しています。

ベンチマーク設計

HealthBench Professionalは医師が作成した会話と評価基準、複数段階の医師審査、厳格なデータフィルタリングを活用しています。例の約3分の1はモデルの失敗を見つけるための「レッドチーミング」試行を含み、測定のハードルを高く保つために最も難しい会話は3.5倍の係数で選択されています。

利用可能性とグローバル展開

現在、ChatGPT for Cliniciansの無料版は米国の認証済み医療提供者に限定されています。OpenAIは、他国や他のグループへのアクセス拡大を計画しており、米国外の認証済み臨床医を対象としたパイロットをBetter Evidence Networkと提携して、現地の規制に従って実施する予定です。

このリリースに合わせて、OpenAIはHealth Blueprintを公開し、米国医療システム内でのAIの責任ある統合に関する推奨事項を提供しています.

Sources