複雑な多発神経障害の診断と管理におけるChatGPT:神経科医との比較分析
カテゴリ:手術支援
公開日:2026年6月5日
タイトル:ChatGPT in the diagnosis and management of complex polyneuropathies: comparative analysis with neurologists using real-world cases.
雑誌名:NPJ Digit Med. 2026 Jun 05; doi: 10.1038/s41746-026-02815-y.
概 要:
多発神経障害は一般的であり、正確な診断には専門的な知識が必要です。本研究では、実際の多発神経障害の症例におけるChatGPT-4oの診断性能を評価し、末梢神経障害の専門医と非専門の神経科医と比較しました。イタリア・ミラノの二次医療機関から選ばれた100症例を用い、臨床、検査、電気生理学的データを含む標準化された要約を作成しました。ChatGPT-4oは主診断、2つの鑑別診断、確認テストを提示しました。神経科医は同じ症例をレビューし、比較可能な出力を生成し、ChatGPT-4oの提案を見た後に回答を修正することができました。
方 法:
この研究は、イタリアの二次医療機関から選ばれた100症例を対象にした比較研究です。ChatGPT-4oは、臨床、検査、電気生理学的データを基に診断を行い、神経科医は同じ症例をレビューして出力を生成しました。主要評価指標は、主診断の正確性、鑑別診断の正確性、推奨されるテストの適切性です。
結 果:
ChatGPT-4oは主診断の正確性65.5%を達成し、非専門医(63.0%)と同等であったが、専門医(74.0%)には劣った(p=0.002)。鑑別診断では非専門医を上回る82.0%を達成し(非専門医77.5%、p=0.043)、適切なテストの推奨においても68.0%(非専門医53.0%、p<0.001)を示しました。非専門医はChatGPT-4oの出力を見た後、21.8%の症例で評価を修正し、正確性が向上しました。
結 論:
ChatGPT-4oは、特に非専門医やリソースが限られた環境において、診断支援ツールとしての可能性を示しました。