皮膚科診療におけるChatGPTとDeepSeek:人工知能モデルは乾癬治療ガイドラインに従っているか?
カテゴリ:医療現場の業務効率化
公開日:2026年2月19日
タイトル:ChatGPT and DeepSeek in Dermatologic Practice: Do Artificial Intelligence Models Adhere to Psoriasis Treatment Guidelines?
雑誌名:J Drugs Dermatol. 2026 Feb 01; 25(2): 133-139. doi: 10.36849/JDD.9482.
概 要:
本研究は、皮膚科における人工知能(AI)、特に大規模言語モデル(LLM)のChatGPTとDeepSeekが、アメリカ皮膚科学会(AAD)が発行した乾癬治療ガイドラインにどの程度一致しているかを評価することを目的としています。31のガイドラインに基づく質問を作成し、両モデルに提示しました。専門医による評価を通じて、モデルの応答がガイドラインに従っているかどうかを確認しました。
方 法:
2021年のAAD-NPFガイドラインに基づき、31の質問を作成し、ChatGPT-4とDeepSeekに提示しました。応答は、モデルの出所を知らない2人の認定皮膚科医によって評価され、ガイドラインとの一致度が判断されました。意見の不一致は第三者によって解決され、コンコーダンス率は推奨の強さに応じて計算され、モデル間の一致度はCohenのカッパ係数を用いて評価されました。
結 果:
ChatGPTとDeepSeekは、全体で87.1%の一致率を示しました。両モデルは強い推奨に完全に一致しましたが、ChatGPTは中程度の推奨に対してより高い一致率(87.5%対81.3%)を示し、DeepSeekは限られた推奨においてChatGPTを上回りました(66.7%対33.3%)。モデル間の一致度は中程度(κ = 0.43)でした。
結 論:
ChatGPTとDeepSeekは、エビデンスに基づく皮膚科ケアにおいて一定の一致を示しましたが、特に限られたエビデンスの場合には不一致が見られ、臨床的監視の必要性が強調されました。AIは乾癬管理において有用な補助ツールとなる可能性がありますが、その安全な統合には慎重な検証と文脈に応じた適用が求められます。