ChatGPTの科学的要約を臨床医と一般向けに簡素化する能力の評価
カテゴリ:医療現場の業務効率化
公開日:2026年2月19日
タイトル:Evaluating ChatGPT's ability to simplify scientific abstracts for clinicians and the public
雑誌名:Sci Rep. 2025 Sep 29; 15(1): 33466.
概 要:
本研究は、ChatGPTが科学的要約を一般向けおよび臨床医向けに簡素化する能力を評価しました。43の要約を対象に、10の質問を用いてChatGPTの簡素化能力を評価しました。要約は、理学療法、作業療法、看護の分野からの4人のレビューアによってGoogle Scholarから選ばれました。ChatGPTによる要約は2回行われ、異なる2人のレビューアによって独立して評価されました。Flesch Reading Easeスコアを計算し、さまざまな研究デザインにおける精度、明瞭性、一貫性の違いを分析しました。結果、31の論文でChatGPTの要約が元の要約よりも高いスコアを示し、可読性が有意に改善されました(p=0.005)。系統的レビューとメタアナリシスは一貫して高いスコアを得ましたが、臨床試験は低いスコアでした。ChatGPTは「幻覚の存在」と「専門用語の使用」において限界があり、10点中7点未満のスコアでした。レビューア間の評価の一致も確認されました。ChatGPTは臨床現場での知識の翻訳に有望ですが、幻覚や専門用語の傾向には注意が必要です。今後の研究が、医療コミュニケーションにおける信頼性と安全性を評価する必要があります。
方 法:
本研究は、43の科学的要約を対象とした評価研究です。要約は、理学療法、作業療法、看護の専門家による便利サンプルから選ばれました。ChatGPTによる要約は2回行われ、異なる2人のレビューアによって評価されました。Flesch Reading Easeスコアを用いて可読性を測定し、研究デザインごとの精度、明瞭性、一貫性の違いを分析しました。
結 果:
ChatGPTの要約は、43のうち31の論文で元の要約よりも高いFlesch Reading Easeスコアを示し、可読性が有意に改善されました(p=0.005)。系統的レビューとメタアナリシスは高いスコアを得た一方で、臨床試験は低いスコアでした。幻覚の存在と専門用語の使用においては限界があり、10点中7点未満のスコアでした。レビューア間の評価の一致も確認されました。
結 論:
ChatGPTは科学的研究を非専門家にとってよりアクセスしやすくする可能性を示しましたが、幻覚や専門用語の使用には注意が必要です。医療コミュニケーションにおける信頼性と安全性を評価するためのさらなる研究が求められます。