MEDICINE & AI

健康分野における選択肢問題レビューのためのツールとしてのChatGPT

カテゴリ:医学教育

公開日:2026年5月14日

タイトル:ChatGPT as a tool for reviewing multiple-choice questions in the health sector. 雑誌名:Sci Rep. 2026 May 13; doi: 10.1038/s41598-026-51988-9. 概 要: 本研究は、医療教育におけるAI、特にChatGPT-4の応用可能性を評価し、医療教員が作成した36の選択肢問題(MCQ)とChatGPT-4によってレビューされたバージョンの質を比較することを目的としています。外部の健康教育専門家10名と研究著者4名が、38の基準に基づいて問題を評価しました。外部評価者は両バージョン間に統計的に有意な差を見出さなかった一方で、研究著者はChatGPT-4によるレビュー版で満たされた基準の数が有意に増加したことを確認しました。結果として、ChatGPT-4は問題の構造的明確さと基本的な作成原則の遵守を反映する能力を示しましたが、臨床推論や高次思考の組み込みには苦労しました。 方 法: 本研究は横断的かつ定量的なアプローチを用いています。評価には、外部の健康教育専門家10名と内部評価者である研究著者4名が参加し、38の基準に基づいてMCQを評価しました。統計解析には記述統計、ウィルコクソン符号付き順位検定、非計量多次元尺度法が用いられました。 結 果: ChatGPT-4によるレビュー版は、構造的明確さと客観性が向上した問題を生成しました。研究著者は、ChatGPT-4によるレビューが基準を満たす数を有意に増加させたことを確認しました(p < 0.001)。一方、外部評価者は両バージョン間に有意差を見出しませんでした(p = 0.325)。 結 論: ChatGPT-4は、選択肢問題の質を向上させる可能性を示しましたが、臨床推論や高次思考の組み込みには限界がありました。AIの修正は教員の質基準に合致しており、教員の努力を補完する可能性があることが示されました。