AIチャットボットの認知領域評価:ChatGPTとGeminiの解剖学教育における比較研究
カテゴリ:医学教育
公開日:2026年2月19日
タイトル:Cognitive Domain Assessment of Artificial Intelligence Chatbots: A Comparative Study Between ChatGPT and Gemini's Understanding of Anatomy Education
雑誌名:Med Sci Educ. 2025 Jun; 35(3): 1295-1304.
概 要:
本研究は、解剖学教育におけるAIチャットボットの統合が進む中、ChatGPT 4o miniとGeminiの応答を評価・比較することを目的としています。解剖学に関する質問を用い、知識、理解、応用の各認知領域に分類し、専門家によって作成された解答キーに基づいてスコアリングを行いました。結果、ChatGPT 4o miniは全体的なパフォーマンスで76.15%を記録し、Geminiの72.84%を上回りましたが、理解レベルの質問ではGeminiが76.88%でChatGPTを上回る結果となりました。
方 法:
本研究は横断研究で、解剖学に関する質問をManual on Competency-Based Undergraduate Curriculumから選定し、知識、理解、応用の各レベルに分類しました。ChatGPT 4o miniとGeminiの応答を専門家による解答キーと照らし合わせて評価し、関連する統計解析を実施しました。
結 果:
ChatGPT 4o miniは全体的なパフォーマンスで76.15%、Geminiは72.84%でした。応用レベルの質問ではChatGPTが優れていましたが、理解レベルの質問ではGeminiが高得点を記録しました。両チャットボットともに事実誤認や文脈における正確性の限界が見られ、特に応用レベルの質問で顕著でした。
結 論:
ChatGPT 4o miniとGeminiは解剖学教育における教育ツールとしての可能性を示していますが、認知領域によって強みと限界が異なります。AIチャットボットは従来の学習方法を補完することができますが、継続的な改良と検証が必要です。医療教育におけるAIの責任ある統合には、教員や学生のトレーニング、適切なIT環境の整備、倫理的問題への配慮が求められます。今後の研究では、質問プールの拡充やユーザーフィードバックの取り入れ、従来の教育アプローチとの比較が効果向上に寄与するでしょう。