MEDICINE & AI

医療教育におけるAIと専門家生成の形成的評価質問を比較するためのランダム化の利用

カテゴリ:医学教育

公開日:2026年5月10日

タイトル:Using randomization to compare AI and expert-generated formative assessment questions in medical education. 雑誌名:Med Educ Online. 2026 Dec 31; 31(1): 2671586. doi: 10.1080/10872981.2026.2671586. 概 要: 本研究は、医療教育におけるAI生成の質問と専門家生成の質問の比較を目的としています。AI生成の内容は教育分野で広く利用されていますが、その評価は困難です。本研究では、医学生のパフォーマンスと主観的評価を比較するためにランダム化を用い、AIと専門家生成の質問に対する学生の反応を調査しました。仮説として、両者にパフォーマンスや評価に差がないことを想定しました。 方 法: 単一施設でのランダム化研究を設計し、医学生参加者は4週間にわたり、毎日AI生成または専門家生成の質問を1問ずつ受け取りました。 結 果: 参加者はAI生成の質問と専門家生成の質問に対して類似した認識を示し(p=0.18)、正答率の分布に有意差はありませんでした。28日間の正答率の累積は両者で一貫していましたが、AI生成の質問の53%が「非常に簡単」または「簡単」と評価されたのに対し、専門家生成の質問は31%でした。 結 論: ランダム化は、AI生成の質問が専門家生成の質問とほぼ区別がつかないことを示す上で重要でした。AIと専門家生成の医療教育コンテンツを比較するための追加の評価方法が必要であることが示唆されました。