重要なケア教育へのアクセス向上のためのAI機械翻訳ツールの体系的マルチモーダル評価
カテゴリ:医学教育
公開日:2026年2月19日
タイトル:A systematic multimodal assessment of AI machine translation tools for enhancing access to critical care education internationally
雑誌名:BMC Med Educ. 2025 Jul 08; 25(1): 1022. doi: 10.1186/s12909-025-07452-9. Epub 2025 Jul 08.
概 要:
言語の壁は、世界中で重要なケア教育へのアクセスを拡大する上で大きな障害となっています。本研究では、機械翻訳(MT)が重要なケアコンテンツへのアクセスを向上させる可能性を探求し、AIフレームワークと大規模言語モデルを用いた最新の進展を考慮しました。選定した4つの無料MTツール(DeepL、Google Gemini、Google Translate、Microsoft CoPilot)を使用し、専門の医療翻訳者による人間翻訳と比較しながら、翻訳の評価方法を開発しました。
方 法:
国際的な重要なケア教育プログラムの一環として使用されるコンテンツの翻訳を評価するために、マルチモーダルな方法を開発しました。選定したMTツールを用いて、中国語(普通話)、スペイン語、ウクライナ語に選ばれたフレーズや段落を翻訳しました。翻訳は、1) バイリンガル臨床医による盲目的評価(流暢さ、適切さ、意味の3つのドメイン)、2) 自動化されたBLEUスコア、3) システムの使いやすさを評価するための検証済みのシステム使用性スケールを用いて比較しました。
結 果:
盲目的評価では、人間翻訳(中国語)、Google Gemini(スペイン語)、Microsoft CoPilot(ウクライナ語)が最高得点を獲得しました。Microsoft CoPilot(中国語)およびGoogle Translate(スペイン語とウクライナ語)は最低得点でした。中国語とスペイン語のすべてのバージョンは「理解可能から良好」または「高品質」のBLEUスコアを受けましたが、ウクライナ語は全体的に「要点をつかむのが難しい」と評価されました。使いやすさスコアは、DeepL(中国語)、Google Gemini(スペイン語)、Google Translate(ウクライナ語)が最高で、Microsoft CoPilot(中国語とウクライナ語)およびGoogle Translate(スペイン語)が低得点でした。
結 論:
いずれのMTツールもすべての指標と言語で最良のパフォーマンスを示さなかったため、教育活動中にこれらのツールを定期的に評価する重要性が強調されました。医療教育者が国際教育プログラムでMTを活用する際の評価を支援するためのマルチモーダル評価方法論を提供します。