論文一覧へ

顎関節開放手術に関する臨床家向け質問への生成AIチャットボット5プラットフォームのガイドラインに基づく評価

押さえるべきポイント

1

40問に対する5プラットフォームの200回答を評価した。

2

明瞭性を除く指標にプラットフォーム間差があった(p<0.001)。事後比較はBonferroni補正を用いた。PerplexityのQAMAIは27.5±1.4、KendallのWは0.75で、出典項目除外後はClaude、Perplexity、Geminiが近づいた。

3

編集考察:Claude・Geminiの可読性は低く、FKGL中央値は22.7・26.1、FRESは−11.6・−7.5だった。文章の長さは各モデル内の得点を説明せず、情報品質の評価は臨床安全性の検証ではない。

研究を読み解く

原文抄録に基づく日本語要約。全文翻訳ではありません。

顎関節開放手術に関する40問を生成AIの5プラットフォームへ提示し、200回答の質と読みやすさをガイドラインに基づいて評価した。専門医2人による評価では、QAMAI総点はPerplexityが最も高かったが、出典提供の項目を除くと上位群の差は縮小した。GQSはClaude、総合評点はGeminiが最高で、すべての指標に最適な単一システムはなかった。著者らは情報の質を評価した結果であり、臨床的安全性や意思決定の評価ではないと明示する。編集考察:版・評価時点・質問条件に依存し、患者診療への利用には個々の回答の専門的確認が必要である。

診療との接点を考える

編集上の考察。個別の治療指示ではありません。

編集考察:AIの文章の流暢さ、出典、臨床内容を別々に評価する参考になるが、手術判断や患者説明を未確認の回答に委ねる根拠ではない。

限界と注意点

  • いずれのプラットフォームも全評価項目で最適ではなく、臨床使用前の専門家による確認が必要とされる。
  • 編集考察:原文のモデル名と評価日は報告内容として扱い、現在の性能順位や製品仕様を保証するものではない。

AIによる執筆と別工程の原文照合。歯科医師未監修。初版:2026-09-15、更新:2026-09-15。照合日:2026-09-15

原文・出典

Guideline-based evaluation of five generative artificial intelligence chatbot platforms for clinician-oriented questions on open temporomandibular joint surgery.

Gaş S, Sulukan E, Korkmaz B.

Journal of stomatology, oral and maxillofacial surgery

原著公開:(オンライン公開日)

出典確認:2026-09-15。診療分野:口腔外科(仮分類)

PubMed PMID 42685976 · DOI 10.1016/j.jormas.2026.102972

免責事項と情報の読み方