突発性難聴における人間の医師とAI(ChatGPT)の治療方針決定の比較評価
Human versus AI in audiological practice: A comparative evaluation of ChatGPT and physician treatment decisions in idiopathic sudden sensorineural hearing loss
突発性難聴(ISSNHL)の治療方針決定において、医師(MD)とAI(ChatGPT、GPT-4oモデル)の推奨を比較評価した研究。86名のISSNHL患者のデータを後方視的に分析し、匿名化された患者データと一連のプロンプトを用いてChatGPTの治療決定を医師の決定と比較した。結果として、AIと医師の治療方針決定の間には、全体的に低いから中程度の合意しか見られなかった。特に経口ステロイドの使用において、医師が処方した26例でChatGPTは推奨せず(Kappa = 0.029)、逆に医師が使用しなかった20例でChatGPTは静脈内ステロイドを推奨した(Kappa = 0.393)。鼓室内ステロイド(Kappa = -0.044)や補助療法(Kappa = 0.035)でも乖離が見られた。これはAIが一般的な治療プロトコルに厳格に従い、文脈理解が限定的であることに起因すると考えられる。結論として、ChatGPTは構造化されたプロトコル主導の提案生成に可能性を示すものの、ISSNHLに対する臨床的意思決定能力は経験豊富な医師に劣り、個別化された推論や文脈感受性の欠如が頻繁な不一致をもたらした。AIは現時点では支援ツールとして捉えるべきである。
本記事はAI(ChatGPT)と医師の治療方針決定を比較した学術研究である。突発性難聴という限定的な領域での評価であり、AIの臨床応用の課題を示すデータとして意義があるが、特定の企業や製品の業績に直結する投資的事象ではない。AIの医療応用における限界を定量的に示した点は長期的な技術動向として参考になるが、短期的な投資判断に資する具体的な事象ではないため、投資家視点での注目度は低い。