日本語

モデル発表ハーバード大学o1

Harvard大学、OpenAI o1が救急トリアージ診断で医師を上回ったと発表

Harvard大学は、OpenAIの推論モデルo1が救急トリアージ診断で医師を上回ったとする研究結果をScience誌に発表しました。独立した専門家らは、この結果はAIの臨床推論において「真の前進」を示すものだと述べています。

研究チームは、ボストン病院の救急外来を訪れた76名の患者を対象に実験を行いました。AIと2名の医師が、バイタルサインや人口統計情報などを含む標準的な電子健康記録を同じ条件で参照しました。その結果、o1は67%の症例で正確または極めて近い診断を下しました。一方、医師は50〜55%にとどまりました。

情報量が少なく迅速な判断が求められるトリアージ場面では、AIの優位性が特に顕著でした。詳細なデータが揃った場合、o1の精度は82%に上昇します。医師の70〜79%と比較して差は統計的に有意ではありませんでしたが、依然として高水準でした。

長期治療計画の作成においても、o1は46名の医師より優れていたと報告されています。5つの臨床症例について、o1は89%のスコアを獲得しました。検索エンジンなど従来のリソースを用いた医師は34%でした。

ただし、研究責任者のArjun Manrai氏らは、AIが医師を完全に置き換えるものではないとしています。本研究はテキストで伝達可能な患者データのみを対象としており、苦痛の程度や外見といった視覚的シグナルの評価は含まれていませんでした。Manrai氏は、AIが「第二の意見」を提供する臨床医のような役割を果たしていると説明しています。

もう一人の責任者であるAdam Rodman氏は、今後10年間でAIは医師と患者と共に働く「三位一体のケアモデル」を形成すると述べています。研究では、肺血栓塞栓症の患者において、医師が見落とした狼瘡との関連性をAIが正しく特定した事例も紹介されています。


出典: OpenAI’s o1 correctly diagnosed 67% of ER patients vs. 50-55% by triage doctors(HN 507pt・473コメント)(HN Search (backfill)、2026-05-03)