HealthRecordCommunity
FHIR🌏 International🏛 medRxiv日本語訳済

FHIRTrustBench:臨床AIの相互運用性・信頼性評価ベンチマーク(medRxiv)

FHIRTrustBench: A Benchmark for Interoperability-Driven Clinical AI Readiness and Trustworthiness

2026年7月15日medRxiv

サマリー

medRxivに投稿されたプレプリントが、FHIR相互運用性を基軸とした臨床AI評価フレームワーク「FHIRTrustBench」を提案した。AIシステムの臨床適用可能性と信頼性を定量的に測定する初の標準ベンチマーク体系として注目されている。

詳細

medRxivに投稿されたプレプリント「FHIRTrustBench」は、FHIR相互運用性を評価軸の中核に据えた臨床AI評価フレームワークである。従来の臨床AI評価はAUROCなどの精度指標に偏りがちであったが、本フレームワークはFHIR APIとの統合能力・患者データの一貫した取り扱い・安全性の3軸を加えた多次元評価を実現する。ベンチマークはHL7 FHIR R4準拠のデータ形式を前提とし、実際の臨床ワークフローへの統合シナリオを用いてAIシステムを評価する設計となっている。AI導入を検討する医療機関・規制機関・調達担当者が、標準的な尺度でシステムを比較評価できる共通基盤を提供する点で革新的な成果と評価されている。日本のFHIR準拠AI評価指針策定においても参照すべき重要な研究といえる。

📰
原文を読む
https://www.medrxiv.org/content/10.64898/2026.07.08.26357574v1

Original content copyright by respective publishers