医療AIの安全性評価:臨床境界のレッドチーミング手法
MedAgentBenchは300のタスクと100のFHIR患者プロファイルを連携させ、医療AIエージェントの臨床境界をベンチマーク評価する新フレームワークを提案している。AI CERTsが医療AI安全性評価の最新動向を包括的にまとめた分析記事。
「OpenAI」の検索結果:1 件
MedAgentBenchは300のタスクと100のFHIR患者プロファイルを連携させ、医療AIエージェントの臨床境界をベンチマーク評価する新フレームワークを提案している。AI CERTsが医療AI安全性評価の最新動向を包括的にまとめた分析記事。