Search

Tag: #evaluation51 results

健康AI基準有效性差距揭露

健康AI基準有效性差距揭露

研究人員分析六個基準中18,707個消費者健康查詢,揭露與臨床需求不符的「有效性差距」。基準缺乏複雜診斷如實驗室值(5.2%)和影像(3.8%)、安全關鍵情境(<0.7%),以及弱勢族群代表性(<11%)。他們呼籲採用類似臨床試驗的標準化查詢剖析。

ArXiv AIResearchMar 21#health-ai#benchmarks#evaluation
Page 4 of 6