Search

Tag: #vision-language20 results

商湯科技發布開源SenseNova U1系列模型

商湯科技發布開源SenseNova U1系列模型

商湯科技正式發布並開源日日新SenseNova U1系列原生理解生成統一模型。基於今年三月自主研發的NEO-unify架構,在單一模型架構上統一多模態理解、推理與生成。該模型將語言與視覺資訊作為統一複合體直接建模,實現高效協同,保留語義豐富度並維持像素級視覺保真度。

MARCH:多代理CT報告生成器

MARCH:多代理CT報告生成器

MARCH 是一個多代理框架,模擬放射科部門階層來生成精確的 3D CT 報告,解決 VLM 中的幻覺問題。它包含駐院醫師代理負責初稿、同儕代理負責修訂,以及主治醫師代理負責共識。於 RadGenome-ChestCT 資料集上超越 SOTA 在臨床忠實度和語言準確性。

ArXiv AIResearchApr 21#multi-agent#radiology#medical-ai
Page 1 of 2