据上海人工智能实验室消息,中文医疗大模型评测基准 MedBench 近日完成 5.0 版本升级。新版由上海人工智能实验室联合广州实验室、广州医科大学附属第一医院钟南山院士团队、复旦大学附属中山医院葛均波院士团队共同构建,重点完善专科化评测体系,并提出医疗原子技能评测范式,用于对 AI 模型幻觉进行多维度校正。MedBench 是国内首个原生医疗垂直评测体系,也是上海市委网信办和上海市卫健委指定的前置医疗 AI 应用技术评测载体。
据上海人工智能实验室消息,中文医疗大模型评测基准 MedBench 近日完成 5.0 版本升级。新版由上海人工智能实验室联合广州实验室、广州医科大学附属第一医院钟南山院士团队、复旦大学附属中山医院葛均波院士团队共同构建,重点完善专科化评测体系,并提出医疗原子技能评测范式,用于对 AI 模型幻觉进行多维度校正。MedBench 是国内首个原生医疗垂直评测体系,也是上海市委网信办和上海市卫健委指定的前置医疗 AI 应用技术评测载体。