中文医疗大模型评测基准迭代!MedBench 5.0 升级,筑牢医疗 AI 安全底线
AI 概述
上海人工智能实验室联合多家机构、顶尖院士团队完成中文医疗大模型评测基准MedBench 5.0更新。该基准为国内首个原生医疗垂直评测体系,本次升级搭建专科化评测体系,推出医疗原子技能评测范式,能够识别并改善大模型幻觉,减少AI误诊。MedBench也是上海官方指定的医疗AI前置评测载体,将助力规范行业发展,推动中文医疗大模型落地临床。

医疗人工智能行业持续深耕细分赛道,朝着专科落地、安全可控两大方向快速发展。近日,上海人工智能实验室对外公布,中文医疗大模型评测基准 MedBench 完成 5.0 版本全面更新。
本次版本升级集结国内医疗 AI 领域优质科研资源。项目由上海人工智能实验室牵头,携手广州实验室、广医一院钟南山院士团队、复旦中山医院葛均波院士团队联合共建,汇聚临床顶尖专家与人工智能科研力量协同攻关。
相较于旧版本,MedBench 5.0 实现多项关键性创新。平台搭建专科化评测体系,创新推出医疗原子技能评测范式,可以全方位识别、修正大模型幻觉问题,从评测层面降低 AI 误诊风险,夯实医疗人工智能安全屏障。
据了解,MedBench 是国内首个原生医疗垂直评测体系,同时被上海市委网信办、上海市卫健委选定为医疗 AI 应用前置技术评测载体。依托标准化评测能力,该基准持续引导行业规范发展,推动高质量中文医疗大模型落地临床场景。
以上关于中文医疗大模型评测基准迭代!MedBench 5.0 升级,筑牢医疗 AI 安全底线的文章就介绍到这了,更多相关内容请搜索码云笔记以前的文章或继续浏览下面的相关文章,希望大家以后多多支持码云笔记。
声明:本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如若内容造成侵权/违法违规/事实不符,请将相关资料发送至 admin@mybj123.com 进行投诉反馈,一经查实,立即处理!
重要:如软件存在付费、会员、充值等,均属软件开发者或所属公司行为,与本站无关,网友需自行判断
码云笔记 » 中文医疗大模型评测基准迭代!MedBench 5.0 升级,筑牢医疗 AI 安全底线
如若内容造成侵权/违法违规/事实不符,请将相关资料发送至 admin@mybj123.com 进行投诉反馈,一经查实,立即处理!
重要:如软件存在付费、会员、充值等,均属软件开发者或所属公司行为,与本站无关,网友需自行判断
码云笔记 » 中文医疗大模型评测基准迭代!MedBench 5.0 升级,筑牢医疗 AI 安全底线
微信
支付宝