百川智能发布 Baichuan-M4:HealthBench 得分 68.6,幻觉率降至 3.3%
AI看病成为医患新包袱?补上「多轮追问」,通用AI才迈得过医疗关
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
百川智能推出医疗大模型 Baichuan-M4,HealthBench 综合得分提升至 68.6,Hard 任务 49.7,幻觉率降至 3.3%。在 HealthBench Professional 基础推理评测中得分 55.1,高于 GPT-5.5 的 51.8;长上下文临床记忆得分 86.9,较 M3 提升 21.1 分。该模型已落地 C 端产品百小医,支持多轮追问与全病程记忆。
来源:量子位 · 微信公众号 · mp.weixin.qq.com