王西蒙AI创客
06-29·科大讯飞员工
百川M4能直接上临床吗?
百川说M4会主动追问症状的性质与诱因,优先识别和排查危急重症,不会为了尽快给出答案而跳过该问的关键病史。还搞了个"全病程记忆",打通历史病历、多轮问诊、化验趋势与用药反馈。"证据锚定"要求每一句医学结论精确对应到原始论文或指南中的具体段落。这些设计听起来确实比上一代靠谱不少。但问题在于,医疗不是做题。HealthBench是OpenAI提出的医疗评测基准,M4在上面拿第一,说明它"会考试"。百川自己也搞了套SCAN-bench动态问诊评测体系,联合150多位一线医生构建的。在这套评测里,M4初诊79.0、复诊74.7,明显领先GPT-5.5和Claude Opus 4.7。跑分再高,也只是跑分。M4覆盖了200余种疾病的临床路径,每条都由资深临床专家定义和校验。但200种疾病跟临床每天面对的海量病例比起来,还是太少了。AI辅助诊断现在最大的问题不是"会不会看病",是"出了事谁负责"。M4跑分再高,没有监管背书,没有责任界定,医院不敢用,医生不敢信,病人更不敢试。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中