数据集 / 项目规格 / 病历采买 · 对话/脱敏/随访/六专科Benchmark
PROJ-EMR-BM · 病历文本 · Project pack 2026
病历类医疗数据采买与六专科Benchmark包
四层病历资产:真实医患多轮对话、脱敏门急诊/住院病历、纵向随访、六专科 Benchmark(皮肤/生殖男科/生殖妇科/内分泌/男科/临床营养,含 LLM+VLM)。强调真实场景、用户隔离与授权分层,区别于通用结构化 EMR 沟通资产。
沟通规模 约7.5万条Benchmark(×1.5 规划)
形态 多轮对话 + 脱敏EMR + 纵向随访 + LLM/VLM Benchmark
基线规模 约5万条Benchmark → ×1.5
附加 另含首期脱敏病历2万、对话1万、随访2千(均×1.5沟通)
为什么医疗大模型需要这一包
训练/评测问诊 Agent、病历摘要、中西医结构化与专科 VLM;Benchmark 与训练数据严格隔离,支撑 Medical Gate 与红线题库。
2026 前沿语境
医疗对话 Agent 与专科 VLM 评测正从「单轮 QA」转向「多轮问诊轨迹 + 风险红线 + 图文证据边界」;六专科 Benchmark 与纵向随访是 2026 年过关评测与幻觉抑制的主流组合。
规格要点(摘自采购/标注附件口径)
- 真实医患多轮对话:首期 10,000 条(沟通×1.5≈15,000)
- 脱敏病例:首期 20,000 例 / 完整目标 100,000 例(沟通首期×1.5≈30,000)
- 纵向随访:首期 2,000 例 / 完整目标 20,000 例(沟通首期×1.5≈3,000)
- 六专科 Benchmark:50,000 条(LLM 32,000 + VLM 18,000)→ 沟通约 75,000 条
- 专科分布含皮肤 VLM 7k、生殖/内分泌/男科等 LLM+VLM 配额、营养 VLM 3k
- 合格批次:字段完整、脱敏 100%、真实场景(禁 AI 拼凑)、用户级隔离
- 授权须区分诊疗/档案/AI 训练/公开展示;红线题 0 容忍
验收与许可提示
- 最终结算以验收合格的去重数量(例/人/条任务)为准,不以沟通规模直接结算。
- 脱敏、授权范围、再训练/再分发边界写入数据卡与合同;跨境需单独书面约定。
- 不得为凑量诱导检查、补造报告、AI 合成冒充真实病例或升级诊断;本站不构成医疗器械宣传。
LumeSage · 北京朗慧科技有限公司旗下业务。规模为规划沟通口径(附件基线 ×1.5),以双方确认的数据卡与合同为准。本包与站点存量专科 Study 包及主推 SKU 命名、计数口径均不同。