数据集 / 项目规格 / 标准化病理 · IHC Panel 标注与评测
PROJ-PATH-IHC · 病理评测 · Project pack 2026
标准化病理标注与评测数据构建包
病理大模型评测与 SFT 质控包:约 204 条标注任务(SFT 诊断推理评估、最小充分 IHC panel、marker 诊断逻辑、模型辅助前后对比)+ 约 500 例高难度病例医师审核。面向病理基础模型上线前的专家评测与硬例回流,非整库 WSI 堆量。
沟通规模 约306条任务(×1.5 规划)
形态 结构化标注 + IHC panel + 诊断逻辑评测
基线规模 约204条任务 → ×1.5
附加 附加子集沟通规模:约750例(基线 500 例高难SFT审核 → ×1.5)
为什么医疗大模型需要这一包
用于病理 LLM/VLM 的 SFT 质量门禁、IHC 推荐策略评测与专家仲裁集;可与多器官 WSI 训练包解耦,单独支撑上线前 Medical Gate。
2026 前沿语境
病理基础模型进入「panel 充分性 + 推理可审计」阶段:最小充分 IHC 组合、LOCALISATION/诊断逻辑与模型辅助前后对照,是 2026 年病理 Agent/辅助诊断过关的核心评测轴,优于仅报告准确率的黑盒分数。
规格要点(摘自采购/标注附件口径)
- 任务一:约 60 条模型生成诊断推理文本的 SFT 评估
- 任务二:约 60 条最小充分 IHC panel 标注(模型性能评估)
- 任务三:约 60 条 IHC marker 诊断逻辑评估(与任务二同病例)
- 任务四:从任务二抽取约 24 条做模型辅助前后 IHC panel 对比
- 另:约 500 例高难度训练集病例由高年资病理医师审核
- 交付在需求方指定标注平台完成;术语/IHC marker 英中规范冻结
- 沟通规模×1.5:评测任务与高难审核条数分别放大,不以切片张数冒充
验收与许可提示
- 最终结算以验收合格的去重数量(例/人/条任务)为准,不以沟通规模直接结算。
- 脱敏、授权范围、再训练/再分发边界写入数据卡与合同;跨境需单独书面约定。
- 不得为凑量诱导检查、补造报告、AI 合成冒充真实病例或升级诊断;本站不构成医疗器械宣传。
LumeSage · 北京朗慧科技有限公司旗下业务。规模为规划沟通口径(附件基线 ×1.5),以双方确认的数据卡与合同为准。本包与站点存量专科 Study 包及主推 SKU 命名、计数口径均不同。