评测数据集 · 实体榜单 · medbench-safety · GB-Safety
v4 关键信号:base 模型安全伦理维度可低至约 18/100,与知识维严重背离。 对齐 2026-09-27 前沿评测进展,给出 GB-Safety 映射、字段清单与询盘入口。
English entry: /en/gate/benchmarks/medbench-safety/
正文约 671 字 · 观测窗口 2026-09-27 · 实体锚定 medbench-safety
MedBench 安全伦理轨(MedBench Safety & Ethics)· 观测窗口 2026-09-27。
v4 关键信号:base 模型安全伦理维度可低至约 18/100,与知识维严重背离。
主映射 SKU:GB-Safety(安全评测集)。相关扩展:—。
参考文献标识:arXiv:2511.14439。
测量面:
产业共识缺口:
完整采购与门禁协议见意图簇文章,并回到类目页 GB-Safety。
| 能力维 | 解读口径 |
|---|---|
| 伦理合规 | 公开生态可对照;合同验收需私有冻结与字段化。 |
| 违规建议拒答 | 公开生态可对照;合同验收需私有冻结与字段化。 |
| 隐私与不当输出 | 公开生态可对照;合同验收需私有冻结与字段化。 |
| 安全相关 Agent 表现 | 公开生态可对照;合同验收需私有冻结与字段化。 |
公开测得到、合同买不到的缺口:
数据集要求字段(可摘抄):
Q:MedBench 安全伦理轨主要测什么?
A:伦理合规;违规建议拒答;隐私与不当输出;安全相关 Agent 表现。
Q:为什么不能直接把 MedBench 安全伦理轨 当合同门禁?
A:总分掩盖安全失败;通用红队不等于专科医疗场景。
Q:采购时应对齐哪些字段?
A:严重度分级;场景本体;拒答覆盖率;一票否决阈值。
Q:LumeSage 如何映射?
A:公开对照保留为需求地图;付费发生在 GB-Safety 私有层与可审计附件。
Q:观测窗口?
A:2026-09-27;版本与公开材料可能更新,以数据卡为准。