跳到主要内容
PII CONTEXT LAB多模型隐私评测

训练方法对比 ·

同一基础模型,比较三种训练目标

正在核验结果


基础模型
1
训练配置
3
随机种子
3407
结果状态
正在载入结果

只使用作者公开数据

训练读取 CAPID 作者公开 train 的 2,107 条记录;评测读取公开 test 的 200 条记录和 Reddit 的 150 条记录。本项目不生成、不翻译、不改写,也不扩充样本。

用途公开切分记录数SHA-256
训练CAPID train2,1070c722cdca74379bcb6e3ae79b583b64ecf7467e018b8a26fb64eb3499ed9ffd8
同分布评测CAPID test2002ff1e3e0402299a93e71f5dc581ee5662f6c25b91ae7cdbea99e4144e10d52f9
域外复核CAPID Reddit150368b3a8c9ca78e72b9b3562ee5304a40c897610eba78e208fe4eadbfcffd2b59

只改变模型从哪些内容中学习

三种方法使用同一个 Llama 3.1 8B 基础模型、同一份公开训练集和相同训练预算。每种方法只保存本次微调产生的参数增量。

M0
让模型同时学习提示词和 JSON 答案
M1
只让模型学习 JSON 答案
M2
只学习 JSON 答案,并提高少数相关性标签的训练权重

这里先固定一个随机种子。这样可以尽快比较训练目标,但不能估计训练随机性。最终结论仍需三个随机种子的完整结果。

CAPID test · 200

主指标要求敏感文字、类别和问题相关性同时正确。辅助指标分别显示文字漏检、类别错误、相关性错误和 JSON 输出失败。

正在载入结果

训练配置联合 F1span F1span + type F1高相关召回低相关召回JSON 可解析率
M0正在载入结果
M1正在载入结果
M2正在载入结果

CAPID Reddit · 150

Reddit 结果用于观察同一训练配置离开 test 后是否保持一致。该结果单独报告,不与 test 混合。

正在载入结果

训练配置联合 F1span F1span + type F1高相关召回低相关召回JSON 可解析率
M0正在载入结果
M1正在载入结果
M2正在载入结果

单种子预览不是最终结论

  • seed 3407 只能给出一次训练结果,不能反映不同随机种子带来的波动。
  • CAPID 作者数据可以比较 CAPID 任务中的训练目标,但不能证明中文、医疗、法律或教育场景的效果。
  • 本页不报告显著性检验。最终三种子分析才会估计训练随机性,并进行预注册的配对比较。

打开机器可读状态