数据飞轮与合成数据

状态:🚧 占位待补齐
一句话定义:把线上反馈变成 可训练/可评测数据 ,形成「用 → 标 → 评 → 改(提示/检索/微调)」飞轮;合成数据加速冷启动。

大纲(待补齐)

  1. 飞轮环节与责任人
  2. 日志 → 黄金集 → 回归
  3. 合成数据:用途与污染风险
  4. 与 SFT / DPO / 偏好数据的衔接

已有相关文档(先读这些)

学习要点(补齐后应能回答)

  • 什么反馈值得进训练集,什么只配进评测集?
  • 合成数据何时会放大偏见?

参考资料(待补充)

-