用模型生成数据再训练模型,成本低、速度快,却容易把评测集风格泄露进训练分布,分数虚高。
差旅笔记策略独立、干净的人类标注集仍然值钱。
晚间休息策略 团队应固定一条黄金评测集,禁止参与任何自动增强。
家庭流程常识发布报告时写明合成数据占比与清洗规则。
通勤检索策略高峰与极端情景各测一次,平时顺畅不等于关键时刻可用。
个人案例注意 合成数据是催化剂,不是真理来源。
书房拉伸注意离开真实反馈,优化会自我循环。
办公骑行要点 若资源有限,先加固最脆弱环节,再谈锦上添花的新功能或新叙事。
书房步骤禁忌 演练的价值,是慌乱时仍有肌肉记忆。供应商响应失败案例的态度,有时比功能列表更关键。