闭环怎么跑
这套机制不是简单“生成一篇看一篇”,而是先拿历史报告标题当题目,再让系统召回对应的原文证据,生成后逐项核对标题、结构、关键内容、数字、逻辑和引用来源。只要发现偏题、乱编、结构漂移或过度照搬,就把问题记下来,调下一轮的召回和写法,继续跑,直到连续 5 篇都稳住。调优结论会写回生成系统,下一次写报告时自动沿用,不是停在测试页里看热闹。
1. 取题目从历史报告标题里挑样本,保证测试题目本身就来自真实文档。
2. 找证据按题目去召回相关文档、章节和实体,尽量让生成先站在原文边上。
3. 生成后核对把新报告和原始内容比对,检查是否出现漏写、乱写、结构走样或自相矛盾。
4. 再调优根据问题改召回范围、章节对齐、事实约束和复制风险控制,然后进入下一轮。
把“报告撰写”变成可持续回归测试
系统会用历史文档标题作为题目,调用现有报告生成链路,再与原始文档的标题、结构、实体、数值、逻辑结论和召回来源做对比。出现偏题、结构漂移、召回不足、幻觉或逻辑冲突时,自动给出下一轮召回和生成策略,而且这些结论会写回报告生成系统,后续正式写报告时自动生效。我们的目标不是机械照抄,也不是放飞乱写,而是在“太像原文”和“和原文冲突”之间找到稳定的中间点。
0样本总数
0当前任务
0.00平均分
0.00平均提升
任务状态
暂无任务,先从左侧开始一次小批量闭环。
等待任务开始。
调优记录
正在读取最近闭环和全局调优状态。