
智谱 GLM 复盘推理基建:AI 干不动活,卡在反馈不可归因
我做电力智能巡检那几年,最耗人的不是调模型,是查「这个结论到底错在哪一级」。 误报率调不下去的时候,团队的第一反应总是换模型、调阈值。真正卡住我们的其实是另一件事:系统只告诉我们「这个结论是错的」,从来没告诉我们这个结论是在哪一级判出来的。后来把每一级判定单独留痕,误报才终于有了改进方向。 ...

我做电力智能巡检那几年,最耗人的不是调模型,是查「这个结论到底错在哪一级」。 误报率调不下去的时候,团队的第一反应总是换模型、调阈值。真正卡住我们的其实是另一件事:系统只告诉我们「这个结论是错的」,从来没告诉我们这个结论是在哪一级判出来的。后来把每一级判定单独留痕,误报才终于有了改进方向。 ...