最近用推理模型干活,有个变化让我挺意外。以前的模型是快思考,你问一句它脱口就答,像嘴比脑子快的朋友。现在这代R1类的,会先在内部自己推几套方案,琢磨一下再开口,活像个会犹豫的顾问。
最让我后背发凉的是它开始自我纠错。有时候它先甩出一个结论,过几秒自己画个叉,说"等一下,这里逻辑有漏洞",然后把前面的推翻重来。一开始我以为出bug了,后来才懂这种"反悔"恰恰是靠谱的信号,它不再把不靠谱的答案说得特别自信。
顺带提示工程也得换打法。以前是下指令教它怎么做,现在更该给边界,告诉它想错时停下来问我,判断权别全交出去,自己手里留一半。
你们碰到过模型自己推翻自己的情况么?