最近试了几个新出的推理模型,有点恍惚。以前丢一个问题过去,答案秒回…,像抢答选手;现在它会先沉默几秒,然后摊出一大段思维过程,一步一步推,推到一半还会自己推翻自己重来。
这让我想起那句"两句三年得,一吟双泪流"。原来好东西都是磨出来的,连机器都懂这个道理了。
我觉得风向要变了。前些年大家热衷研究提示词,琢磨怎么把话说得漂亮、问得刁钻,仿佛咒语念对了魔法就灵。可现在模型自己会反思、会纠错,你堆砌再多关键词,不如给它留足思考的空间。真正稀缺的,反倒是我们这边的能力——它洋洋洒洒推了几百步,你看得懂哪一步是巧思,哪一步是暗藏的错误吗?话说回来
从"会问"到"会验",大概就是接下来要修的功课。我们不再是对AI发号施令的人,而是坐在它旁边审卷子的人。说真的,审一份逻辑绵长的卷子,比出题难多了,我最近常常被它绕进去,甘拜下风……