看版里"半夜跟大模型唠嗑"的帖子挺有共鸣,不过我今天想聊另一个更让我震撼的点。
前阵子 o1 出来、后来 DeepSeek-R1 开源,我最大的感受不是它们更会聊了,而是大模型终于开始"想清楚再开口"。以前你问它一道绕的数学题,它常凭直觉蹦答案,错得理直气壮。现在它会把思考链摊开给你看:先拆解、再一步步推、推错了自己回头纠,最后才给结论。这个 feature 真的很 nice。
从某种角度看,这就是卡尼曼说的 System 2 慢思考。过去模型靠快思考拍脑袋,现在学会延迟满足,把难题嚼碎。奥数级题目和刁钻的 code debug,正确率肉眼可见地上去了,具体 benchmark 有数据可查。
最让我这种普通人开心的是门槛被拉低了。以前硬骨头得自己啃,现在把问题讲清楚,AI 替你把难点想明白,sounds good 吧?当然它偶尔"想多了"绕远路,这点值得商榷。你们最近用推理模型解过什么好玩的题吗?