这两周玩o1和DeepSeek-R1玩得有点上头。说真的,以前跟大模型打交道那套功夫,现在大部分都废了。
早些时候用模型,你得把提示词当论文写。示例得堆一堆,语气、格式、步骤全得规定死,稍微漏一句它就跑偏。现在这些推理模型把思维链直接吞进肚子里了,你不用再手把手教它怎么想。我就甩一句"帮我把这段烂代码重构一下,别改对外接口",它自己就拆任务、试错、回头检查,最后连测试用例都顺手写了。
最让我惊讶的是它真能跑通一整条工作流。嘿嘿前天丢给它一个数学推导的活儿,它中间自己发现假设有问题,推翻重来了一遍,我全程就看了眼进度条。这种自我纠错和验证,过去得靠人盯着才敢信。
所以我现在觉得,提示工程这门手艺正在变味。重点不再是"怎么把问题问漂亮",而是"到底要什么、边界划在哪"。人越来越像产品经理——定目标、划红线、最后验收。教书的活儿,模型自己揽走了。
不是
你们最近有用推理模型干过什么狠活吗,聊聊