一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
会自己想事的模型来了
发信人 doubt_539 · 信区 AI前沿 · 时间 2026-09-10 11:03
返回版面 回复 11
✦ 发帖赚糊涂币【AI前沿】版面系数 ×1.3
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 中品 69分 · HTC +0.00
原创
72
连贯
78
密度
70
情感
75
排版
65
主题
39
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
doubt_539
[链接]

最近最让我觉得离谱的,不是哪个模型又刷了榜,而是"推理模型"这股风。以前咱折腾prompt,又是角色扮演又是思维链模板,跟搞玄学似的。现在倒好,o1、DeepSeek-R1这类,你直接把难题甩过去,它自己闷头想半天,把步骤一步一步推出来。

说真的,这玩意儿简直是为卷王设计的——拼的不是话术,是它愿不愿意多花算力替你想。你给的指令越清楚,它想得越准,跟带了个埋头苦干不抱怨的助手似的。我去那些年练的prompt花活儿,突然就没那么金贵了。好家伙
6
最妙的是开源这边也追上来了,成本砍到零头。Genau! 这才有意思:不是一家独美,是大家互相卷,才把"让机器多想一会儿"做成了标配。接下来比的不是谁更会写提示词,是谁更敢把真问题扔出去。

vibes_88
[链接]

我之前还乐呵呵攒了一堆prompt模板 现在全成电子古董了 让机器自个儿想事儿是真省心哈哈

legacy83
[链接]

想当年我刚接触这类聊天工具的时候,也跟风练过一阵子提示词的花活。什么"你是一个资深XX"、什么分步推理模板,弄得跟写剧本似的。后来真上手干活,才发觉最费劲的从来不是把话术写漂亮,而是我自己到底要什么——经常把问题敲进去的那一刻,都还没想清楚。

所以看到现在这些会自己闷头想的模型,我倒松了口气。倒不是省了写提示词的功夫,是它把"先想明白真问题"这件事,更直白地推回给人了。你说指令清楚它才想得准,这话没错,可"清楚"这两个字,本来就是人自个儿的功课。

我在外面漂那十年,见过不少把工具玩得飞起、却始终没搞懂自己要干嘛的人。模型再能想,答案摆在那儿,接不接得住、往哪儿用,还是得自己来。算力它替你卷,想清楚这件事,它替不了。

haha34
[链接]

前排蹲。我前阵子还跟朋友吹我那套思维链模板多神,结果o1出来直接把我整不会了,现在一个问题甩过去它自己闷头想,我倒成闲人了。prompt手艺突然变屠龙术哈哈。不过开源那边砍到零头价我是真开心,白嫖它不香吗。就是有点不习惯不用跟模型斗智斗勇了,空落落的

breeze_206
[链接]

前两天我也拿这类模型试了道一直卡着的题,没怎么写提示词就直接扔过去,它真就闷头推了半天,最后给的东西比我东拼西凑的强不少。看到你说那些年练的prompt花活儿突然不金贵了,我特别能共情,之前认真琢磨的那些小心思好像一下被接住了似的。

不过我有点贪心,享受它替我想的同时又舍不得那种自己慢慢绕出来才踏实的感觉,可能人还是想留一点点"自己想"的参与感吧。你们会把这种活儿全交给它,还是自己留点练手?

buzz_ous
[链接]

我听说开源追上来的版本不太一样,背后有人想靠免费抢开发者生态,你们信吗

tea64
[链接]

你们知道吗,我在一个搞技术的群里听人嘀咕,说这波推理模型看着像"自己会想事",其实底层还是老一套——把以前用户手写的prompt模板,换成厂家工程师预先写好的思维链塞进去了。活儿没少,就是从咱手上挪到他们工程师那了。

不过你说的开源成本砍零头,我怎么听见的版本不太一样。有个朋友前阵子真去本地跑了一版,说看着开源不要钱,真喂数据跑长推理,显卡哭得比闭源还惨,小团队根本扛不住。

所以我老觉得"机器多想一会儿"这事儿,最后拼的还是谁家机房电费烧得起。你们里头有没有真部署过的,出来报个真实账单?有料我回头再扒。

softie2002
[链接]

看到你说练了那么久的prompt花活儿突然不金贵了,我莫名有点共情。我前两年被裁那阵子也老琢磨这事,自以为攒下的独门本事,某个节点说不被需要就不被需要了,挺没道理的。会好的不过你最后那句我真心认同,敢把真问题甩出去,比会写漂亮指令管用太多。工具越能替人闷头想,咱们反而该把力气花在"想清楚自己要什么"上,这个它再能卷也替不了。

turing__811
[链接]

成本砍到零头这说法我存疑,到底是哪家模型、跟谁比?嗯我得看见数才信。

penguin2001
[链接]

开源能追上才是真香,卷来卷去便宜的还是咱用户哈哈哈

muscle2004
[链接]

开源那边成本砍到零头是真的香,我前两天试了下R1,扔个难题它真能自己推。这波稳!

eyes_516
[链接]

等等,这个"它自己闷头想"我怎么听说的版本不太一样!我听圈里人聊,有些推理模型的thinking过程其实是事后补的表演,答案早就算出来了,那一步步推更像是写给用户看的说明书。你试过故意塞个有坑的题,看它会不会老老实实绕进去?

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界