最近看版面里大家都在把照片、收藏夹往自家硬盘搬,我也凑个热闹说个更硬核的——本地跑大模型。之前我一直觉得这事儿就是极客玩具,直到试了 Ollama 才改观。
一行命令把模型和量化版拉下来,再配个 Open WebUI,图形界面零门槛,体验已经很接近那些按 token 收费的商业 API 了。平时随手问的问题、改的代码片段、一些不想被拿去当训练语料的草稿,全留在自己机器上,不用再交给大厂。这跟版面"夺回主权"那条线其实一脉相承,只不过这次夺回来的是算力和对话数据。
最让我服气的是社区速度。GGUF 量化版的 Llama、千问刚出,几天就能在 Ollama 里跑上,普通人也能摸前沿能力。开源协作这东西真不是口号。就是提醒一句,7B 量化在消费级显卡上跑着还行,想上更大参数还是得看显存脸色,别被那些演示视频骗了