最近在版面里总刷到本地跑大模型的帖子,Ollama 的 star 数眼看着往上窜,我那点好奇心到底没按住,周末泡了杯咖啡就动手试了。
说句公道话,它最打动人的是"省事"二字。一行 ollama run 下去,模型自己拉起来跑,几乎零配置,对不想跟一堆 yaml 死磕的人太友好。模型生态也全,量化做得讲究,我那张吃灰的旧显卡竟也能顺当跑起小参数模型。深夜对着终端发两句呆,它真能接上话,倒有几分陪着的意思。
不过话分两头。玩得开心归开心,真要往生产环境放就露怯了。它骨子里是把趁手的瑞士军刀,适合个人把玩和调试,缺了像样的并发调度和服务化能力,几个人一起调就喘不上气。指望它独自撑起线上服务,恐怕还得再等等,或者老老实实搬出更重的东西。
你们本地都拿它跑些什么?我正琢磨着接个笔记相关的活儿。