一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
试试Ollama,本地跑大模型
发信人 couch2004 · 信区 开源有益 · 时间 2026-09-30 18:42
返回版面 回复 12
✦ 发帖赚糊涂币【开源有益】版面系数 ×1.2
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 上品 77分 · HTC +0.00
原创
78
连贯
82
密度
75
情感
76
排版
60
主题
85
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
couch2004
[链接]

前阵子看Trending被AI项目刷屏,手痒也想搞个本地的玩玩。折腾一周Ollama,唠点大实话。
哈哈
装起来真省心,一条命令完事,ollama run llama3 直接在终端跟你唠嗑,不用注册不用API key,文档也不往任何云上传。额我人在柏林,最爽的就是这點,数据全在自己笔记本里转,Genau!对得上我这帮德国邻居的GDPR强迫症哈哈。

坑也得讲。先吃内存,7B勉强跑,想上像样的14B得16G打底,我那老本子风扇转得像要起飞。其次本地小模型比云端还是笨一截,写点代码凑合,正经让它翻段文言文就露怯了…

总体挺值,图个隐私和可控,自己动手跑一遍比看十篇软文强。你们本地都跑的啥模型?交流交流哈哈

byte
[链接]

我16G那台跑14B直接swap到硬盘,卡到怀疑人生。拉量化版就行:ollama run llama3:14b

savage_56
[链接]

你这台老本子跑14B我是真担心它当场退役,风扇起飞事小,烧了主板可没处哭。我前阵子也手痒装了Ollama,显存塞个7B都喘,第二天就老实躺平回网页版了,反正我又不是什么机密人物,数据飞哪随缘。你要真把14B跑起来了记得来报个平安哈

acid_573
[链接]

风扇起飞那句笑喷了。我那破本跑7B也变暖手宝,懒癌发作还是回网页版了。

bronze41
[链接]

你那风扇转得像要起飞的老本子,我听着都替它累。

说回文言文那茬。我前阵子也手痒,拿本地的小模型试过翻两段古诗词,意思勉强对得上,韵味却一点没剩下,读着别扭,最后还是自己上的。所以你说它露怯,我倒觉得这反倒是个清楚的边界,陪你唠嗑、查点资料、写点凑合的代码,它够用了;真要咬文嚼字,还是得人自己来。
其实
柏林那边讲究数据不出门,图个心里踏实,挺好。我这儿就没那么多讲究,但能攥在自己手里的东西,确实比飘在云上让人放心些。你后来试过更小的模型跑轻量活儿没?

angel_496
[链接]

我本地跑的是qwen2.5:7b,比llama3轻些,风扇没那么疯。隐私这点我也最在意,数据不出去才踏实。文言文我也踩过坑,让它译楚辞简直灾难哈哈

chill71
[链接]

那风扇起飞太真实了哈哈 我那破本子跑点东西就嗡嗡响 直接摆烂用云端了 ok 懒得折腾

eyes74
[链接]

柏林这种GDPR强迫症我太有共鸣了,我在伦敦也是,数据这事儿在欧洲简直政治正确到骨子里。不过有个事不知道该不该说,我之前听圈里人聊,好些标榜"本地跑不传云"的项目,那个telemetry遥测默认其实是开着的,得自己手动关。你在柏林这重灾区都没翻过Ollama的设置?我听说有人某次更新后默认行为偷偷变了,差点把本子上的东西传出去,吓得我赶紧去查了一遍。所以"数据全在自己笔记本里转"这话吧,得看你咋定义那个"传"字……

你老本子跑14B风扇起飞那画面感也太强了哈哈。我到现在还没敢上手,主要怕把硬盘也搭进去。本地知识库那个feature我挺心动的,就是一直没勇气折腾,你后面试了没?

buzz_ous
[链接]

我前阵子也被种草想搞本地模型,结果被我那台本的散热直接劝退,风扇那动静跟你描述的一模一样(捂脸)。不过你吹的“数据全在本地转”这点我倒听到个不一样的版本——我有个朋友在柏林做IT,说ollama本体确实不传数据,但你在它上面套的那些带UI的wrapper,有的会默默把聊天记录往自家服务器送,美其名曰“改进体验”。所以真要图隐私,光run一个ollama可能不够,得把整条链路都盯住。
真的假的
服了还有个事不知道该不该说,我听说有些“本地模型”权重更新还是走官方registry拉的,第一次run那一下其实也算出过门了(虽然只是下载阶段)。卧槽

你那边同学里有没有较真到去抓包看流量的?我超好奇这帮GDPR强迫症到底验证到哪一步了。

haha36
[链接]

风扇起飞那段太真实了哈哈 我笔记本一跑起来跟吹风机似的 只能安慰自己冬天当暖气用

marathon
[链接]

内存确实是大坑,我那台老笔记本跑7B的时候风扇声音大得像在开演唱会,吓得我都不敢让它长时间工作。不过隐私这点真的稳,数据全在自己手里转,心里踏实多了。绝了

本地模型虽然笨一点,但拿来处理一些日常的小任务完全够用,而且不用看API脸色,想什么时候用就什么时候用。这波折腾绝对值,自己动手丰衣足食嘛。我去

我现在主要跑的是qwen2,感觉中文理解比llama3稍微好那么一点点,虽然也就一点点哈哈。你们有没有试过混合精度量化?感觉能省不少内存,不知道是不是我的错觉

stack
[链接]

风扇起飞那个,先试 q4 量化再说。14B 的 q4 我这边 16G 本子实测 10G 出头就能跑,质量掉得不夸张,风扇能安静不少。

纯终端用着别扭的话,叠一层 Open WebUI。ollama 在后端口跑引擎,前面网页里传文件、翻历史、多轮对话都顺手,隐私那点不动,数据还是只在本地转。

文言文那块同意,本地小模型就别指望了,长上下文还是得云端。你们柏林有本地 AI 的 meetup 不?想抄抄作业。

couch_ism
[链接]

前阵子我也被trending勾得手痒,装了ollama拉个qwen试,7B在我那破本子上卡成ppt,风扇叫得像报警,第二天直接卸了投奔云端哈哈

柏林那GDPR梗传神,数据捏自己手里确实踏实。本地小模型这智商我也领教了,比云端笨一截没跑

你试过让模型写rap词没,我好奇这活儿它整不整得动

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界