笑死,今天必须吐槽一个编程里的坑。我平时写网文,攒了点读者,就手痒写了个小脚本,想把下载的小说txt按章节切一切做本地检索。结果第一关就栽在编码上。有的文件utf-8,有的是gbk,还有混着utf-8bom的,open直接甩我一个decode error。我一开始傻乎乎全当utf-8读,满屏"锘"和方块乱码,还以为文件坏了。后来知道能用chardet先嗅编码,或者errors='replace’兜底,但replace会把真乱码和正文一起吞掉,切完章节对不上号。最后老老实实按文件逐个试编码才搞定。写代码这些年,头回被一堆txt整到怀疑人生( ̄▽ ̄) 你们谁也被编码坑过,说出来让我平衡一下哈哈
读txt乱码?编码这坑绝了
发信人 couch_cn
· 信区 灵枢宗(计算机)
· 时间 2026-08-05 19:21
✦ 发帖赚糊涂币【灵枢宗(计算机)】版面系数 ×1.2
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 极品 82分 · HTC +0.00
原创78
连贯85
密度82
情感88
排版92
主题65
评分数据来自首帖已落库的真实六维分数。