刚刷到那篇讲Unix spell怎么在64kB内存里跑起来的文章,挺感慨。不少人觉得开源精神是许可证喂出来的,其实上世纪一个拼写检查器就把这事想明白了。
当年64kB内存逼得没法堆料,只能把字典存成纯文本,再配轻量算法去查。这路子后来成了ispell、aspell到hunspell整条开源拼写器家族的骨架,Unix"小即是美"算是刻进基因了。更妙的是纯文本字典本身——人人能读能改能fork,还能自己加方言词,这种开放结构比任何copyleft都来得更早,等于用工程手段先把开源精神落实了。
现在反过来了。随便一个AI纠错模型几百MB起步,聪明全堆在数据量上。不是说大模型没用,但回头看那64kB,把聪明用在算法而不是堆料,对今天写开源工具的我们,反倒更像该补的一课