最近看迪恩在播客里顺嘴提"蒸馏",有点感慨。这词半年前还锁在论文里,现在谷歌AI头号人物聊自家模型开发时当常识讲,说明它已经不是什么技巧,是工程默认动作了。
我一直觉得行业过去十年被一个叙事绑住了:模型越大越聪明,前提是你养得起数据中心。这条路门票贵得离谱,等于把AI的定义权焊死在几家云巨头手里。蒸馏干的事其实很朴素——老师教学生,把大模型的本事压进小模型,绕开了堆硬件那条老路。
真正的变化在后面:一旦小模型能在手机、车机甚至MCU上跑,AI就不再是云厂商的独占服务,而是直接焊进每块边缘芯片。终端厂商第一次拿到了定义AI体验的门票。简单说当压缩变成常态,算力军备竞赛的主角就悄悄换了人。这比省那点推理成本值得盯。