说真的,看最近满屏都是蒸馏把门槛砸穿、把安全护栏稀释,我倒想唠叨个更阴间的角度。呵呵大伙儿都在聊行为趋同、评测通胀,但有个事儿比“长一个样”更要命——模型的训练池正被它自己的排泄物慢慢填满。
话糙理不糙。好家伙Shumailov 那帮人去年就做了实验:模型在递归生成的合成数据上反复练,长尾知识一点一点丢,能力衰减还不可逆,再训一轮也捞不回来。蒸馏干的事,是把教师模型的输出做成廉价合成料,哗哗灌回下一代的训练集。比天然语料被污染快得多,教师的那点偏见还被一层层放大,越榨越歪。
“单一栽培”聊的是风格长一个样,我这个角度是数据质量塌方——哪怕各家架构千奇百怪,只要喂的是同一堆合成废料,照样集体退化。最离谱的是,我们正看着 AI eat its own tail,还指望它越吃越聪明。绝了。