刚看BBC那篇,说现在新手鸟人全在拿类Shazam的App识鸟,挺有意思。但我觉得这玩意儿真正值得聊的不是识别本身,而是它本质上是一张去中心化的生物声学采集网。
手机端跑的是轻量声纹模型,音频指纹加轻量CNN那套,离线实时就能出结果,典型的边缘AI落地。关键在后面:你每点一次"这是什么鸟",就顺手贡献了一次带GPS标签的标注。这种众包规模直接把xeno-canto那种老牌学术库甩开几条街,模型越用越准,feedback loop特别干净。
好处也实在,野外监测成本被压到近乎为零。不过有个事得提:麦克风开着的时候它可不分鸟叫人叫,旁边的对话照样进库。数据权属和录音隐私这问题,迟早要爆。
感觉这路子只会越来越多,反正麦克风已经长在人身上了。