缉毒犬与毒品擦肩而过
一只搜查犬和它的训导员,是由两个物种组成的团队。狗能采集到搭档无法感知的气味。训导员则决定他们去哪里、停留多久,以及狗的哪种反应算作一次发现——即一次“判定”(call)。大多数研究根据结果,或根据品种、训练等固定特征来评价这些团队。很少有研究观察搜索过程中实际发生了什么。
在舒适的测试条件下,经过认证的团队得分往往超过90%。在更贴近现实的条件下,表现就会下降。而自从1911年普丰斯特(Pfungst)分析“聪明的汉斯”以来,人类无意中给出的暗示一直是人们的标准怀疑对象:训导员可能在不知不觉中引导着自己的狗。
摄像机下的109次搜索
加州大学圣迭戈分校的Stephan Kaufhold、Federico Rossano及其同事与一家专业训犬公司合作,于2025年春季和2026年春季在校园内组织了两场有评委打分的搜查活动。37支专业缉毒团队——来自警察、惩教机构和私人安保,大多使用比利时马林诺斯犬——每队搜索三个杂乱的区域:一个室外场地、一组三辆车和一个室内房间,每次搜索两到四分钟。
每个区域藏有两种真实毒品(甲基苯丙胺、可卡因或海洛因)和若干干扰物:热狗、奶酪、狗饼干、宠物食品,以及新旧钞票——用过的钞票上常带有毒品残留。训导员不知道任何东西藏在哪里,只知道恰好有两个目标。固定摄像机和计算机视觉软件以厘米级精度追踪狗和训导员,编码员记录下每一个手势、指令和狗的反应。

搜索是如何被记录的:三个环境中的目标(星形)和干扰物(方形),一次室内搜索中狗(蓝色)和训导员(红色)的追踪路径,以及从隐藏目标到判定的链条。——图1,Kaufhold、Terwilliger、Kefer & Rossano(2026),arXiv:2610.07129。
近在咫尺,却没有反应
结果令人清醒。训导员共作出157次判定,其中41%是错误的。各团队找到了218个目标中的92个,即42%,一半的搜索中至少有一次错误判定。表现差异巨大:五支团队在六个目标中一个都没找到,没有一支团队全部找到六个,而最好的团队在越过起跑线后7秒就判定了第一个目标。
最惊人的发现是这些发现究竟是在哪里丢失的。覆盖范围不是问题:狗曾进入92%的目标1米范围内。被遗漏的目标,中位数被经过了三次,总计约8秒——并不比最终被找到的目标少。训导员也没有忽视自己的狗:狗指示过的91个目标中,他们判定了89个。
损失发生在相遇的那一刻。如果把每次在1米范围内的经过视为一次测试,狗在17%的经过中对毒品做出了反应——约六次中有一次——而对干扰物的反应不到4%。因此,狗显然能区分毒品和干扰物;只是它们常常经过时毫无反应。只有4%的发现发生在第一次经过时。

狗在毒品附近做出反应的频率远高于在干扰物附近,但仍然只出现在少数经过中。——图4,Kaufhold、Terwilliger、Kefer & Rossano(2026),arXiv:2610.07129。
不见“聪明的汉斯”
在1590次没有反应的经过中,训导员在毒品附近和在干扰物附近的行为是一样的:指点、做手势、发出指令和行走的频率都相同。他们在错误判定之前做的手势甚至比在正确判定之前更少。在这里,没有任何迹象表明训导员在引导他们的狗——不过作者指出,更细微的信号,比如目光或牵引绳的松紧,并没有被测量,而且观看搜索的评委知道毒品藏在哪里。
真正改变行为的是另一样东西:时间。在最后30秒里,判定次数增加了两倍,无论对错,而且狗对干扰物做出反应的频率也大大提高。
问题在干扰物,而非团队
找到目标是一支团队相对稳定的特征。错误判定则不然:它们取决于具体的搜索和特定的物品——热狗引发了19次错误判定,用过的钞票引发了17次。团队的行进速度是搜索中唯一与成功相关的特征,且主要体现在同一团队内部;作者将其视为反映搜索进展的一个指标,而不是建议走得更快。马林诺斯犬以及习惯不拴绳工作的狗表现也更好;训导员的经验和认证资质则无法预测成功与否。
作者强调,这些数字并不是对现实世界中准确率的估计,而且37支团队是一个很小的样本。他们的解读是:狗决定是否做出反应,训导员决定在哪里嗅、嗅多久以及嗅多少次——成功属于这对搭档,而不属于其中任何一方。
