Cani antiesplosivo sotto lo standard: la colpa non è della certificazione

Quando un cane da esplosivo non raggiunge gli obiettivi di performance, la tentazione è imputarlo agli standard di certificazione. È una reazione comprensibile, e anche la più comoda: se lo standard è troppo alto, il problema sta fuori dal proprio controllo. Uno studio di validazione sul campo, condotto su più siti con metodo black box, ribalta questa prospettiva, e lo fa con dati che meritano attenzione da chiunque si occupi di formazione e certificazione delle unità cinofile.

Lo studio: metodo black box, più siti, un obiettivo preciso

Il metodo black box è una forma di validazione in cui l’unità viene testata su scenari costruiti da terzi, senza che il binomio conosca in anticipo la posizione del target, replicando quanto più possibile le condizioni di un impiego reale. Lo studio ha applicato questo metodo su più siti operativi, misurando le prestazioni di binomi antiesplosivo rispetto allo standard OSAC, lo standard sviluppato per armonizzare le pratiche di addestramento e certificazione nel settore forense.

Il dato aggregato è chiaro: i binomi analizzati hanno registrato un tasso medio di successo intorno all’80%, contro un obiettivo dichiarato del 90%. Un divario di dieci punti percentuali, che a prima vista sembrerebbe confermare il sospetto iniziale: lo standard è tarato troppo in alto.

Il vero fattore predittivo: le risorse, non lo standard

È qui che lo studio ribalta l’interpretazione più immediata. Il divario tra prestazione osservata e obiettivo dichiarato non si è dimostrato uniforme, e la variabile che meglio lo spiega non è la difficoltà dello standard in sé, ma le risorse di addestramento disponibili ai conduttori. I conduttori di ambito federale hanno reso sistematicamente meglio, e la ragione emersa è concreta: disponevano di strutture ampie e di una gamma completa di materiali di pratica. Risorse che i contractor privati e le agenzie di dimensioni più piccole, molto spesso, semplicemente non hanno a disposizione.

Tradotto in termini operativi: due binomi valutati con lo stesso standard non stanno competendo alla pari se uno dei due si è addestrato su una gamma ristretta di scenari e materiali, mentre l’altro ha avuto accesso a un ventaglio più ampio di condizioni di pratica. Il risultato non misura solo la capacità del cane e del conduttore. Misura anche, indirettamente, il budget e le infrastrutture dell’organizzazione che li ha formati.

Le criticità che riguardano chi progetta i test

Lo studio non si ferma alla diagnosi sulle risorse. Individua anche criticità metodologiche precise nei protocolli di test stessi, che chiamano in causa direttamente chi li progetta, non chi li supera o li fallisce.

La prima riguarda il realismo degli scenari: in alcuni test i pacchi bersaglio venivano presentati in scatole con i lembi semplicemente accostati, mentre nella realtà operativa un pacco sospetto è quasi sempre sigillato con nastro adesivo. Una differenza che sembra minore e che invece altera in modo concreto la diffusione dell’odore e, di conseguenza, la difficoltà reale del compito rispetto a quella percepita dal progettista del test.

La seconda è la contaminazione da odore di stoccaggio: i sussidi di addestramento conservati a lungo nello stesso ambiente assorbono un odore di fondo legato a quel luogo, e il cane può finire per associare la ricerca a quell’odore ambientale invece che al target reale. In fase di test, questo porta il cane a mancare materiale fresco che non porta con sé la stessa firma olfattiva di stoccaggio.

La terza è la necessità, non sempre rispettata, del doppio cieco: test in cui né il cane né il conduttore conoscono la posizione del target, unica condizione che permette di misurare la capacità reale del binomio senza il rischio, documentato in letteratura, che il conduttore trasmetta inconsapevolmente indizi al cane.

La voce dei conduttori, non solo i numeri

A completare il quadro, un secondo studio dello stesso gruppo di ricerca ha raccolto sistematicamente il feedback dei conduttori sulle pratiche di addestramento e sugli standard di test. Non è un dettaglio complementare: è la controparte qualitativa dei dati aggregati, ed è il canale attraverso cui i limiti strutturali appena descritti, scarsità di risorse, scenari poco realistici, contaminazione dei sussidi, emergono con il linguaggio di chi li vive ogni giorno sul campo, non solo come statistica.

Il nodo delle risorse è più profondo di quanto sembri

Vale la pena aggiungere un tassello che rafforza l’intero ragionamento. Costruire materiali di pratica realmente affidabili non è affatto scontato, nemmeno per i laboratori più attrezzati. Uno studio pubblicato nello stesso periodo, dedicato allo sviluppo di una pseudo sostanza per il fentanyl, ha mostrato che il solo composto chimico marker, per quanto identificato con precisione analitica, non è bastato a replicare in modo affidabile il profilo odoroso percepito dai cani. Se anche un gruppo di ricerca specializzato fatica a costruire un sussidio di addestramento pienamente equivalente al materiale reale, si capisce meglio quanto pesi, per un contractor o un’agenzia con risorse limitate, non poter accedere a una gamma completa e ben validata di materiali di pratica.

La sintesi della ricercatrice, e perché è un punto di governance

La sintesi della ricercatrice a capo del lavoro è diretta: il problema non è che gli standard siano troppo alti, ma che i conduttori non vengono supportati come dovrebbero. È una conclusione che sposta l’attenzione da dove cade più comodo, la revisione al ribasso degli standard, a dove serve davvero intervenire: l’allocazione delle risorse a monte della certificazione.

È un punto che tocca direttamente la governance delle unità cinofile. Uno standard uniforme applicato a organizzazioni con dotazioni radicalmente diverse non misura solo la competenza del binomio, misura anche una disuguaglianza strutturale nell’accesso alle risorse di addestramento. Per chi costruisce impianti di normazione e certificazione, il dato ha una conseguenza pratica precisa: uno standard serio non può limitarsi a fissare la soglia di prestazione attesa. Deve occuparsi anche di cosa serve, in termini di strutture e materiali, per rendere quella soglia raggiungibile in modo equo, indipendentemente dalle dimensioni dell’organizzazione che presenta il binomio.

La sintesi

Un cane che non raggiunge l’obiettivo di performance non è, quasi mai, la prova che lo standard sia sbagliato. È più spesso la prova che qualcosa a monte, le risorse, i materiali, il realismo dei test, non ha ricevuto l’attenzione che meritava. Prima di abbassare l’asticella, la domanda giusta da porsi è se a quell’asticella sia stato dato davvero un supporto adeguato per arrivarci.

Francesco Piliego
Canine Security Advisor
Referente Tecnico Schema FCC.PCS.1121 K9 Detection
Cum canibus in futuro

Riferimenti scientifici

Karpinsky, M., Browning, H., Quigley-McBride, A., Bunker, P., Chapman, W., Prada-Tiedemann, P.A., & DeGreeff, L.E. (2025). Explosive detection canines in the field: a multi-site black box validation study. Frontiers in Veterinary Science, 12, 1668317. https://doi.org/10.3389/fvets.2025.1668317

Sucher, K.R., Medrano, A.C., Quigley-McBride, A., Bunker, P., Karpinsky, M., Chapman, W., DeGreeff, L.E., & Prada-Tiedemann, P.A. (2026). Insights from the field: Evaluating handler feedback on training practices and standards on canine detection testing. Forensic Science International: Synergy, 13, 100717. https://doi.org/10.1016/j.fsisyn.2026.100717

Dargan, R., Hogan, K.A., Forte, L., Bosnich, J., Furton, K.G., & DeGreeff, L.E. (2026). Lessons from the development of a canine training aid mimic for the detection of fentanyl: Canines versus instruments. Forensic Science International, 384, 112911. https://doi.org/10.1016/j.forsciint.2026.112911

Il presente contributo ha finalità tecnica e divulgativa e riporta i risultati degli studi citati nei limiti in cui sono stati formulati dagli autori, senza estenderne la portata oltre le condizioni sperimentali descritte.

Torna in alto