Parte prima
Come la video analisi intelligente sta cambiando sicurezza, indagini e libertà
Il tema è assai intrigante soprattutto per chi, come il sottoscritto, si è occupato di sicurezza in una grande azienda, molto grande. Una banca internazionale con problematiche molto particolari. Questa evoluzione consente ora cosa inimmaginabili solo sino a pochi anni fa. Questo in una azienda, pensate che salto qualitativo può fare per coloro che si occupano di sicurezza, antiterrorismo et similia per una nazione.
Entriamo dunque in questo argomento con progressione, per metabolizzarlo come merita.
Quando una telecamera ha iniziato a capire ciò che vede
Per oltre mezzo secolo le telecamere hanno svolto un ruolo sostanzialmente passivo. Osservavano ciò che accadeva davanti all’obiettivo, trasformavano la luce in immagini e le registravano su un supporto analogico prima e digitale poi. Se si verificava un furto, una rapina o un’aggressione, gli investigatori recuperavano le registrazioni e iniziavano un lungo lavoro di analisi, spesso fotogramma dopo fotogramma. La telecamera era un testimone silenzioso: vedeva tutto, ma non comprendeva nulla.
La rivoluzione della videosorveglianza non è iniziata con telecamere più nitide o con sensori capaci di registrare in 4K o in 8K. Questi progressi hanno certamente migliorato la qualità delle immagini, ma non ne hanno modificato la natura. Il vero salto tecnologico è avvenuto quando alle telecamere è stato affiancato un nuovo protagonista: l’intelligenza artificiale.
È in quel momento che nasce la video analisi intelligente.
Per la prima volta il sistema non si limita più ad acquisire immagini. Inizia ad analizzarle, classificarle, interpretarle e trasformarle in dati. La differenza è enorme. Una registrazione video tradizionale è costituita da milioni di pixel che cambiano continuamente nel tempo. Per un computer tradizionale quei pixel sono semplicemente numeri. Per un moderno algoritmo di deep learning, invece, rappresentano informazioni dalle quali è possibile estrarre significato.
In termini molto semplici, il software non “vede” come vede un essere umano. Scompone ogni fotogramma in una quantità enorme di caratteristiche matematiche. Analizza forme, proporzioni, contorni, contrasti, colori, velocità, direzioni di movimento e relazioni spaziali tra gli oggetti presenti nella scena. Successivamente confronta queste informazioni con modelli statistici costruiti durante la fase di addestramento delle reti neurali.
È proprio questo processo che consente al sistema di distinguere un’automobile da una motocicletta, un adulto da un bambino, un bagaglio da una bicicletta o una persona da un animale con percentuali di accuratezza che, nei sistemi più evoluti, raggiungono livelli impensabili soltanto pochi anni fa.
Come funziona davvero la video analisi intelligente
Quando sentiamo parlare di intelligenza artificiale applicata alla videosorveglianza immaginiamo spesso un software misterioso capace di “riconoscere” immediatamente una persona. La realtà è molto più affascinante e, soprattutto, molto più complessa.
Ogni secondo una telecamera ad alta definizione produce decine di immagini. Ognuna di esse viene elaborata quasi istantaneamente attraverso una sequenza di operazioni che avvengono in pochi millisecondi.
La prima fase è la rilevazione degli oggetti, definita in ambito tecnico object detection. L’algoritmo individua automaticamente tutto ciò che compare nella scena e delimita ogni elemento con un riquadro virtuale. Persone, automobili, motocicli, autobus, biciclette, animali e perfino oggetti apparentemente insignificanti vengono separati dallo sfondo e classificati.
Subentra quindi il tracking, cioè l’inseguimento digitale dell’oggetto. Il software assegna a ciascun soggetto un identificativo temporaneo e continua a seguirlo fotogramma dopo fotogramma, anche quando cambia direzione, velocità o distanza dalla telecamera. Non sta ancora cercando un nome. Sta costruendo una storia fatta di movimenti, tempi e relazioni.
Contemporaneamente vengono estratte decine o centinaia di caratteristiche descrittive. In informatica vengono chiamate feature. Alcune riguardano la geometria del corpo, altre la distribuzione dei colori degli indumenti, altre ancora il modo in cui il soggetto occupa lo spazio, la postura, la velocità del passo e la dinamica del movimento.
È importante comprendere un concetto fondamentale. L’intelligenza artificiale non ragiona come un investigatore. Non formula ipotesi, non trae conclusioni e non attribuisce responsabilità. Costruisce invece una rappresentazione matematica della scena estremamente più ricca di quanto possa fare un semplice filmato.
Da quel momento il video non è più soltanto un insieme di immagini. Diventa una gigantesca banca dati interrogabile.
Un investigatore non è più costretto a guardare centinaia di ore di registrazioni. Può chiedere al sistema, ad esempio, di individuare tutte le persone che indossavano una giacca rossa tra le 14 e le 16, oppure tutti i SUV bianchi transitati in una determinata area o ancora tutti coloro che sono entrati in una zona vietata senza uscirne entro un certo intervallo di tempo.
Questa è la vera rivoluzione. Non è la telecamera a essere diventata intelligente. È l’intero sistema che ha imparato a trasformare un flusso video in informazioni utilizzabili quasi in tempo reale.
Una rivoluzione che è già arrivata
Mentre l’opinione pubblica discute della possibilità di utilizzare o meno l’intelligenza artificiale nelle attività di sicurezza, la tecnologia è ormai una realtà consolidata in numerosi aeroporti internazionali, grandi stazioni ferroviarie, infrastrutture critiche, impianti industriali, porti, reti autostradali e importanti complessi commerciali.
Anche in Italia il dibattito si è acceso nelle ultime settimane a seguito delle proposte relative all’impiego di sistemi avanzati di analisi video e di riconoscimento biometrico da parte delle forze dell’ordine. Il confronto politico è acceso e coinvolge il Governo, le opposizioni, il Garante per la protezione dei dati personali e gli esperti di diritto europeo, soprattutto alla luce del nuovo quadro normativo introdotto dall’AI Act dell’Unione europea.
Il rischio, tuttavia, è che il confronto si concentri esclusivamente sulle parole “intelligenza artificiale” o “riconoscimento facciale”, trascurando il fatto che la video analisi moderna comprende un insieme molto più ampio di tecnologie. Ridurre tutto al riconoscimento del volto significa osservare soltanto una piccola parte di un sistema infinitamente più sofisticato.
Ed è proprio questo il punto da cui partiremo nella seconda parte dell’articolo. Scopriremo come oggi un individuo possa essere seguito attraverso decine di telecamere anche quando il suo volto non è perfettamente visibile, quali caratteristiche vengono realmente analizzate dagli algoritmi e perché il modo di camminare, la postura, la corporatura, l’abbigliamento e il comportamento possano diventare elementi preziosi per ricostruire gli spostamenti di un sospetto senza sostituire, in alcun modo, il giudizio dell’investigatore umano.
Piaciuto sino a qui? Domani leggerete cose che: “… io ne ho viste cose che voi umani non potreste immaginarvi”
Giulio Valerio Santini
Leggi anche:
https://www.nationaldailypress.it/author/giulio-valerio-santini
Le telecamere ci guardano e pensano prima parte
Nota di trasparenza
I link rimandano per vostra comodità a pagine relative a società affiliate. Qualora un lettore decidesse di effettuare un acquisto tramite tale collegamento, il giornale potrebbe ricevere una piccola commissione come affiliato, senza alcun costo aggiuntivo per l’utente. Grazie
AMAZON: https://amzn.to/4tU6brg
EBAY: https://ebay.us/pV4iYd

