Boundingbox

Boundingbox är den rektangulära ruta som en kameras videoanalys ritar runt ett objekt den upptäckt i bilden – ofta en människa eller ett fordon – för att förtydliga videoströmmen.

Bakom en boundingbox ligger maskininlärning: kameran analyserar videoströmmen, upptäcker objekt och klassificerar dem – i grunden som människa eller fordon – och samlar attributen som metadata i realtid. Boundingboxen visualiserar den detekteringen, men är samtidigt ett strukturerat dataobjekt som anger objektets position och storlek som koordinater och bär en klassetikett. På svenska motsvaras ordet av begränsningsruta, men i säkerhetsbranschen används i praktiken den engelska låneformen.

I branschstandarden ONVIF är boundingboxen en formellt definierad nod i scenbeskrivningen, vid sidan av objektets tyngdpunkt, och anges med fyra attribut: left, top, right och bottom. Serialiserad som ONVIF Scene Description-XML kan samma metadata tolkas av olika tillverkares system utan särskilda drivrutiner.

I praktiken färgkodas rutan ofta efter objekttyp – i Axis objektanalys får människor en röd box och fordon en blå – så att en operatör snabbt ser hur systemet tolkat det som rör sig i bild. På kameror med djupinlärning kan fordon delas vidare i lastbil, buss, bil, cykel och övrigt. Varje box har dessutom en detekteringspunkt, vid fötterna för en människa och i mitten för ett fordon, som avgör när objektet räknas som att det passerat en linje eller ett område. Tillsammans med objektets rörelsebana gör boundingboxen det möjligt att både upptäcka och spåra personer och fordon.

GDPR-Cookie-samtycke med Real Cookie Banner