Tiered inference — one GPU, four tiers
Tier 0 every frame YOLOWorld + ByteTrack ~30–50 ms Tier 1 triggered plate OCR · re-ID · Florence-2 on detection Tier 2 gated live VLM narration on scene change Tier 3 on demand heavy VLM deep-look · summary operator request
Computer vision platform
2026
Real Vision
Cameras that understand what they see. Real-time detection, multi-camera identity tracking, licence-plate recognition and vehicle damage baselining — narrated in language, running entirely on the client's own hardware.
~347
detection classes
4
model tiers, one GPU
7
safety event kinds
0
footage leaves site
