图片作者:
图片作者:
图片作者:
图片作者:
觉得监控探头有时候很不给力?除了被损坏或正好进入拍摄盲区等某些特殊原因外,视频探头缺乏智能应用是一个很大的原因。通常,视频监控网络的图像内容分析需要人工实施观看、手动调阅。想象一下,一位办案者,对着十几、二十多台摄像机录像,海量的信息向他涌来,而人的精神注意力只能集中半个小时,这时,他该怎么办。
如何“拯救”这些被信息淹没的人,其中一个思路就是将视频图像文本化,公安部第三研究所所长胡传平说,现在人们处理视频的手段有限,处理文本手段却很多。如果有一种技术,能代替人智能阅读视频,并将其转化为计算机和人都看得懂的描述语言,那在办案时,只要搜索关键词,就有相应的图像推送出来,那将大大节约时间和劳动力,甚至可以通过个性化的定制,由系统自动推送你想要的视频。这,就是监控视频结构化描述技术(VSD)。
一个世界级的难题
如何让机器读懂视频中的含义并将之描述出来,这是一个世界难题,直到目前为止,并没有出现能代替人眼和人脑,完全“读懂”视频的技术。
要将视频描述出来,必须依赖图像处理技术、模式识别技术、语义理解技术等对视频数据进行多层次、多尺度的特征提取。视频首先传送到描述设备,类似人的大脑,机器在这里对内容进行分析理解,并产生多层次的结构化输出;接着对描述数据进行传输和存储,同时描述设备也输出一个原始视频供系统存储。视频经过描述设备后,由于编码不变,由此视频对相应内容的描述被系统保留,以方便调阅。
难点在于如何处理视频中纷杂的情况。胡传平说,现在的技术已经能读懂这样的画面:一间屋子中,一位红衣女子走进来,坐下打开电脑,她走到打印机前打印,她出门了。然而问题是,如果把这间单一的屋子扩大到一个网吧或餐厅,要机器描述多人的环境,就显得有些“力不从心”。
监控道路交通显神通
由于VSD对人多的环境还是会有些“眼盲”,选一个合适的工作场所先行突破尤为重要。公安部三所的研究团队发现,这项技术运用在监控道路交通上正能大显身手。原因有二:其一,道路交通需要描述的语言相对固定,只要说某某车型、车牌多少,什么颜色,通过某某路口时多少速度就可以了;其二,车的种类、颜色有限,而车牌识别技术已经是一项成熟的技术。
就这样,此项技术已在成都率先展开试点。有了它,交警们要了解信息,不用一直盯着屏幕,而只要用电脑自动分析一页页文本信息就可以了。对于办案警察来说,这项技术将大大解放他们的双眼。
研发平台类似“苹果”
VSD的应用范围当然不仅限于交通系统。为了解决复杂环境识别描述混乱这一困境,胡传平所在的公安部三所研发团队决定建设一个开放的研发平台,广揽天下英才共同攻关,有点类似“苹果”的APP商店。
举个简单的例子,有人做杯子的识别描述很有一套,当然做杯子识别的不只一家,公安部三所通过比较,确定哪个更好,并将其和其它的技术集成起来,形成能满足某一特定场景描述的完整的软件模块,供相关企业和用户使用。另外在平台上,该研究所也会发布一些需求信息,比如他们急需筷子的识别描述技术,就会引导平台有重点、有分工的进行研发。胡传平认为,这种开放平台的方式,能大大延伸研究所核心团队的智慧,有助于加快解决VSD这一世界级难题。
不难想象,有了杯子等识别描述技术,并将它们合在一块,就能有一家餐馆的视频结构化描述技术,以此类推,在不久的将来,就能将那些被视频监控海量信息淹没的人们解脱出来。本报记者沈湫莎
|
|
|