Video Analysis领域的技术包括将视频转文字描述
发布时间
阅读量:
阅读量
本篇文章提交至极视角平台,相关链接为文章链接
此前已分别介绍了video analysis领域中的action recognition与temporal action detection两个方向。这两个方向主要涉及对视频中mid-level信息的解析,而近期我所关注的研究重点则转向了如何把握视频的高层语义(high-level)内容,其中video captioning便是该领域的关键研究方向之一。video captioning的任务是为视频生成对应的文本描述,其与image captioning(即为图片生成文字描述)存在相似之处,但视频内容还额外包含时间序列特征,因此在处理上更为复杂。截至目前为止,我尚未亲自进行过video captioning相关的实验操作,因此文中若存在不当之处,恳请各位予以指正。
数据库
以下将简要介绍近年来最为广泛使用的两个数据库。
- MSR-VTT数据集:此数据集源自ACM Multimedia 2016会议中由微软研究院提出的视频到文本(MSR-VTT)挑战任务,其访问链接为 MSR-VTT dataset 。该数据集共计包
全部评论 (0)
还没有任何评论哟~
