详细信息

一种多模态信息融合的视频检索模型    

Video retrieval model based on multimodal information fusion

文献类型:期刊文献

中文题名:一种多模态信息融合的视频检索模型

英文题名:Video retrieval model based on multimodal information fusion

作者:张静[1];俞辉[2]

机构:[1]华东理工大学计算机科学与工程系,上海200237;[2]复旦大学计算机科学与工程系,上海200433

年份:2008

卷号:28

期号:1

起止页码:199

中文期刊名:计算机应用

外文期刊名:journal of Computer Applications

收录:CSTPCD;;北大核心:【北大核心2004】;CSCD:【CSCD2011_2012】;

基金:国家自然科学基金资助项目(60533100)

语种:中文

中文关键词:TRECVID;视频检索;多模态信息融合;关系代数表达式

外文关键词:TRECVID; video retrieval; multimodal information fusion; relation algebra expression

摘要:针对包含复杂语义信息的视频检索的需要,提出了一种基于关系代数的多模态信息融合视频检索模型,该模型充分利用视频包含的文本、图像、高层语义概念等多模态特征,构造了对应于多个视频特征的查询模块,并创新地使用关系代数表达式对查询得到的多模态信息进行融合。实验表明,该模型能够充分发挥多模型视频检索及基于关系代数表达式的融合策略在复杂语义视频检索中的优势,得到较好的查询结果。
In allusion to the complex requirement of query, a new video retrieval model based on multimodal information fusion was brought forward in this paper. It included multi-models like text retrieval, image query, semantic features extraction, and used relational algebra expression to fuse these multimodal information. Experimental results demonstrate that our method could fully utilize the advantages of muhimodal information fusion based on relational expression in video retrieval, and achieve good performance on complex semantic video retrieval.

参考文献:

正在载入数据...

版权所有©华东理工大学 重庆维普资讯有限公司 渝B2-20050021-7 
渝公网安备 50019002500408号 违法和不良信息举报中心