基于物体检测及关系推理的视觉问答方法研究

来源 :测试技术学报 | 被引量 : 0次 | 上传用户:chuai09
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
大多数图像描述及视觉问答任务中,主要工作是对图像数据的拟合分类,而缺乏图像中物体之间的关系推理,导致描述图像或回答问题时准确率不高.为解决该问题,本文提出一种基于物体检测及关系推理的视觉问答模型.该模型由上游网络和下游网络两部分组成,上游网络采用极快速区域卷积神经网络,下游网络由多层感知机组成的多模态特征融合推理网络构成.上游网络对图像进行物体检测与特征提取,利用长短期记忆网络对提问的问题进行信息提取以嵌入下游网络;下游网络对问题和图像的特征进行融合和推理,进而得出答案.采用数据集CLEVR进行模型
其他文献
改革开放初期,我国"三资"企业迅速发展,是"三资"企业劳资关系的形成时期。为改善"三资"企业劳资关系,调节"三资"企业劳动问题,国家非常重视对"三资"企业的劳动立法和劳动人事
兰坪县易地扶贫搬迁工作已进入到后续扶持阶段,虽然已实现"搬得出",但如何"稳得住、能致富"才是脱贫致富的关键所在。以可持续生计理论为依据,从五个方面研究兰坪县易地扶贫
报送重要紧急信息,中央办公厅、省委办公厅近几年来下发了一系列文件,就报送重要紧急信息范围、时限等都提出了明确规定和具体要求。笔者通过十几年的信息工作实践,积累了一
针对疫情下企事业单位复工,学校开学返校和公共场所人员流动等情况,以及人员进出门禁时所需进行的身份信息登记,测温消毒等繁琐的防疫检测问题,研究了一种智能消毒及预警门禁系统.研究包括:智能消毒及预警门禁系统模型的构建;人脸及身份证信息的采集和智能识别;消毒杀菌的协同处理策略;人员身份数据的网络通信和云端存储.采用非接触式热成像摄像机采集人体体温信息;构建基于卷积神经网络的宽度学习系统模型对人脸特征进行