课题基金 / 基金详情

基于感知增强理论的视觉显著性计算

批准号:
61703166
项目类别:
青年科学基金项目
资助金额:
26.0 万元
负责人:
余晋刚
依托单位:
学科分类:
机器感知与机器视觉
结题年份:
2020
批准年份:
2017
项目状态:
已结题
项目参与者:
何盛鸿、黄骐云、瞿军、黄炜琛、黄建、刘君

项目摘要

结项摘要

项目成果

余晋刚的其他基金

相似基金

相关文献

中文摘要
受人类视觉系统选择性注意机制启发的视觉计算方法是当前计算机视觉领域的研究热点之一。传统的视觉显著性计算模型大多是基于空间位置的,没有充分考虑图像的感知组织和结构信息,因而无法有效地应对许多实际应用中复杂视觉场景带来的挑战。本课题拟以视觉注意的感知增强理论为基础,研究和建立一种新的视觉显著性计算框架,即基于对象的视觉显著性计算。首先,按照感知增强理论所提出的“注意信息沿着格式塔线索传播”的基本结构,建立基于对象的视觉显著性计算的一般框架;其次,围绕着图像格式塔线索的提取与表达、注意信息传播模型这两个关键问题开展算法研究,提出具体的算法实现方案;最后,通过实验,并结合具体应用,对模型和算法进行性能评估和进一步优化完善。本课题从“基于空间位置”到“基于对象”,发展了图像视觉显著性计算的理论和方法,同时能够为视觉显著性计算在复杂视觉场景下的广泛应用提供算法支持。
英文摘要
Visual computing inspired by the selective attention mechanism of human visual system is at the frontier of computer vision. The vast majority of traditional visual saliency models are space-based, which do not take into account the perceptual organization and structural information of images, and are therefore unable to effectively cope with challenges posed by complex visual scenes in many real-world applications. This project aims to establish a novel computational framework for visual saliency, namely, object-based visual saliency, based on the Sensory Enhancement Theory of visual attention. Firstly, we will establish the generic computational framework of object-based visual saliency, which follows the paradigm of attention spreading along Gestalt cues as suggested by the Sensory Enhancement Theory. Secondly, we will concentrate on the two key fundamental issues: extraction and representation of Gestalt cues, and attention spreading, and propose the overall algorithmic solution. Finally, we will evaluate the performance of the proposed models and algorithms by experiments and applications, and make further improvements accordingly. Going from space-based visual saliency to object-based visual saliency, this project will promote the development of visual saliency computation, both theoretically and methodologically. It will also contribute by providing practical algorithms to enable the wide application of visual saliency in complex visual scenes.
本项目围绕着基于对象的视觉显著性计算,着重针对计算框架、格式塔线索的提取与表达、注意信息传播模型等关键问题开展了深入研究:1)在计算框架方面,提出了一种用于基于对象视觉显著性计算的贝叶斯概率图模型框架,通过一个三层概率图模型实现底层视觉线索和中高层格式塔线索的融合,并采用一种迭代优化策略实现模型的高效求解。在公开数据集上的实验结果表明,该计算框架能够更好地应对复杂视觉场景和多显著对象带来的挑战;2)在格式塔线索的提取与表达,主要针对形状线索进行了研究,提出了一种基于形状先验约束优化的方法,取得了较好的实验结果;3)在注意信息传播模型方面,主要探索和提出了一种基于深度全引导网络的注意信息传播方法,采用类似于小样本目标检测的网络结构,通过中高层格式塔线索引导对象定位,实现显著性增强。在公开数据集上的大量实现表明,所提出方法可达到当前最优性能。此外,作为具体应用案例,研究了基于对象的视觉显著性机制在医学图像分析中的应用,在中耳疾病内镜图像辅助诊断数据集上的结果表明,视觉显著性机制可有效地提升图像分类诊断的准确性。
期刊论文列表
专著列表
科研奖励列表
会议论文列表
专利列表
DOI: 10.1109/access.2019.2908925
发表时间: 2019
期刊: IEEE Access
影响因子: 3.9
作者: [Yu Jin-Gang, Xiao Lichao, Ou Jiarong, Liu Zhifeng]
通讯作者: Liu Zhifeng
Exemplar-Based Recursive Instance Segmentation With Application to Plant Image Analysis
基于样本的递归实例分割在植物图像分析中的应用
DOI: 10.1109/tip.2019.2923571
发表时间: 2020
期刊: IEEE Transactions on Image Processing
影响因子: 10.6
作者: [Jin-Gang Yu, Yansheng Li, Changxin Gao, Hongxia Gao, Gui-Song Xia, Zhu Liang Yu, Yuanqing Li]
通讯作者: Yuanqing Li
Computer-aided diagnosis of laryngeal cancer via deep learning based on laryngoscopic images
基于喉镜图像的深度学习计算机辅助喉癌诊断
DOI: 10.1016/j.ebiom.2019.08.075
发表时间: 2019-10-01
期刊: EBIOMEDICINE
影响因子: 11.1
作者: [Xiong, Hao, Lin, Peiliang, Yang, Haidi]
通讯作者: Yang, Haidi
面向乳腺癌HER2精准判读的免疫组化病 理图像分析方法研究
  • 批准号:
    --
  • 项目类别:
    省市级项目
  • 资助金额:
    10.0万元
  • 批准年份:
    2025
  • 负责人:
    余晋刚
  • 依托单位:
面向乳腺癌精准诊疗的病理图像标注高效学习方法研究
  • 批准号:
    --
  • 项目类别:
    省市级项目
  • 资助金额:
    15.0万元
  • 批准年份:
    2024
  • 负责人:
    余晋刚
  • 依托单位:
面向高通量植物表型测量的多模态图像结构化协同分析
  • 批准号:
    62076099
  • 项目类别:
    面上项目
  • 资助金额:
    59.0万元
  • 批准年份:
    2020
  • 负责人:
    余晋刚
  • 依托单位:
国内基金
海外基金