• 文献检索
  • 文档翻译
  • 深度研究
  • 学术资讯
  • Suppr Zotero 插件Zotero 插件
  • 邀请有礼
  • 套餐&价格
  • 历史记录
应用&插件
Suppr Zotero 插件Zotero 插件浏览器插件Mac 客户端Windows 客户端微信小程序
定价
高级版会员购买积分包购买API积分包
服务
文献检索文档翻译深度研究API 文档MCP 服务
关于我们
关于 Suppr公司介绍联系我们用户协议隐私条款
关注我们

Suppr 超能文献

核心技术专利:CN118964589B侵权必究
粤ICP备2023148730 号-1Suppr @ 2026

文献检索

告别复杂PubMed语法,用中文像聊天一样搜索,搜遍4000万医学文献。AI智能推荐,让科研检索更轻松。

立即免费搜索

文件翻译

保留排版,准确专业,支持PDF/Word/PPT等文件格式,支持 12+语言互译。

免费翻译文档

深度研究

AI帮你快速写综述,25分钟生成高质量综述,智能提取关键信息,辅助科研写作。

立即免费体验

基于尺度自适应网络的语义图像分割。

Semantic Image Segmentation by Scale-Adaptive Networks.

出版信息

IEEE Trans Image Process. 2020;29(1):2066-2077. doi: 10.1109/TIP.2019.2941644. Epub 2019 Oct 22.

DOI:10.1109/TIP.2019.2941644
PMID:31647432
Abstract

Semantic image segmentation is an important yet unsolved problem. One of the major challenges is the large variability of the object scales. To tackle this scale problem, we propose a Scale-Adaptive Network (SAN) which consists of multiple branches with each one taking charge of the segmentation of the objects of a certain range of scales. Given an image, SAN first computes a dense scale map indicating the scale of each pixel which is automatically determined by the size of the enclosing object. Then the features of different branches are fused according to the scale map to generate the final segmentation map. To ensure that each branch indeed learns the features for a certain scale, we propose a scale-induced ground-truth map and enforce a scale-aware segmentation loss for the corresponding branch in addition to the final loss. Extensive experiments over the PASCAL-Person-Part, the PASCAL VOC 2012, and the Look into Person datasets demonstrate that our SAN can handle the large variability of the object scales and outperforms the state-of-the-art semantic segmentation methods.

摘要

语义图像分割是一个重要但尚未解决的问题。其中一个主要挑战是目标尺度的巨大可变性。为了解决这个尺度问题,我们提出了一种 Scale-Adaptive Network(SAN),它由多个分支组成,每个分支负责分割一定范围尺度的目标。给定一张图像,SAN 首先计算一个密集的尺度图,指示每个像素的尺度,该尺度由包围对象的大小自动确定。然后根据尺度图融合不同分支的特征,生成最终的分割图。为了确保每个分支确实学习了特定尺度的特征,我们提出了一种尺度诱导的真实标签图,并在最终损失之外,为相应的分支施加一种尺度感知的分割损失。在 PASCAL-Person-Part、PASCAL VOC 2012 和 Look into Person 数据集上的广泛实验表明,我们的 SAN 可以处理目标尺度的巨大可变性,并且优于最新的语义分割方法。

相似文献

1
Semantic Image Segmentation by Scale-Adaptive Networks.基于尺度自适应网络的语义图像分割。
IEEE Trans Image Process. 2020;29(1):2066-2077. doi: 10.1109/TIP.2019.2941644. Epub 2019 Oct 22.
2
Coarse-to-Fine Semantic Segmentation From Image-Level Labels.从图像级标签进行粗到细的语义分割。
IEEE Trans Image Process. 2020;29:225-236. doi: 10.1109/TIP.2019.2926748. Epub 2019 Jul 12.
3
Proposal-Free Network for Instance-Level Object Segmentation.用于实例级目标分割的无提案网络
IEEE Trans Pattern Anal Mach Intell. 2018 Dec;40(12):2978-2991. doi: 10.1109/TPAMI.2017.2775623. Epub 2017 Nov 22.
4
A Novel Upsampling and Context Convolution for Image Semantic Segmentation.一种用于图像语义分割的新型上采样与上下文卷积
Sensors (Basel). 2021 Mar 20;21(6):2170. doi: 10.3390/s21062170.
5
Online glocal transfer for automatic figure-ground segmentation.在线全局到局部转移的自动前景背景分割。
IEEE Trans Image Process. 2014 May;23(5):2109-21. doi: 10.1109/TIP.2014.2312287.
6
Scale-Aware Pixelwise Object Proposal Networks.尺度感知像素级目标提议网络。
IEEE Trans Image Process. 2016 Oct;25(10):4525-39. doi: 10.1109/TIP.2016.2593342. Epub 2016 Jul 19.
7
STC: A Simple to Complex Framework for Weakly-Supervised Semantic Segmentation.STC:一种用于弱监督语义分割的从简单到复杂的框架。
IEEE Trans Pattern Anal Mach Intell. 2017 Nov;39(11):2314-2320. doi: 10.1109/TPAMI.2016.2636150. Epub 2016 Dec 6.
8
SCN: Switchable Context Network for Semantic Segmentation of RGB-D Images.SCN:用于 RGB-D 图像语义分割的可切换上下文网络。
IEEE Trans Cybern. 2020 Mar;50(3):1120-1131. doi: 10.1109/TCYB.2018.2885062. Epub 2018 Dec 20.
9
Mask SSD: An Effective Single-Stage Approach to Object Instance Segmentation.Mask SSD:一种有效的单阶段目标实例分割方法。
IEEE Trans Image Process. 2020;29(1):2078-2093. doi: 10.1109/TIP.2019.2947806. Epub 2019 Oct 22.
10
Degraded Image Semantic Segmentation with Dense-Gram Networks.基于密集Gram网络的退化图像语义分割
IEEE Trans Image Process. 2019 Aug 26. doi: 10.1109/TIP.2019.2936111.

引用本文的文献

1
DBRSNet: a dual-branch remote sensing image segmentation model based on feature interaction and multi-scale feature fusion.DBRSNet:一种基于特征交互和多尺度特征融合的双分支遥感图像分割模型。
Sci Rep. 2025 Jul 30;15(1):27786. doi: 10.1038/s41598-025-13236-4.