Ultra-High Resolution Segmentation via Boundary-Enhanced Patch-Merging Transformer
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Haopeng, Zhang, Yingwei, Xu, Lumin, Jin, Sheng, Chen, Yiqiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Ultra High-Resolution Image Inpainting with Patch-Based Content Consistency Adapter
von: Zhang, Jianhui, et al.
Veröffentlicht: (2025)
von: Zhang, Jianhui, et al.
Veröffentlicht: (2025)
SPT: Sequence Prompt Transformer for Interactive Image Segmentation
von: Cheng, Senlin, et al.
Veröffentlicht: (2024)
von: Cheng, Senlin, et al.
Veröffentlicht: (2024)
TCFormer: Visual Recognition via Token Clustering Transformer
von: Zeng, Wang, et al.
Veröffentlicht: (2024)
von: Zeng, Wang, et al.
Veröffentlicht: (2024)
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
von: Dong, Qingji, et al.
Veröffentlicht: (2026)
von: Dong, Qingji, et al.
Veröffentlicht: (2026)
CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense Prediction
von: Wu, Size, et al.
Veröffentlicht: (2023)
von: Wu, Size, et al.
Veröffentlicht: (2023)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
von: Yao, Ting, et al.
Veröffentlicht: (2024)
von: Yao, Ting, et al.
Veröffentlicht: (2024)
Adapting Vision Transformers to Ultra-High Resolution Semantic Segmentation with Relay Tokens
von: Perron, Yohann, et al.
Veröffentlicht: (2026)
von: Perron, Yohann, et al.
Veröffentlicht: (2026)
Brain-Inspired Stepwise Patch Merging for Vision Transformers
von: Yu, Yonghao, et al.
Veröffentlicht: (2024)
von: Yu, Yonghao, et al.
Veröffentlicht: (2024)
DBAT: Dynamic Backward Attention Transformer for Material Segmentation with Cross-Resolution Patches
von: Heng, Yuwen, et al.
Veröffentlicht: (2023)
von: Heng, Yuwen, et al.
Veröffentlicht: (2023)
High-Resolution Frame Interpolation with Patch-based Cascaded Diffusion
von: Hur, Junhwa, et al.
Veröffentlicht: (2024)
von: Hur, Junhwa, et al.
Veröffentlicht: (2024)
KptLLM: Unveiling the Power of Large Language Model for Keypoint Comprehension
von: Yang, Jie, et al.
Veröffentlicht: (2024)
von: Yang, Jie, et al.
Veröffentlicht: (2024)
Leveraging Adaptive Implicit Representation Mapping for Ultra High-Resolution Image Segmentation
von: Zhao, Ziyu, et al.
Veröffentlicht: (2024)
von: Zhao, Ziyu, et al.
Veröffentlicht: (2024)
F-LMM: Grounding Frozen Large Multimodal Models
von: Wu, Size, et al.
Veröffentlicht: (2024)
von: Wu, Size, et al.
Veröffentlicht: (2024)
Adaptive Morph-Patch Transformer for Aortic Vessel Segmentation
von: Zhang, Zhenxi, et al.
Veröffentlicht: (2025)
von: Zhang, Zhenxi, et al.
Veröffentlicht: (2025)
Sliding-Window Merging for Compacting Patch-Redundant Layers in LLMs
von: Ding, Xuan, et al.
Veröffentlicht: (2025)
von: Ding, Xuan, et al.
Veröffentlicht: (2025)
UniFS: Universal Few-shot Instance Perception with Point Representations
von: Jin, Sheng, et al.
Veröffentlicht: (2024)
von: Jin, Sheng, et al.
Veröffentlicht: (2024)
Adaptive Patching for High-resolution Image Segmentation with Transformers
von: Zhang, Enzhi, et al.
Veröffentlicht: (2024)
von: Zhang, Enzhi, et al.
Veröffentlicht: (2024)
LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention
von: Shao, Shitong, et al.
Veröffentlicht: (2026)
von: Shao, Shitong, et al.
Veröffentlicht: (2026)
KptLLM++: Towards Generic Keypoint Comprehension with Large Language Model
von: Yang, Jie, et al.
Veröffentlicht: (2025)
von: Yang, Jie, et al.
Veröffentlicht: (2025)
HD-VGGT: High-Resolution Visual Geometry Transformer
von: Chen, Tianrun, et al.
Veröffentlicht: (2026)
von: Chen, Tianrun, et al.
Veröffentlicht: (2026)
SAGD: Boundary-Enhanced Segment Anything in 3D Gaussian via Gaussian Decomposition
von: Hu, Xu, et al.
Veröffentlicht: (2024)
von: Hu, Xu, et al.
Veröffentlicht: (2024)
PC-SAM: Patch-Constrained Fine-Grained Interactive Road Segmentation in High-Resolution Remote Sensing Images
von: Lv, Chengcheng, et al.
Veröffentlicht: (2026)
von: Lv, Chengcheng, et al.
Veröffentlicht: (2026)
Serp-Mamba: Advancing High-Resolution Retinal Vessel Segmentation with Selective State-Space Model
von: Wang, Hongqiu, et al.
Veröffentlicht: (2024)
von: Wang, Hongqiu, et al.
Veröffentlicht: (2024)
PatchScaler: An Efficient Patch-Independent Diffusion Model for Image Super-Resolution
von: Liu, Yong, et al.
Veröffentlicht: (2024)
von: Liu, Yong, et al.
Veröffentlicht: (2024)
PatchVSR: Breaking Video Diffusion Resolution Limits with Patch-wise Video Super-Resolution
von: Du, Shian, et al.
Veröffentlicht: (2025)
von: Du, Shian, et al.
Veröffentlicht: (2025)
F2Net: A Frequency-Fused Network for Ultra-High Resolution Remote Sensing Segmentation
von: Chen, Hengzhi, et al.
Veröffentlicht: (2025)
von: Chen, Hengzhi, et al.
Veröffentlicht: (2025)
Minimal High-Resolution Patches Are Sufficient for Whole Slide Image Representation via Cascaded Dual-Scale Reconstruction
von: Liu, Yujian, et al.
Veröffentlicht: (2025)
von: Liu, Yujian, et al.
Veröffentlicht: (2025)
GKGNet: Group K-Nearest Neighbor based Graph Convolutional Network for Multi-Label Image Recognition
von: Yao, Ruijie, et al.
Veröffentlicht: (2023)
von: Yao, Ruijie, et al.
Veröffentlicht: (2023)
Dynamic Snake Upsampling Operater and Boundary-Skeleton Weighted Loss for Tubular Structure Segmentation
von: Chen, Yiqi, et al.
Veröffentlicht: (2025)
von: Chen, Yiqi, et al.
Veröffentlicht: (2025)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
von: Skorokhodov, Ivan, et al.
Veröffentlicht: (2024)
von: Skorokhodov, Ivan, et al.
Veröffentlicht: (2024)
Segformer++: Efficient Token-Merging Strategies for High-Resolution Semantic Segmentation
von: Kienzle, Daniel, et al.
Veröffentlicht: (2024)
von: Kienzle, Daniel, et al.
Veröffentlicht: (2024)
Sparse Refinement for Efficient High-Resolution Semantic Segmentation
von: Liu, Zhijian, et al.
Veröffentlicht: (2024)
von: Liu, Zhijian, et al.
Veröffentlicht: (2024)
PatchCraft: Exploring Texture Patch for Efficient AI-generated Image Detection
von: Zhong, Nan, et al.
Veröffentlicht: (2023)
von: Zhong, Nan, et al.
Veröffentlicht: (2023)
MSPE: Multi-Scale Patch Embedding Prompts Vision Transformers to Any Resolution
von: Liu, Wenzhuo, et al.
Veröffentlicht: (2024)
von: Liu, Wenzhuo, et al.
Veröffentlicht: (2024)
All Patches Matter, More Patches Better: Enhance AI-Generated Image Detection via Panoptic Patch Learning
von: Yang, Zheng, et al.
Veröffentlicht: (2025)
von: Yang, Zheng, et al.
Veröffentlicht: (2025)
Every Pixel Has its Moments: Ultra-High-Resolution Unpaired Image-to-Image Translation via Dense Normalization
von: Ho, Ming-Yang, et al.
Veröffentlicht: (2024)
von: Ho, Ming-Yang, et al.
Veröffentlicht: (2024)
Towards Robust Semantic Segmentation against Patch-based Attack via Attention Refinement
von: Yuan, Zheng, et al.
Veröffentlicht: (2024)
von: Yuan, Zheng, et al.
Veröffentlicht: (2024)
UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
von: Zhao, Min, et al.
Veröffentlicht: (2025)
von: Zhao, Min, et al.
Veröffentlicht: (2025)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
von: Wu, Size, et al.
Veröffentlicht: (2025)
von: Wu, Size, et al.
Veröffentlicht: (2025)
UltraGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
von: Zhang, Yuyao, et al.
Veröffentlicht: (2025)
von: Zhang, Yuyao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Ultra High-Resolution Image Inpainting with Patch-Based Content Consistency Adapter
von: Zhang, Jianhui, et al.
Veröffentlicht: (2025) -
SPT: Sequence Prompt Transformer for Interactive Image Segmentation
von: Cheng, Senlin, et al.
Veröffentlicht: (2024) -
TCFormer: Visual Recognition via Token Clustering Transformer
von: Zeng, Wang, et al.
Veröffentlicht: (2024) -
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
von: Dong, Qingji, et al.
Veröffentlicht: (2026) -
CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense Prediction
von: Wu, Size, et al.
Veröffentlicht: (2023)