Saved in:
| Main Authors: | Wu, Juncheng, Ni, Zhangkai, Wang, Hanli, Yang, Wenhan, Zhou, Yuyin, Wang, Shiqi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2406.08377 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Misalignment-Robust Frequency Distribution Loss for Image Transformation
by: Ni, Zhangkai, et al.
Published: (2024)
by: Ni, Zhangkai, et al.
Published: (2024)
Opinion-Unaware Blind Image Quality Assessment using Multi-Scale Deep Feature Statistics
by: Ni, Zhangkai, et al.
Published: (2024)
by: Ni, Zhangkai, et al.
Published: (2024)
Structural Similarity-Inspired Unfolding for Lightweight Image Super-Resolution
by: Ni, Zhangkai, et al.
Published: (2025)
by: Ni, Zhangkai, et al.
Published: (2025)
Wavelet-Domain Masked Image Modeling for Color-Consistent HDR Video Reconstruction
by: Zhang, Yang, et al.
Published: (2026)
by: Zhang, Yang, et al.
Published: (2026)
AFUNet: Cross-Iterative Alignment-Fusion Synergy for HDR Reconstruction via Deep Unfolding Paradigm
by: Li, Xinyue, et al.
Published: (2025)
by: Li, Xinyue, et al.
Published: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
by: Wang, Yahong, et al.
Published: (2026)
by: Wang, Yahong, et al.
Published: (2026)
Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
by: Zhu, Lingyu, et al.
Published: (2024)
by: Zhu, Lingyu, et al.
Published: (2024)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
by: Wang, Yahong, et al.
Published: (2025)
by: Wang, Yahong, et al.
Published: (2025)
Restorer: Removing Multi-Degradation with All-Axis Attention and Prompt Guidance
by: Mao, Jiawei, et al.
Published: (2024)
by: Mao, Jiawei, et al.
Published: (2024)
FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
by: Han, Menglin, et al.
Published: (2026)
by: Han, Menglin, et al.
Published: (2026)
Perceptual-GS: Scene-adaptive Perceptual Densification for Gaussian Splatting
by: Zhou, Hongbi, et al.
Published: (2025)
by: Zhou, Hongbi, et al.
Published: (2025)
MedVLThinker: Simple Baselines for Multimodal Medical Reasoning
by: Huang, Xiaoke, et al.
Published: (2025)
by: Huang, Xiaoke, et al.
Published: (2025)
SCING:Towards More Efficient and Robust Person Re-Identification through Selective Cross-modal Prompt Tuning
by: Xie, Yunfei, et al.
Published: (2025)
by: Xie, Yunfei, et al.
Published: (2025)
MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning
by: Yu, Suhao, et al.
Published: (2025)
by: Yu, Suhao, et al.
Published: (2025)
A Comprehensive Analysis of Mamba for 3D Volumetric Medical Image Segmentation
by: Wang, Chaohan, et al.
Published: (2025)
by: Wang, Chaohan, et al.
Published: (2025)
HisTrackMap: Global Vectorized High-Definition Map Construction via History Map Tracking
by: Yang, Jing, et al.
Published: (2025)
by: Yang, Jing, et al.
Published: (2025)
Gap-closing Matters: Perceptual Quality Evaluation and Optimization of Low-Light Image Enhancement
by: Chen, Baoliang, et al.
Published: (2023)
by: Chen, Baoliang, et al.
Published: (2023)
Sculpting Holistic 3D Representation in Contrastive Language-Image-3D Pre-training
by: Gao, Yipeng, et al.
Published: (2023)
by: Gao, Yipeng, et al.
Published: (2023)
Unified Coding for Both Human Perception and Generalized Machine Analytics with CLIP Supervision
by: Yin, Kangsheng, et al.
Published: (2025)
by: Yin, Kangsheng, et al.
Published: (2025)
Self-Supervised Anatomical Consistency Learning for Vision-Grounded Medical Report Generation
by: Yang, Longzhen, et al.
Published: (2025)
by: Yang, Longzhen, et al.
Published: (2025)
More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models
by: Liu, Chengzhi, et al.
Published: (2025)
by: Liu, Chengzhi, et al.
Published: (2025)
GPT-IMAGE-EDIT-1.5M: A Million-Scale, GPT-Generated Image Dataset
by: Wang, Yuhan, et al.
Published: (2025)
by: Wang, Yuhan, et al.
Published: (2025)
Generalized Correspondence Matching via Flexible Hierarchical Refinement and Patch Descriptor Distillation
by: Han, Yu, et al.
Published: (2024)
by: Han, Yu, et al.
Published: (2024)
Towards a Universal Image Degradation Model via Content-Degradation Disentanglement
by: Yang, Wenbo, et al.
Published: (2025)
by: Yang, Wenbo, et al.
Published: (2025)
Deep Linear Array Pushbroom Image Restoration: A Degradation Pipeline and Jitter-Aware Restoration Network
by: Chen, Zida, et al.
Published: (2024)
by: Chen, Zida, et al.
Published: (2024)
Single-Image Shadow Removal Using Deep Learning: A Comprehensive Survey
by: Guo, Laniqng, et al.
Published: (2024)
by: Guo, Laniqng, et al.
Published: (2024)
From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models
by: Wu, Juncheng, et al.
Published: (2026)
by: Wu, Juncheng, et al.
Published: (2026)
Weakly-Supervised Referring Video Object Segmentation through Text Supervision
by: Shi, Miaojing, et al.
Published: (2026)
by: Shi, Miaojing, et al.
Published: (2026)
Deep Feature Statistics Mapping for Generalized Screen Content Image Quality Assessment
by: Chen, Baoliang, et al.
Published: (2022)
by: Chen, Baoliang, et al.
Published: (2022)
Decoupled Residual Denoising Diffusion Models for Unified and Data Efficient Image-to-Image Translation
by: Lin, Ziyue, et al.
Published: (2026)
by: Lin, Ziyue, et al.
Published: (2026)
Scaling Laws in Patchification: An Image Is Worth 50,176 Tokens And More
by: Wang, Feng, et al.
Published: (2025)
by: Wang, Feng, et al.
Published: (2025)
MedTrinity-25M: A Large-scale Multimodal Dataset with Multigranular Annotations for Medicine
by: Xie, Yunfei, et al.
Published: (2024)
by: Xie, Yunfei, et al.
Published: (2024)
RCNet: Deep Recurrent Collaborative Network for Multi-View Low-Light Image Enhancement
by: Luo, Hao, et al.
Published: (2024)
by: Luo, Hao, et al.
Published: (2024)
Fast Omni-Directional Image Super-Resolution: Adapting the Implicit Image Function with Pixel and Semantic-Wise Spherical Geometric Priors
by: Shen, Xuelin, et al.
Published: (2025)
by: Shen, Xuelin, et al.
Published: (2025)
Learning Feature Descriptors using Camera Pose Supervision
by: Wang, Qianqian, et al.
Published: (2020)
by: Wang, Qianqian, et al.
Published: (2020)
PASDiff: Physics-Aware Semantic Guidance for Joint Real-world Low-Light Face Enhancement and Restoration
by: Ni, Yilin, et al.
Published: (2026)
by: Ni, Yilin, et al.
Published: (2026)
DALD-PCAC: Density-Adaptive Learning Descriptor for Point Cloud Lossless Attribute Compression
by: Fu, Chunyang, et al.
Published: (2026)
by: Fu, Chunyang, et al.
Published: (2026)
SCoT: Unifying Consistency Models and Rectified Flows via Straight-Consistent Trajectories
by: Wu, Zhangkai, et al.
Published: (2025)
by: Wu, Zhangkai, et al.
Published: (2025)
Nested AutoRegressive Models
by: Wu, Hongyu, et al.
Published: (2025)
by: Wu, Hongyu, et al.
Published: (2025)
HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing
by: Hui, Mude, et al.
Published: (2024)
by: Hui, Mude, et al.
Published: (2024)
Similar Items
-
Misalignment-Robust Frequency Distribution Loss for Image Transformation
by: Ni, Zhangkai, et al.
Published: (2024) -
Opinion-Unaware Blind Image Quality Assessment using Multi-Scale Deep Feature Statistics
by: Ni, Zhangkai, et al.
Published: (2024) -
Structural Similarity-Inspired Unfolding for Lightweight Image Super-Resolution
by: Ni, Zhangkai, et al.
Published: (2025) -
Wavelet-Domain Masked Image Modeling for Color-Consistent HDR Video Reconstruction
by: Zhang, Yang, et al.
Published: (2026) -
AFUNet: Cross-Iterative Alignment-Fusion Synergy for HDR Reconstruction via Deep Unfolding Paradigm
by: Li, Xinyue, et al.
Published: (2025)