KAN See In the Dark
Fuente:
arXiv
Guardado en:
| Autores principales: | Ning, Aoxiang, Xue, Minglong, He, Jinhong, Song, Chengyun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Zero-Reference Lighting Estimation Diffusion Model for Low-Light Image Enhancement
por: He, Jinhong, et al.
Publicado: (2024)
por: He, Jinhong, et al.
Publicado: (2024)
Zero-Shot Low-Light Image Enhancement via Joint Frequency Domain Priors Guided Diffusion
por: He, Jinhong, et al.
Publicado: (2024)
por: He, Jinhong, et al.
Publicado: (2024)
Degradation-Consistent Learning via Bidirectional Diffusion for Low-Light Image Enhancement
por: He, Jinhong, et al.
Publicado: (2025)
por: He, Jinhong, et al.
Publicado: (2025)
Addressing Domain Discrepancy: A Dual-branch Collaborative Model to Unsupervised Dehazing
por: Fan, Shuaibin, et al.
Publicado: (2024)
por: Fan, Shuaibin, et al.
Publicado: (2024)
Artistic-style text detector and a new Movie-Poster dataset
por: Ning, Aoxiang, et al.
Publicado: (2024)
por: Ning, Aoxiang, et al.
Publicado: (2024)
KAN You See It? KANs and Sentinel for Effective and Explainable Crop Field Segmentation
por: Cambrin, Daniele Rege, et al.
Publicado: (2024)
por: Cambrin, Daniele Rege, et al.
Publicado: (2024)
Demystifying KAN for Vision Tasks: The RepKAN Approach
por: Cheon, Minjong
Publicado: (2026)
por: Cheon, Minjong
Publicado: (2026)
DFDNet: Dynamic Frequency-Guided De-Flare Network
por: Xue, Minglong, et al.
Publicado: (2025)
por: Xue, Minglong, et al.
Publicado: (2025)
Seeing the Unseen: Zooming in the Dark with Event Cameras
por: Kai, Dachun, et al.
Publicado: (2026)
por: Kai, Dachun, et al.
Publicado: (2026)
Low-light Image Enhancement via CLIP-Fourier Guided Wavelet Diffusion
por: Xue, Minglong, et al.
Publicado: (2024)
por: Xue, Minglong, et al.
Publicado: (2024)
Unified Image Restoration and Enhancement: Degradation Calibrated Cycle Reconstruction Diffusion Model
por: Xue, Minglong, et al.
Publicado: (2024)
por: Xue, Minglong, et al.
Publicado: (2024)
K-U-KAN: Koopman-Enhanced U-KAN for 3D Dental Reconstruction from a Single Panoramic X-ray Radiograph
por: Parida, Bikram Keshari, et al.
Publicado: (2026)
por: Parida, Bikram Keshari, et al.
Publicado: (2026)
KAN-Mixers: a new deep learning architecture for image classification
por: Canuto, Jorge Luiz dos Santos, et al.
Publicado: (2025)
por: Canuto, Jorge Luiz dos Santos, et al.
Publicado: (2025)
Bad Seeing or Bad Thinking? Rewarding Perception for Vision-Language Reasoning
por: Wang, Haozhe, et al.
Publicado: (2026)
por: Wang, Haozhe, et al.
Publicado: (2026)
Helping CLIP See Both the Forest and the Trees: A Decomposition and Description Approach
por: Xue, Leyan, et al.
Publicado: (2025)
por: Xue, Leyan, et al.
Publicado: (2025)
Seeing Right but Saying Wrong: Inter- and Intra-Layer Refinement in MLLMs without Training
por: Song, Shezheng, et al.
Publicado: (2026)
por: Song, Shezheng, et al.
Publicado: (2026)
KAN-RCBEVDepth: A multi-modal fusion algorithm in object detection for autonomous driving
por: Lai, Zhihao, et al.
Publicado: (2024)
por: Lai, Zhihao, et al.
Publicado: (2024)
Dataset Color Quantization: A Training-Oriented Framework for Dataset-Level Compression
por: Yu, Chenyue, et al.
Publicado: (2026)
por: Yu, Chenyue, et al.
Publicado: (2026)
Optimizing 4D Lookup Table for Low-light Video Enhancement via Wavelet Priori
por: He, Jinhong, et al.
Publicado: (2024)
por: He, Jinhong, et al.
Publicado: (2024)
Think Twice to See More: Iterative Visual Reasoning in Medical VLMs
por: Chen, Kaitao, et al.
Publicado: (2025)
por: Chen, Kaitao, et al.
Publicado: (2025)
KAN See Your Face
por: Han, Dong, et al.
Publicado: (2024)
por: Han, Dong, et al.
Publicado: (2024)
UNetVL: Enhancing 3D Medical Image Segmentation with Chebyshev KAN Powered Vision-LSTM
por: Guo, Xuhui, et al.
Publicado: (2025)
por: Guo, Xuhui, et al.
Publicado: (2025)
See&Trek: Training-Free Spatial Prompting for Multimodal Large Language Model
por: Li, Pengteng, et al.
Publicado: (2025)
por: Li, Pengteng, et al.
Publicado: (2025)
LKM-UNet: Large Kernel Vision Mamba UNet for Medical Image Segmentation
por: Wang, Jinhong, et al.
Publicado: (2024)
por: Wang, Jinhong, et al.
Publicado: (2024)
Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts
por: Xu, Haolei, et al.
Publicado: (2026)
por: Xu, Haolei, et al.
Publicado: (2026)
See Before You Code: Learning Visual Priors for Spatially Aware Educational Animation Generation
por: Li, Yuejia, et al.
Publicado: (2026)
por: Li, Yuejia, et al.
Publicado: (2026)
Pixelis: Reasoning in Pixels, from Seeing to Acting
por: Zhou, Yunpeng
Publicado: (2026)
por: Zhou, Yunpeng
Publicado: (2026)
Can NeRFs See without Cameras?
por: Amballa, Chaitanya, et al.
Publicado: (2025)
por: Amballa, Chaitanya, et al.
Publicado: (2025)
Beyond Seeing: Evaluating Multimodal LLMs on Tool-Enabled Image Perception, Transformation, and Reasoning
por: Guo, Xingang, et al.
Publicado: (2025)
por: Guo, Xingang, et al.
Publicado: (2025)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
por: Sheng, Zhiqiang, et al.
Publicado: (2026)
por: Sheng, Zhiqiang, et al.
Publicado: (2026)
DepthDark: Robust Monocular Depth Estimation for Low-Light Environments
por: Zeng, Longjian, et al.
Publicado: (2025)
por: Zeng, Longjian, et al.
Publicado: (2025)
Seeing Through the Mask: Rethinking Adversarial Examples for CAPTCHAs
por: Jabary, Yahya, et al.
Publicado: (2024)
por: Jabary, Yahya, et al.
Publicado: (2024)
FutureNet-LOF: Joint Trajectory Prediction and Lane Occupancy Field Prediction with Future Context Encoding
por: Wang, Mingkun, et al.
Publicado: (2024)
por: Wang, Mingkun, et al.
Publicado: (2024)
Object-Centric Vision Token Pruning for Vision Language Models
por: Li, Guangyuan, et al.
Publicado: (2025)
por: Li, Guangyuan, et al.
Publicado: (2025)
The Dawn of KAN in Image-to-Image (I2I) Translation: Integrating Kolmogorov-Arnold Networks with GANs for Unpaired I2I Translation
por: Mahara, Arpan, et al.
Publicado: (2024)
por: Mahara, Arpan, et al.
Publicado: (2024)
See then Tell: Enhancing Key Information Extraction with Vision Grounding
por: Liu, Shuhang, et al.
Publicado: (2024)
por: Liu, Shuhang, et al.
Publicado: (2024)
See Through the Noise: Improving Domain Generalization in Gaze Estimation
por: Peng, Yanming, et al.
Publicado: (2026)
por: Peng, Yanming, et al.
Publicado: (2026)
Multimodal Language Models See Better When They Look Shallower
por: Chen, Haoran, et al.
Publicado: (2025)
por: Chen, Haoran, et al.
Publicado: (2025)
To See or To Please: Uncovering Visual Sycophancy and Split Beliefs in VLMs
por: Hong, Rui, et al.
Publicado: (2026)
por: Hong, Rui, et al.
Publicado: (2026)
Seeing the Abstract: Translating the Abstract Language for Vision Language Models
por: Talon, Davide, et al.
Publicado: (2025)
por: Talon, Davide, et al.
Publicado: (2025)
Ejemplares similares
-
Zero-Reference Lighting Estimation Diffusion Model for Low-Light Image Enhancement
por: He, Jinhong, et al.
Publicado: (2024) -
Zero-Shot Low-Light Image Enhancement via Joint Frequency Domain Priors Guided Diffusion
por: He, Jinhong, et al.
Publicado: (2024) -
Degradation-Consistent Learning via Bidirectional Diffusion for Low-Light Image Enhancement
por: He, Jinhong, et al.
Publicado: (2025) -
Addressing Domain Discrepancy: A Dual-branch Collaborative Model to Unsupervised Dehazing
por: Fan, Shuaibin, et al.
Publicado: (2024) -
Artistic-style text detector and a new Movie-Poster dataset
por: Ning, Aoxiang, et al.
Publicado: (2024)