Lightweight Pixel Difference Networks for Efficient Visual Representation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Zhuo, Zhang, Jiehua, Wang, Longguang, Zhang, Hua, Liu, Zhen, Pietikäinen, Matti, Liu, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rapid Salient Object Detection with Difference Convolutional Neural Networks
par: Su, Zhuo, et autres
Publié: (2025)
par: Su, Zhuo, et autres
Publié: (2025)
Deep Learning for Visual Speech Analysis: A Survey
par: Sheng, Changchong, et autres
Publié: (2022)
par: Sheng, Changchong, et autres
Publié: (2022)
Light-ResKAN: A Parameter-Sharing Lightweight KAN with Gram Polynomials for Efficient SAR Image Recognition
par: Yi, Pan, et autres
Publié: (2026)
par: Yi, Pan, et autres
Publié: (2026)
Pluggable Style Representation Learning for Multi-Style Transfer
par: Liu, Hongda, et autres
Publié: (2025)
par: Liu, Hongda, et autres
Publié: (2025)
Cycle Pixel Difference Network for Crisp Edge Detection
par: Liu, Changsong, et autres
Publié: (2024)
par: Liu, Changsong, et autres
Publié: (2024)
A Unified Hierarchical Framework for Fine-grained Cross-view Geo-localization over Large-scale Scenarios
par: Song, Zhuo, et autres
Publié: (2025)
par: Song, Zhuo, et autres
Publié: (2025)
Highly Efficient and Unsupervised Framework for Moving Object Detection in Satellite Videos
par: Xiao, C., et autres
Publié: (2024)
par: Xiao, C., et autres
Publié: (2024)
Ghost-dil-NetVLAD: A Lightweight Neural Network for Visual Place Recognition
par: Gong, Qingyuan, et autres
Publié: (2021)
par: Gong, Qingyuan, et autres
Publié: (2021)
Learning Pixel-wise Continuous Depth Representation via Clustering for Depth Completion
par: Shenglun, Chen, et autres
Publié: (2024)
par: Shenglun, Chen, et autres
Publié: (2024)
Efficient Visual Representation Learning with Heat Conduction Equation
par: Zhang, Zhemin, et autres
Publié: (2024)
par: Zhang, Zhemin, et autres
Publié: (2024)
Osprey: Pixel Understanding with Visual Instruction Tuning
par: Yuan, Yuqian, et autres
Publié: (2023)
par: Yuan, Yuqian, et autres
Publié: (2023)
UPGS: Unified Pose-aware Gaussian Splatting for Dynamic Scene Deblurring
par: Wu, Zhijing, et autres
Publié: (2025)
par: Wu, Zhijing, et autres
Publié: (2025)
SaMam: Style-aware State Space Model for Arbitrary Image Style Transfer
par: Liu, Hongda, et autres
Publié: (2025)
par: Liu, Hongda, et autres
Publié: (2025)
PAKAN: Pixel Adaptive Kolmogorov-Arnold Network Modules for Pansharpening
par: Zhang, Haoyu, et autres
Publié: (2026)
par: Zhang, Haoyu, et autres
Publié: (2026)
Pixel Sentence Representation Learning
par: Xiao, Chenghao, et autres
Publié: (2024)
par: Xiao, Chenghao, et autres
Publié: (2024)
PDCFNet: Enhancing Underwater Images through Pixel Difference Convolution
par: Zhang, Song, et autres
Publié: (2024)
par: Zhang, Song, et autres
Publié: (2024)
Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing
par: Zhao, Xiangyu, et autres
Publié: (2025)
par: Zhao, Xiangyu, et autres
Publié: (2025)
Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model
par: Zhu, Lianghui, et autres
Publié: (2024)
par: Zhu, Lianghui, et autres
Publié: (2024)
MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
par: He, Haoyang, et autres
Publié: (2024)
par: He, Haoyang, et autres
Publié: (2024)
Dyn-Adapter: Towards Disentangled Representation for Efficient Visual Recognition
par: Zhang, Yurong, et autres
Publié: (2024)
par: Zhang, Yurong, et autres
Publié: (2024)
Learning Efficient and Generalizable Human Representation with Human Gaussian Model
par: Liu, Yifan, et autres
Publié: (2025)
par: Liu, Yifan, et autres
Publié: (2025)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
par: Yin, Jiong, et autres
Publié: (2025)
par: Yin, Jiong, et autres
Publié: (2025)
Deep Lookup Network
par: Guo, Yulan, et autres
Publié: (2025)
par: Guo, Yulan, et autres
Publié: (2025)
Bidirectional Feature-aligned Motion Transformation for Efficient Dynamic Point Cloud Compression
par: Deng, Xuan, et autres
Publié: (2025)
par: Deng, Xuan, et autres
Publié: (2025)
Preserving Full Degradation Details for Blind Image Super-Resolution
par: Liu, Hongda, et autres
Publié: (2024)
par: Liu, Hongda, et autres
Publié: (2024)
Gaussian Graph Network: Learning Efficient and Generalizable Gaussian Representations from Multi-view Images
par: Zhang, Shengjun, et autres
Publié: (2025)
par: Zhang, Shengjun, et autres
Publié: (2025)
Towards Efficient and Effective Text-to-Video Retrieval with Coarse-to-Fine Visual Representation Learning
par: Tian, Kaibin, et autres
Publié: (2024)
par: Tian, Kaibin, et autres
Publié: (2024)
CFTrack: Enhancing Lightweight Visual Tracking through Contrastive Learning and Feature Matching
par: Liang, Juntao, et autres
Publié: (2025)
par: Liang, Juntao, et autres
Publié: (2025)
Pyramid Pixel Context Adaption Network for Medical Image Classification with Supervised Contrastive Learning
par: Zhang, Xiaoqing, et autres
Publié: (2023)
par: Zhang, Xiaoqing, et autres
Publié: (2023)
A Lightweight Target-Driven Network of Stereo Matching for Inland Waterways
par: Su, Jing, et autres
Publié: (2024)
par: Su, Jing, et autres
Publié: (2024)
EARL: Towards a Unified Analysis-Guided Reinforcement Learning Framework for Egocentric Interaction Reasoning and Pixel Grounding
par: Su, Yuejiao, et autres
Publié: (2026)
par: Su, Yuejiao, et autres
Publié: (2026)
PicoPose: Progressive Pixel-to-Pixel Correspondence Learning for Novel Object Pose Estimation
par: Liu, Lihua, et autres
Publié: (2025)
par: Liu, Lihua, et autres
Publié: (2025)
The Prism Hypothesis: Harmonizing Semantic and Pixel Representations via Unified Autoencoding
par: Fan, Weichen, et autres
Publié: (2025)
par: Fan, Weichen, et autres
Publié: (2025)
PixelThink: Towards Efficient Chain-of-Pixel Reasoning
par: Wang, Song, et autres
Publié: (2025)
par: Wang, Song, et autres
Publié: (2025)
Machine Vision Therapy: Multimodal Large Language Models Can Enhance Visual Robustness via Denoising In-Context Learning
par: Huang, Zhuo, et autres
Publié: (2023)
par: Huang, Zhuo, et autres
Publié: (2023)
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment
par: Zhao, Shijie, et autres
Publié: (2025)
par: Zhao, Shijie, et autres
Publié: (2025)
Expert Knowledge-Aware Image Difference Graph Representation Learning for Difference-Aware Medical Visual Question Answering
par: Hu, Xinyue, et autres
Publié: (2023)
par: Hu, Xinyue, et autres
Publié: (2023)
In Pursuit of Pixel Supervision for Visual Pre-training
par: Yang, Lihe, et autres
Publié: (2025)
par: Yang, Lihe, et autres
Publié: (2025)
PixelCraft: A Multi-Agent System for High-Fidelity Visual Reasoning on Structured Images
par: Zhang, Shuoshuo, et autres
Publié: (2025)
par: Zhang, Shuoshuo, et autres
Publié: (2025)
Learning 1D Causal Visual Representation with De-focus Attention Networks
par: Tao, Chenxin, et autres
Publié: (2024)
par: Tao, Chenxin, et autres
Publié: (2024)
Documents similaires
-
Rapid Salient Object Detection with Difference Convolutional Neural Networks
par: Su, Zhuo, et autres
Publié: (2025) -
Deep Learning for Visual Speech Analysis: A Survey
par: Sheng, Changchong, et autres
Publié: (2022) -
Light-ResKAN: A Parameter-Sharing Lightweight KAN with Gram Polynomials for Efficient SAR Image Recognition
par: Yi, Pan, et autres
Publié: (2026) -
Pluggable Style Representation Learning for Multi-Style Transfer
par: Liu, Hongda, et autres
Publié: (2025) -
Cycle Pixel Difference Network for Crisp Edge Detection
par: Liu, Changsong, et autres
Publié: (2024)