Deep Lookup Network
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Yulan, Wang, Longguang, Mao, Wendong, Dong, Xiaoyu, Wang, Yingqian, Liu, Li, An, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
por: Xu, Qingyu, et al.
Publicado: (2024)
por: Xu, Qingyu, et al.
Publicado: (2024)
PanMatch: Unleashing the Potential of Large Vision Models for Unified Matching Models
por: Zhang, Yongjian, et al.
Publicado: (2025)
por: Zhang, Yongjian, et al.
Publicado: (2025)
Probing Deep into Temporal Profile Makes the Infrared Small Target Detector Much Better
por: Li, Ruojing, et al.
Publicado: (2025)
por: Li, Ruojing, et al.
Publicado: (2025)
Triple Spectral Fusion for Sensor-based Human Activity Recognition
por: Zhang, Ye, et al.
Publicado: (2026)
por: Zhang, Ye, et al.
Publicado: (2026)
A Memory-Efficient Framework for Deformable Transformer with Neural Architecture Search
por: Mao, Wendong, et al.
Publicado: (2025)
por: Mao, Wendong, et al.
Publicado: (2025)
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
por: Shi, Huihong, et al.
Publicado: (2024)
por: Shi, Huihong, et al.
Publicado: (2024)
SpecDETR: A transformer-based hyperspectral point object detection network
por: Li, Zhaoxu, et al.
Publicado: (2024)
por: Li, Zhaoxu, et al.
Publicado: (2024)
DIVD: Deblurring with Improved Video Diffusion Model
por: Long, Haoyang, et al.
Publicado: (2024)
por: Long, Haoyang, et al.
Publicado: (2024)
NTIRE 2024 Challenge on Stereo Image Super-Resolution: Methods and Results
por: Wang, Longguang, et al.
Publicado: (2024)
por: Wang, Longguang, et al.
Publicado: (2024)
Pack-PTQ: Advancing Post-training Quantization of Neural Networks by Pack-wise Reconstruction
por: Li, Changjun, et al.
Publicado: (2025)
por: Li, Changjun, et al.
Publicado: (2025)
Taming Lookup Tables for Efficient Image Retouching
por: Yang, Sidi, et al.
Publicado: (2024)
por: Yang, Sidi, et al.
Publicado: (2024)
Pixel Embedding: Fully Quantized Convolutional Neural Network with Differentiable Lookup Table
por: Tokunaga, Hiroyuki, et al.
Publicado: (2024)
por: Tokunaga, Hiroyuki, et al.
Publicado: (2024)
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
por: Lu, Jinming, et al.
Publicado: (2025)
por: Lu, Jinming, et al.
Publicado: (2025)
Pluggable Style Representation Learning for Multi-Style Transfer
por: Liu, Hongda, et al.
Publicado: (2025)
por: Liu, Hongda, et al.
Publicado: (2025)
SaMam: Style-aware State Space Model for Arbitrary Image Style Transfer
por: Liu, Hongda, et al.
Publicado: (2025)
por: Liu, Hongda, et al.
Publicado: (2025)
A Unified Hierarchical Framework for Fine-grained Cross-view Geo-localization over Large-scale Scenarios
por: Song, Zhuo, et al.
Publicado: (2025)
por: Song, Zhuo, et al.
Publicado: (2025)
Sketch2NeRF: Multi-view Sketch-guided Text-to-3D Generation
por: Chen, Minglin, et al.
Publicado: (2024)
por: Chen, Minglin, et al.
Publicado: (2024)
Density-guided Translator Boosts Synthetic-to-Real Unsupervised Domain Adaptive Segmentation of 3D Point Clouds
por: Yuan, Zhimin, et al.
Publicado: (2024)
por: Yuan, Zhimin, et al.
Publicado: (2024)
Multi-modal Spatio-Temporal Transformer for High-resolution Land Subsidence Prediction
por: Yao, Wendong, et al.
Publicado: (2025)
por: Yao, Wendong, et al.
Publicado: (2025)
Dynamic Universal Approximation Theory: The Basic Theory for Deep Learning-Based Computer Vision Models
por: Wang, Wei, et al.
Publicado: (2024)
por: Wang, Wei, et al.
Publicado: (2024)
AIQViT: Architecture-Informed Post-Training Quantization for Vision Transformers
por: Jiang, Runqing, et al.
Publicado: (2025)
por: Jiang, Runqing, et al.
Publicado: (2025)
Augmenting Prototype Network with TransMix for Few-shot Hyperspectral Image Classification
por: Liu, Chun, et al.
Publicado: (2024)
por: Liu, Chun, et al.
Publicado: (2024)
LookupViT: Compressing visual information to a limited number of tokens
por: Koner, Rajat, et al.
Publicado: (2024)
por: Koner, Rajat, et al.
Publicado: (2024)
ClueTracer: Question-to-Vision Clue Tracing for Training-Free Hallucination Suppression in Multimodal Reasoning
por: Xi, Gongli, et al.
Publicado: (2026)
por: Xi, Gongli, et al.
Publicado: (2026)
Dual form Complementary Masking for Domain-Adaptive Image Segmentation
por: Wang, Jiawen, et al.
Publicado: (2025)
por: Wang, Jiawen, et al.
Publicado: (2025)
DropoutGS: Dropping Out Gaussians for Better Sparse-view Rendering
por: Xu, Yexing, et al.
Publicado: (2025)
por: Xu, Yexing, et al.
Publicado: (2025)
DOR3D-Net: Dense Ordinal Regression Network for 3D Hand Pose Estimation
por: Mao, Yamin, et al.
Publicado: (2024)
por: Mao, Yamin, et al.
Publicado: (2024)
Deep Neighbor Layer Aggregation for Lightweight Self-Supervised Monocular Depth Estimation
por: Boya, Wang, et al.
Publicado: (2023)
por: Boya, Wang, et al.
Publicado: (2023)
Simulating the Real World: A Unified Survey of Multimodal Generative Models
por: Hu, Yuqi, et al.
Publicado: (2025)
por: Hu, Yuqi, et al.
Publicado: (2025)
SDRNET: Stacked Deep Residual Network for Accurate Semantic Segmentation of Fine-Resolution Remotely Sensed Images
por: Wambugu, Naftaly, et al.
Publicado: (2025)
por: Wambugu, Naftaly, et al.
Publicado: (2025)
Preserving Full Degradation Details for Blind Image Super-Resolution
por: Liu, Hongda, et al.
Publicado: (2024)
por: Liu, Hongda, et al.
Publicado: (2024)
Exploiting Gaussian Agnostic Representation Learning with Diffusion Priors for Enhanced Infrared Small Target Detection
por: Li, Junyao, et al.
Publicado: (2025)
por: Li, Junyao, et al.
Publicado: (2025)
STNet: Deep Audio-Visual Fusion Network for Robust Speaker Tracking
por: Li, Yidi, et al.
Publicado: (2024)
por: Li, Yidi, et al.
Publicado: (2024)
Local and Global Feature Attention Fusion Network for Face Recognition
por: Yu, Wang, et al.
Publicado: (2024)
por: Yu, Wang, et al.
Publicado: (2024)
Large Vision-Language Models Get Lost in Attention
por: Xi, Gongli, et al.
Publicado: (2026)
por: Xi, Gongli, et al.
Publicado: (2026)
Rethinking Metrics and Benchmarks of Video Anomaly Detection
por: Liu, Zihao, et al.
Publicado: (2025)
por: Liu, Zihao, et al.
Publicado: (2025)
VideoDirector: Precise Video Editing via Text-to-Video Models
por: Wang, Yukun, et al.
Publicado: (2024)
por: Wang, Yukun, et al.
Publicado: (2024)
Interpretable Recognition of Fused Magnesium Furnace Working Conditions with Deep Convolutional Stochastic Configuration Networks
por: Weitao, Li, et al.
Publicado: (2025)
por: Weitao, Li, et al.
Publicado: (2025)
Audio-Guided Visual Perception for Audio-Visual Navigation
por: Wang, Yi, et al.
Publicado: (2025)
por: Wang, Yi, et al.
Publicado: (2025)
Local Feature Matching Using Deep Learning: A Survey
por: Xu, Shibiao, et al.
Publicado: (2024)
por: Xu, Shibiao, et al.
Publicado: (2024)
Ejemplares similares
-
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
por: Xu, Qingyu, et al.
Publicado: (2024) -
PanMatch: Unleashing the Potential of Large Vision Models for Unified Matching Models
por: Zhang, Yongjian, et al.
Publicado: (2025) -
Probing Deep into Temporal Profile Makes the Infrared Small Target Detector Much Better
por: Li, Ruojing, et al.
Publicado: (2025) -
Triple Spectral Fusion for Sensor-based Human Activity Recognition
por: Zhang, Ye, et al.
Publicado: (2026) -
A Memory-Efficient Framework for Deformable Transformer with Neural Architecture Search
por: Mao, Wendong, et al.
Publicado: (2025)