Spectral Image Tokenizer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Esteves, Carlos, Suhail, Mohammed, Makadia, Ameesh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Spectrally-Guided Diffusion Noise Schedules
par: Esteves, Carlos, et autres
Publié: (2026)
par: Esteves, Carlos, et autres
Publié: (2026)
Factorized Video Autoencoders for Efficient Generative Modelling
par: Suhail, Mohammed, et autres
Publié: (2024)
par: Suhail, Mohammed, et autres
Publié: (2024)
Single Mesh Diffusion Models with Field Latents for Texture Generation
par: Mitchel, Thomas W., et autres
Publié: (2023)
par: Mitchel, Thomas W., et autres
Publié: (2023)
Learning to Transform for Generalizable Instance-wise Invariance
par: Singhal, Utkarsh, et autres
Publié: (2023)
par: Singhal, Utkarsh, et autres
Publié: (2023)
Decomposing Private Image Generation via Coarse-to-Fine Wavelet Modeling
par: Bayrooti, Jasmine, et autres
Publié: (2026)
par: Bayrooti, Jasmine, et autres
Publié: (2026)
Wide-Baseline Relative Camera Pose Estimation with Directional Learning
par: Chen, Kefan, et autres
Publié: (2021)
par: Chen, Kefan, et autres
Publié: (2021)
3DCodeBench: Benchmarking Agentic Procedural 3D Modeling Via Code
par: Gao, Yipeng, et autres
Publié: (2026)
par: Gao, Yipeng, et autres
Publié: (2026)
No Training Wheels: Steering Vectors for Bias Correction at Inference Time
par: Gupta, Aviral, et autres
Publié: (2025)
par: Gupta, Aviral, et autres
Publié: (2025)
Network Inversion of Convolutional Neural Nets
par: Suhail, Pirzada, et autres
Publié: (2024)
par: Suhail, Pirzada, et autres
Publié: (2024)
Network Inversion for Generating Confidently Classified Counterfeits
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
Activation Matching for Explanation Generation
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
Shortcut Learning Susceptibility in Vision Classifiers
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
PoissonNet: A Local-Global Approach for Learning on Surfaces
par: Maesumi, Arman, et autres
Publié: (2025)
par: Maesumi, Arman, et autres
Publié: (2025)
BATR-FST: Bi-Level Adaptive Token Refinement for Few-Shot Transformers
par: Al-Habib, Mohammed, et autres
Publié: (2025)
par: Al-Habib, Mohammed, et autres
Publié: (2025)
Semantic Prompting with Image-Token for Continual Learning
par: Han, Jisu, et autres
Publié: (2024)
par: Han, Jisu, et autres
Publié: (2024)
VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations
par: Patel, Maitreya, et autres
Publié: (2026)
par: Patel, Maitreya, et autres
Publié: (2026)
Controllable Image Generation with Composed Parallel Token Prediction
par: Stirling, Jamie, et autres
Publié: (2024)
par: Stirling, Jamie, et autres
Publié: (2024)
Network Inversion for Uncertainty-Aware Out-of-Distribution Detection
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
Privacy Preserving Properties of Vision Classifiers
par: Suhail, Pirzada, et autres
Publié: (2025)
par: Suhail, Pirzada, et autres
Publié: (2025)
LGQ: Learning Discretization Geometry for Scalable and Stable Image Tokenization
par: Altun, Idil Bilge, et autres
Publié: (2026)
par: Altun, Idil Bilge, et autres
Publié: (2026)
MaskBit: Embedding-free Image Generation via Bit Tokens
par: Weber, Mark, et autres
Publié: (2024)
par: Weber, Mark, et autres
Publié: (2024)
End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer
par: Chu, Wenda, et autres
Publié: (2026)
par: Chu, Wenda, et autres
Publié: (2026)
One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression
par: Miwa, Keita, et autres
Publié: (2025)
par: Miwa, Keita, et autres
Publié: (2025)
Spectral and Spatial Graph Learning for Multispectral Solar Image Compression
par: Siwakoti, Prasiddha, et autres
Publié: (2025)
par: Siwakoti, Prasiddha, et autres
Publié: (2025)
Clustering-Guided Spatial-Spectral Mamba for Hyperspectral Image Classification
par: Dewis, Zack, et autres
Publié: (2026)
par: Dewis, Zack, et autres
Publié: (2026)
FlexTok: Resampling Images into 1D Token Sequences of Flexible Length
par: Bachmann, Roman, et autres
Publié: (2025)
par: Bachmann, Roman, et autres
Publié: (2025)
Boosting Text-to-Image Diffusion Models via Core Token Attention-Based Seed Selection
par: Zhang, Yunzhe, et autres
Publié: (2026)
par: Zhang, Yunzhe, et autres
Publié: (2026)
GeoToken: Hierarchical Geolocalization of Images via Next Token Prediction
par: Ghasemi, Narges, et autres
Publié: (2025)
par: Ghasemi, Narges, et autres
Publié: (2025)
Network Inversion and Its Applications
par: Suhail, Pirzada, et autres
Publié: (2024)
par: Suhail, Pirzada, et autres
Publié: (2024)
HyperTokens: Controlling Token Dynamics for Continual Video-Language Understanding
par: Nguyen, Toan, et autres
Publié: (2026)
par: Nguyen, Toan, et autres
Publié: (2026)
MetaToken: Detecting Hallucination in Image Descriptions by Meta Classification
par: Fieback, Laura, et autres
Publié: (2024)
par: Fieback, Laura, et autres
Publié: (2024)
Hallucinatory Image Tokens: A Training-free EAZY Approach on Detecting and Mitigating Object Hallucinations in LVLMs
par: Che, Liwei, et autres
Publié: (2025)
par: Che, Liwei, et autres
Publié: (2025)
Hyperspectral Image Spectral-Spatial Feature Extraction via Tensor Principal Component Analysis
par: Ren, Yuemei, et autres
Publié: (2024)
par: Ren, Yuemei, et autres
Publié: (2024)
Spectral Evolution Search: Efficient Inference-Time Scaling for Reward-Aligned Image Generation
par: Ye, Jinyan, et autres
Publié: (2026)
par: Ye, Jinyan, et autres
Publié: (2026)
Language-Guided Image Tokenization for Generation
par: Zha, Kaiwen, et autres
Publié: (2024)
par: Zha, Kaiwen, et autres
Publié: (2024)
Diffusion Autoencoders are Scalable Image Tokenizers
par: Chen, Yinbo, et autres
Publié: (2025)
par: Chen, Yinbo, et autres
Publié: (2025)
High-Resolution Image Reconstruction with Unsupervised Learning and Noisy Data Applied to Ion-Beam Dynamics for Particle Accelerators
par: Osswald, Francis, et autres
Publié: (2026)
par: Osswald, Francis, et autres
Publié: (2026)
SAMSA: Segment Anything Model Enhanced with Spectral Angles for Hyperspectral Interactive Medical Image Segmentation
par: Roddan, Alfie, et autres
Publié: (2025)
par: Roddan, Alfie, et autres
Publié: (2025)
Prioritizing Image-Related Tokens Enhances Vision-Language Pre-Training
par: Chen, Yangyi, et autres
Publié: (2025)
par: Chen, Yangyi, et autres
Publié: (2025)
Deep Spectral Clustering via Joint Spectral Embedding and Kmeans
par: Guo, Wengang, et autres
Publié: (2024)
par: Guo, Wengang, et autres
Publié: (2024)
Documents similaires
-
Spectrally-Guided Diffusion Noise Schedules
par: Esteves, Carlos, et autres
Publié: (2026) -
Factorized Video Autoencoders for Efficient Generative Modelling
par: Suhail, Mohammed, et autres
Publié: (2024) -
Single Mesh Diffusion Models with Field Latents for Texture Generation
par: Mitchel, Thomas W., et autres
Publié: (2023) -
Learning to Transform for Generalizable Instance-wise Invariance
par: Singhal, Utkarsh, et autres
Publié: (2023) -
Decomposing Private Image Generation via Coarse-to-Fine Wavelet Modeling
par: Bayrooti, Jasmine, et autres
Publié: (2026)