Does Engram Do Memory Retrieval in Autoregressive Image Generation?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jinghao, He, Qiyuan, Gu, Chunbin, Heng, Pheng-Ann |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
REAR: Rethinking Visual Autoregressive Models via Generator-Tokenizer Consistency Regularization
par: He, Qiyuan, et autres
Publié: (2025)
par: He, Qiyuan, et autres
Publié: (2025)
AID: Attention Interpolation of Text-to-Image Diffusion
par: He, Qiyuan, et autres
Publié: (2024)
par: He, Qiyuan, et autres
Publié: (2024)
VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation
par: Liao, Xinyao, et autres
Publié: (2026)
par: Liao, Xinyao, et autres
Publié: (2026)
Memory-Efficient Prompt Tuning for Incremental Histopathology Classification
par: Zhu, Yu, et autres
Publié: (2024)
par: Zhu, Yu, et autres
Publié: (2024)
Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting
par: Li, Wei, et autres
Publié: (2024)
par: Li, Wei, et autres
Publié: (2024)
Unifying Physically-Informed Weather Priors in A Single Model for Image Restoration Across Multiple Adverse Weather Conditions
par: Xu, Jiaqi, et autres
Publié: (2026)
par: Xu, Jiaqi, et autres
Publié: (2026)
AR-RAG: Autoregressive Retrieval Augmentation for Image Generation
par: Qi, Jingyuan, et autres
Publié: (2025)
par: Qi, Jingyuan, et autres
Publié: (2025)
Tri-modal Confluence with Temporal Dynamics for Scene Graph Generation in Operating Rooms
par: Guo, Diandian, et autres
Publié: (2024)
par: Guo, Diandian, et autres
Publié: (2024)
Towards Synchronous Memorizability and Generalizability with Site-Modulated Diffusion Replay for Cross-Site Continual Segmentation
par: Xu, Dunyuan, et autres
Publié: (2024)
par: Xu, Dunyuan, et autres
Publié: (2024)
Deep Omni-supervised Learning for Rib Fracture Detection from Chest Radiology Images
par: Chai, Zhizhong, et autres
Publié: (2023)
par: Chai, Zhizhong, et autres
Publié: (2023)
Unveiling Deep Shadows: A Survey and Benchmark on Image and Video Shadow Detection, Removal, and Generation in the Deep Learning Era
par: Hu, Xiaowei, et autres
Publié: (2024)
par: Hu, Xiaowei, et autres
Publié: (2024)
Tiny-Engram: Trigger-Indexed Concept Tables for Generative Vision
par: Cai, Runyuan, et autres
Publié: (2026)
par: Cai, Runyuan, et autres
Publié: (2026)
UniHOPE: A Unified Approach for Hand-Only and Hand-Object Pose Estimation
par: Wang, Yinqiao, et autres
Publié: (2025)
par: Wang, Yinqiao, et autres
Publié: (2025)
SiMA-Hand: Boosting 3D Hand-Mesh Reconstruction by Single-to-Multi-View Adaptation
par: Wang, Yinqiao, et autres
Publié: (2024)
par: Wang, Yinqiao, et autres
Publié: (2024)
Unlocking Positive Transfer in Incrementally Learning Surgical Instruments: A Self-reflection Hierarchical Prompt Framework
par: Zhu, Yu, et autres
Publié: (2026)
par: Zhu, Yu, et autres
Publié: (2026)
Cross Prompting Consistency with Segment Anything Model for Semi-supervised Medical Image Segmentation
par: Miao, Juzheng, et autres
Publié: (2024)
par: Miao, Juzheng, et autres
Publié: (2024)
Autoregressive Image Generation without Vector Quantization
par: Li, Tianhong, et autres
Publié: (2024)
par: Li, Tianhong, et autres
Publié: (2024)
G2Face: High-Fidelity Reversible Face Anonymization via Generative and Geometric Priors
par: Yang, Haoxin, et autres
Publié: (2024)
par: Yang, Haoxin, et autres
Publié: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
S^2Former-OR: Single-Stage Bi-Modal Transformer for Scene Graph Generation in OR
par: Pei, Jialun, et autres
Publié: (2024)
par: Pei, Jialun, et autres
Publié: (2024)
Conceptrol: Concept Control of Zero-shot Personalized Image Generation
par: He, Qiyuan, et autres
Publié: (2025)
par: He, Qiyuan, et autres
Publié: (2025)
Cross-modality Guidance-aided Multi-modal Learning with Dual Attention for MRI Brain Tumor Grading
par: Xu, Dunyuan, et autres
Publié: (2024)
par: Xu, Dunyuan, et autres
Publié: (2024)
SurgLQA: Scalable Long-Horizon Surgical Video Question Answering
par: Guo, Diandian, et autres
Publié: (2026)
par: Guo, Diandian, et autres
Publié: (2026)
Surgical Workflow Recognition and Blocking Effectiveness Detection in Laparoscopic Liver Resections with Pringle Maneuver
par: Guo, Diandian, et autres
Publié: (2024)
par: Guo, Diandian, et autres
Publié: (2024)
From Learning to Unlearning: Biomedical Security Protection in Multimodal Large Language Models
par: Xu, Dunyuan, et autres
Publié: (2025)
par: Xu, Dunyuan, et autres
Publié: (2025)
Benchmarking Endoscopic Surgical Image Restoration and Beyond
par: Pei, Jialun, et autres
Publié: (2025)
par: Pei, Jialun, et autres
Publié: (2025)
Autoregressive Image Generation with Masked Bit Modeling
par: Yu, Qihang, et autres
Publié: (2026)
par: Yu, Qihang, et autres
Publié: (2026)
Exploiting Discriminative Codebook Prior for Autoregressive Image Generation
par: Tang, Longxiang, et autres
Publié: (2025)
par: Tang, Longxiang, et autres
Publié: (2025)
Topology-Constrained Learning for Efficient Laparoscopic Liver Landmark Detection
par: Cui, Ruize, et autres
Publié: (2025)
par: Cui, Ruize, et autres
Publié: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
FlashAR: Efficient Post-Training Acceleration for Autoregressive Image Generation
par: Zhou, Junkang, et autres
Publié: (2026)
par: Zhou, Junkang, et autres
Publié: (2026)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
par: Song, Quanjian, et autres
Publié: (2025)
par: Song, Quanjian, et autres
Publié: (2025)
Multi-scale Spatio-temporal Transformer-based Imbalanced Longitudinal Learning for Glaucoma Forecasting from Irregular Time Series Images
par: Yang, Xikai, et autres
Publié: (2024)
par: Yang, Xikai, et autres
Publié: (2024)
Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models
par: Xu, Jiaqi, et autres
Publié: (2024)
par: Xu, Jiaqi, et autres
Publié: (2024)
Scalable Autoregressive Image Generation with Mamba
par: Li, Haopeng, et autres
Publié: (2024)
par: Li, Haopeng, et autres
Publié: (2024)
Revisiting Shadow Detection: A New Benchmark Dataset for Complex World
par: Hu, Xiaowei, et autres
Publié: (2019)
par: Hu, Xiaowei, et autres
Publié: (2019)
MS2Mesh-XR: Multi-modal Sketch-to-Mesh Generation in XR Environments
par: Tong, Yuqi, et autres
Publié: (2024)
par: Tong, Yuqi, et autres
Publié: (2024)
HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model
par: Liu, Jiaming, et autres
Publié: (2025)
par: Liu, Jiaming, et autres
Publié: (2025)
FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model
par: Cao, Yukang, et autres
Publié: (2025)
par: Cao, Yukang, et autres
Publié: (2025)
Improving Flexible Image Tokenizers for Autoregressive Image Generation
par: Fu, Zixuan, et autres
Publié: (2026)
par: Fu, Zixuan, et autres
Publié: (2026)
Documents similaires
-
REAR: Rethinking Visual Autoregressive Models via Generator-Tokenizer Consistency Regularization
par: He, Qiyuan, et autres
Publié: (2025) -
AID: Attention Interpolation of Text-to-Image Diffusion
par: He, Qiyuan, et autres
Publié: (2024) -
VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation
par: Liao, Xinyao, et autres
Publié: (2026) -
Memory-Efficient Prompt Tuning for Incremental Histopathology Classification
par: Zhu, Yu, et autres
Publié: (2024) -
Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting
par: Li, Wei, et autres
Publié: (2024)