Does Engram Do Memory Retrieval in Autoregressive Image Generation?
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Jinghao, He, Qiyuan, Gu, Chunbin, Heng, Pheng-Ann |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
REAR: Rethinking Visual Autoregressive Models via Generator-Tokenizer Consistency Regularization
por: He, Qiyuan, et al.
Publicado: (2025)
por: He, Qiyuan, et al.
Publicado: (2025)
AID: Attention Interpolation of Text-to-Image Diffusion
por: He, Qiyuan, et al.
Publicado: (2024)
por: He, Qiyuan, et al.
Publicado: (2024)
VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation
por: Liao, Xinyao, et al.
Publicado: (2026)
por: Liao, Xinyao, et al.
Publicado: (2026)
Memory-Efficient Prompt Tuning for Incremental Histopathology Classification
por: Zhu, Yu, et al.
Publicado: (2024)
por: Zhu, Yu, et al.
Publicado: (2024)
Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting
por: Li, Wei, et al.
Publicado: (2024)
por: Li, Wei, et al.
Publicado: (2024)
Unifying Physically-Informed Weather Priors in A Single Model for Image Restoration Across Multiple Adverse Weather Conditions
por: Xu, Jiaqi, et al.
Publicado: (2026)
por: Xu, Jiaqi, et al.
Publicado: (2026)
AR-RAG: Autoregressive Retrieval Augmentation for Image Generation
por: Qi, Jingyuan, et al.
Publicado: (2025)
por: Qi, Jingyuan, et al.
Publicado: (2025)
Tri-modal Confluence with Temporal Dynamics for Scene Graph Generation in Operating Rooms
por: Guo, Diandian, et al.
Publicado: (2024)
por: Guo, Diandian, et al.
Publicado: (2024)
Towards Synchronous Memorizability and Generalizability with Site-Modulated Diffusion Replay for Cross-Site Continual Segmentation
por: Xu, Dunyuan, et al.
Publicado: (2024)
por: Xu, Dunyuan, et al.
Publicado: (2024)
Deep Omni-supervised Learning for Rib Fracture Detection from Chest Radiology Images
por: Chai, Zhizhong, et al.
Publicado: (2023)
por: Chai, Zhizhong, et al.
Publicado: (2023)
Unveiling Deep Shadows: A Survey and Benchmark on Image and Video Shadow Detection, Removal, and Generation in the Deep Learning Era
por: Hu, Xiaowei, et al.
Publicado: (2024)
por: Hu, Xiaowei, et al.
Publicado: (2024)
Tiny-Engram: Trigger-Indexed Concept Tables for Generative Vision
por: Cai, Runyuan, et al.
Publicado: (2026)
por: Cai, Runyuan, et al.
Publicado: (2026)
UniHOPE: A Unified Approach for Hand-Only and Hand-Object Pose Estimation
por: Wang, Yinqiao, et al.
Publicado: (2025)
por: Wang, Yinqiao, et al.
Publicado: (2025)
SiMA-Hand: Boosting 3D Hand-Mesh Reconstruction by Single-to-Multi-View Adaptation
por: Wang, Yinqiao, et al.
Publicado: (2024)
por: Wang, Yinqiao, et al.
Publicado: (2024)
Unlocking Positive Transfer in Incrementally Learning Surgical Instruments: A Self-reflection Hierarchical Prompt Framework
por: Zhu, Yu, et al.
Publicado: (2026)
por: Zhu, Yu, et al.
Publicado: (2026)
Cross Prompting Consistency with Segment Anything Model for Semi-supervised Medical Image Segmentation
por: Miao, Juzheng, et al.
Publicado: (2024)
por: Miao, Juzheng, et al.
Publicado: (2024)
Autoregressive Image Generation without Vector Quantization
por: Li, Tianhong, et al.
Publicado: (2024)
por: Li, Tianhong, et al.
Publicado: (2024)
G2Face: High-Fidelity Reversible Face Anonymization via Generative and Geometric Priors
por: Yang, Haoxin, et al.
Publicado: (2024)
por: Yang, Haoxin, et al.
Publicado: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
S^2Former-OR: Single-Stage Bi-Modal Transformer for Scene Graph Generation in OR
por: Pei, Jialun, et al.
Publicado: (2024)
por: Pei, Jialun, et al.
Publicado: (2024)
Conceptrol: Concept Control of Zero-shot Personalized Image Generation
por: He, Qiyuan, et al.
Publicado: (2025)
por: He, Qiyuan, et al.
Publicado: (2025)
Cross-modality Guidance-aided Multi-modal Learning with Dual Attention for MRI Brain Tumor Grading
por: Xu, Dunyuan, et al.
Publicado: (2024)
por: Xu, Dunyuan, et al.
Publicado: (2024)
SurgLQA: Scalable Long-Horizon Surgical Video Question Answering
por: Guo, Diandian, et al.
Publicado: (2026)
por: Guo, Diandian, et al.
Publicado: (2026)
Surgical Workflow Recognition and Blocking Effectiveness Detection in Laparoscopic Liver Resections with Pringle Maneuver
por: Guo, Diandian, et al.
Publicado: (2024)
por: Guo, Diandian, et al.
Publicado: (2024)
From Learning to Unlearning: Biomedical Security Protection in Multimodal Large Language Models
por: Xu, Dunyuan, et al.
Publicado: (2025)
por: Xu, Dunyuan, et al.
Publicado: (2025)
Benchmarking Endoscopic Surgical Image Restoration and Beyond
por: Pei, Jialun, et al.
Publicado: (2025)
por: Pei, Jialun, et al.
Publicado: (2025)
Autoregressive Image Generation with Masked Bit Modeling
por: Yu, Qihang, et al.
Publicado: (2026)
por: Yu, Qihang, et al.
Publicado: (2026)
Exploiting Discriminative Codebook Prior for Autoregressive Image Generation
por: Tang, Longxiang, et al.
Publicado: (2025)
por: Tang, Longxiang, et al.
Publicado: (2025)
Topology-Constrained Learning for Efficient Laparoscopic Liver Landmark Detection
por: Cui, Ruize, et al.
Publicado: (2025)
por: Cui, Ruize, et al.
Publicado: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
FlashAR: Efficient Post-Training Acceleration for Autoregressive Image Generation
por: Zhou, Junkang, et al.
Publicado: (2026)
por: Zhou, Junkang, et al.
Publicado: (2026)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
por: Song, Quanjian, et al.
Publicado: (2025)
por: Song, Quanjian, et al.
Publicado: (2025)
Multi-scale Spatio-temporal Transformer-based Imbalanced Longitudinal Learning for Glaucoma Forecasting from Irregular Time Series Images
por: Yang, Xikai, et al.
Publicado: (2024)
por: Yang, Xikai, et al.
Publicado: (2024)
Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models
por: Xu, Jiaqi, et al.
Publicado: (2024)
por: Xu, Jiaqi, et al.
Publicado: (2024)
Scalable Autoregressive Image Generation with Mamba
por: Li, Haopeng, et al.
Publicado: (2024)
por: Li, Haopeng, et al.
Publicado: (2024)
Revisiting Shadow Detection: A New Benchmark Dataset for Complex World
por: Hu, Xiaowei, et al.
Publicado: (2019)
por: Hu, Xiaowei, et al.
Publicado: (2019)
MS2Mesh-XR: Multi-modal Sketch-to-Mesh Generation in XR Environments
por: Tong, Yuqi, et al.
Publicado: (2024)
por: Tong, Yuqi, et al.
Publicado: (2024)
HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model
por: Liu, Jiaming, et al.
Publicado: (2025)
por: Liu, Jiaming, et al.
Publicado: (2025)
FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model
por: Cao, Yukang, et al.
Publicado: (2025)
por: Cao, Yukang, et al.
Publicado: (2025)
Improving Flexible Image Tokenizers for Autoregressive Image Generation
por: Fu, Zixuan, et al.
Publicado: (2026)
por: Fu, Zixuan, et al.
Publicado: (2026)
Ejemplares similares
-
REAR: Rethinking Visual Autoregressive Models via Generator-Tokenizer Consistency Regularization
por: He, Qiyuan, et al.
Publicado: (2025) -
AID: Attention Interpolation of Text-to-Image Diffusion
por: He, Qiyuan, et al.
Publicado: (2024) -
VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation
por: Liao, Xinyao, et al.
Publicado: (2026) -
Memory-Efficient Prompt Tuning for Incremental Histopathology Classification
por: Zhu, Yu, et al.
Publicado: (2024) -
Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting
por: Li, Wei, et al.
Publicado: (2024)