MemRoPE: Training-Free Infinite Video Generation via Evolving Memory Tokens
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kim, Youngrae, Hu, Qixin, Kuo, C. -C. Jay, Beerel, Peter A. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autoregressive Self-Rollout
von: Yesiltepe, Hidir, et al.
Veröffentlicht: (2025)
von: Yesiltepe, Hidir, et al.
Veröffentlicht: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
HIVTP: A Training-Free Method to Improve VLMs Efficiency via Hierarchical Visual Token Pruning Using Middle-Layer-Based Importance Score
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos
von: Feng, X., et al.
Veröffentlicht: (2026)
von: Feng, X., et al.
Veröffentlicht: (2026)
ReRoPE: Repurposing RoPE for Relative Camera Control
von: Li, Chunyang, et al.
Veröffentlicht: (2026)
von: Li, Chunyang, et al.
Veröffentlicht: (2026)
Training-Free Efficient Video Generation via Dynamic Token Carving
von: Zhang, Yuechen, et al.
Veröffentlicht: (2025)
von: Zhang, Yuechen, et al.
Veröffentlicht: (2025)
DEVIAS: Learning Disentangled Video Representations of Action and Scene
von: Bae, Kyungho, et al.
Veröffentlicht: (2023)
von: Bae, Kyungho, et al.
Veröffentlicht: (2023)
VideoRoPE: What Makes for Good Video Rotary Position Embedding?
von: Wei, Xilin, et al.
Veröffentlicht: (2025)
von: Wei, Xilin, et al.
Veröffentlicht: (2025)
RoPECraft: Training-Free Motion Transfer with Trajectory-Guided RoPE Optimization on Diffusion Transformers
von: Gokmen, Ahmet Berke, et al.
Veröffentlicht: (2025)
von: Gokmen, Ahmet Berke, et al.
Veröffentlicht: (2025)
SlotVTG: Object-Centric Adapter for Generalizable Video Temporal Grounding
von: Han, Jiwook, et al.
Veröffentlicht: (2026)
von: Han, Jiwook, et al.
Veröffentlicht: (2026)
OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation
von: Zhao, Lin, et al.
Veröffentlicht: (2026)
von: Zhao, Lin, et al.
Veröffentlicht: (2026)
VideoMem: Enhancing Ultra-Long Video Understanding via Adaptive Memory Management
von: Jin, Hongbo, et al.
Veröffentlicht: (2025)
von: Jin, Hongbo, et al.
Veröffentlicht: (2025)
Anchor Forcing: Anchor Memory and Tri-Region RoPE for Interactive Streaming Video Diffusion
von: Yang, Yang, et al.
Veröffentlicht: (2026)
von: Yang, Yang, et al.
Veröffentlicht: (2026)
Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
von: Liu, Jinzhuo, et al.
Veröffentlicht: (2026)
von: Liu, Jinzhuo, et al.
Veröffentlicht: (2026)
FPAN: Mitigating Replication in Diffusion Models through the Fine-Grained Probabilistic Addition of Noise to Token Embeddings
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
StoryMem: Multi-shot Long Video Storytelling with Memory
von: Zhang, Kaiwen, et al.
Veröffentlicht: (2025)
von: Zhang, Kaiwen, et al.
Veröffentlicht: (2025)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
von: Ma, Xiaoyu, et al.
Veröffentlicht: (2026)
von: Ma, Xiaoyu, et al.
Veröffentlicht: (2026)
UI-Mem: Self-Evolving Experience Memory for Online Reinforcement Learning in Mobile GUI Agents
von: Xiao, Han, et al.
Veröffentlicht: (2026)
von: Xiao, Han, et al.
Veröffentlicht: (2026)
Infinite-Story: A Training-Free Consistent Text-to-Image Generation
von: Park, Jihun, et al.
Veröffentlicht: (2025)
von: Park, Jihun, et al.
Veröffentlicht: (2025)
EVIDENT: Routing MLLM Adaptation through Entity-Grounded Visual Evidence for Cross-Domain Video Temporal Grounding
von: Ahn, Geo, et al.
Veröffentlicht: (2026)
von: Ahn, Geo, et al.
Veröffentlicht: (2026)
vid-TLDR: Training Free Token merging for Light-weight Video Transformer
von: Choi, Joonmyung, et al.
Veröffentlicht: (2024)
von: Choi, Joonmyung, et al.
Veröffentlicht: (2024)
MemCam: Memory-Augmented Camera Control for Consistent Video Generation
von: Gao, Xinhang, et al.
Veröffentlicht: (2026)
von: Gao, Xinhang, et al.
Veröffentlicht: (2026)
MosaicMem: Hybrid Spatial Memory for Controllable Video World Models
von: Yu, Wei, et al.
Veröffentlicht: (2026)
von: Yu, Wei, et al.
Veröffentlicht: (2026)
FIFO-Diffusion: Generating Infinite Videos from Text without Training
von: Kim, Jihwan, et al.
Veröffentlicht: (2024)
von: Kim, Jihwan, et al.
Veröffentlicht: (2024)
Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training
von: Liu, Changkun, et al.
Veröffentlicht: (2026)
von: Liu, Changkun, et al.
Veröffentlicht: (2026)
FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing
von: Wei, Tianyi, et al.
Veröffentlicht: (2025)
von: Wei, Tianyi, et al.
Veröffentlicht: (2025)
Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning
von: Gao, Xianqiang, et al.
Veröffentlicht: (2026)
von: Gao, Xianqiang, et al.
Veröffentlicht: (2026)
MemFlow: Flowing Adaptive Memory for Consistent and Efficient Long Video Narratives
von: Ji, Sihui, et al.
Veröffentlicht: (2025)
von: Ji, Sihui, et al.
Veröffentlicht: (2025)
$\infty$-Video: A Training-Free Approach to Long Video Understanding via Continuous-Time Memory Consolidation
von: Santos, Saul, et al.
Veröffentlicht: (2025)
von: Santos, Saul, et al.
Veröffentlicht: (2025)
Evolving Token Communication with Parametric Memory Network
von: Chen, Weixuan, et al.
Veröffentlicht: (2026)
von: Chen, Weixuan, et al.
Veröffentlicht: (2026)
FluxMem: Adaptive Hierarchical Memory for Streaming Video Understanding
von: Xie, Yiweng, et al.
Veröffentlicht: (2026)
von: Xie, Yiweng, et al.
Veröffentlicht: (2026)
VideoMemory: Toward Consistent Video Generation via Memory Integration
von: Zhou, Jinsong, et al.
Veröffentlicht: (2026)
von: Zhou, Jinsong, et al.
Veröffentlicht: (2026)
Infinite-Homography as Robust Conditioning for Camera-Controlled Video Generation
von: Kim, Min-Jung, et al.
Veröffentlicht: (2025)
von: Kim, Min-Jung, et al.
Veröffentlicht: (2025)
MemOVCD: Training-Free Open-Vocabulary Change Detection via Cross-Temporal Memory Reasoning and Global-Local Adaptive Rectification
von: Kuang, Zuzheng, et al.
Veröffentlicht: (2026)
von: Kuang, Zuzheng, et al.
Veröffentlicht: (2026)
LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
von: Xiao, Yang, et al.
Veröffentlicht: (2025)
FreeAction: Training-Free Techniques for Enhanced Fidelity of Trajectory-to-Video Generation
von: Kim, Seungwook, et al.
Veröffentlicht: (2025)
von: Kim, Seungwook, et al.
Veröffentlicht: (2025)
KTV: Keyframes and Key Tokens Selection for Efficient Training-Free Video LLMs
von: Song, Baiyang, et al.
Veröffentlicht: (2026)
von: Song, Baiyang, et al.
Veröffentlicht: (2026)
Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs
von: Hyun, Jeongseok, et al.
Veröffentlicht: (2025)
von: Hyun, Jeongseok, et al.
Veröffentlicht: (2025)
Block Selective Reprogramming for On-device Training of Vision Transformers
von: Sarkar, Sreetama, et al.
Veröffentlicht: (2024)
von: Sarkar, Sreetama, et al.
Veröffentlicht: (2024)
FreeSpec: Training-Free Long Video Generation via Singular-Spectrum Reconstruction
von: Chen, Fangda, et al.
Veröffentlicht: (2026)
von: Chen, Fangda, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autoregressive Self-Rollout
von: Yesiltepe, Hidir, et al.
Veröffentlicht: (2025) -
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
von: Xu, Jingqi, et al.
Veröffentlicht: (2025) -
HIVTP: A Training-Free Method to Improve VLMs Efficiency via Hierarchical Visual Token Pruning Using Middle-Layer-Based Importance Score
von: Xu, Jingqi, et al.
Veröffentlicht: (2025) -
Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos
von: Feng, X., et al.
Veröffentlicht: (2026) -
ReRoPE: Repurposing RoPE for Relative Camera Control
von: Li, Chunyang, et al.
Veröffentlicht: (2026)