EchoGen: Generating Visual Echoes in Any Scene via Feed-Forward Subject-Driven Auto-Regressive Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Ruixiao, Wang, Zhendong, Liu, Keli, Li, Li, Chen, Ying, Li, Kai, Li, Daowen, Li, Houqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ProGVC: Progressive-based Generative Video Compression via Auto-Regressive Context Modeling
par: Li, Daowen, et autres
Publié: (2026)
par: Li, Daowen, et autres
Publié: (2026)
ScaleWeaver: Weaving Efficient Controllable T2I Generation with Multi-Scale Reference Attention
par: Liu, Keli, et autres
Publié: (2025)
par: Liu, Keli, et autres
Publié: (2025)
EchoGen: Cycle-Consistent Learning for Unified Layout-Image Generation and Understanding
par: Zou, Kai, et autres
Publié: (2026)
par: Zou, Kai, et autres
Publié: (2026)
StepVAR: Structure-Texture Guided Pruning for Visual Autoregressive Models
par: Liu, Keli, et autres
Publié: (2026)
par: Liu, Keli, et autres
Publié: (2026)
Controllable Generative Video Compression
par: Ding, Ding, et autres
Publié: (2026)
par: Ding, Ding, et autres
Publié: (2026)
Deep Lossless Image Compression via Masked Sampling and Coarse-to-Fine Auto-Regression
par: Li, Tiantian, et autres
Publié: (2025)
par: Li, Tiantian, et autres
Publié: (2025)
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation
par: Chai, Shang, et autres
Publié: (2025)
par: Chai, Shang, et autres
Publié: (2025)
DriveGen3D: Boosting Feed-Forward Driving Scene Generation with Efficient Video Diffusion
par: Wang, Weijie, et autres
Publié: (2025)
par: Wang, Weijie, et autres
Publié: (2025)
Gen3R: 3D Scene Generation Meets Feed-Forward Reconstruction
par: Huang, Jiaxin, et autres
Publié: (2026)
par: Huang, Jiaxin, et autres
Publié: (2026)
GenXD: Generating Any 3D and 4D Scenes
par: Zhao, Yuyang, et autres
Publié: (2024)
par: Zhao, Yuyang, et autres
Publié: (2024)
EchoPrune: Interpreting Redundancy as Temporal Echoes for Efficient VideoLLMs
par: Li, Jiameng, et autres
Publié: (2026)
par: Li, Jiameng, et autres
Publié: (2026)
DelowlightSplat: Feed-Forward Gaussian Splatting for Lowlight 3D Scene Reconstruction
par: Jiang, Fuzhen, et autres
Publié: (2026)
par: Jiang, Fuzhen, et autres
Publié: (2026)
FreeGen: Feed-Forward Reconstruction-Generation Co-Training for Free-Viewpoint Driving Scene Synthesis
par: Chen, Shijie, et autres
Publié: (2025)
par: Chen, Shijie, et autres
Publié: (2025)
DenoiseSplat: Feed-Forward Gaussian Splatting for Noisy 3D Scene Reconstruction
par: Jiang, Fuzhen, et autres
Publié: (2026)
par: Jiang, Fuzhen, et autres
Publié: (2026)
UniSH: Unifying Scene and Human Reconstruction in a Feed-Forward Pass
par: Li, Mengfei, et autres
Publié: (2026)
par: Li, Mengfei, et autres
Publié: (2026)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
par: Wang, Zhendong, et autres
Publié: (2025)
par: Wang, Zhendong, et autres
Publié: (2025)
Motion-aware 3D Gaussian Splatting for Efficient Dynamic Scene Reconstruction
par: Guo, Zhiyang, et autres
Publié: (2024)
par: Guo, Zhiyang, et autres
Publié: (2024)
Forest2Seq: Revitalizing Order Prior for Sequential Indoor Scene Synthesis
par: Sun, Qi, et autres
Publié: (2024)
par: Sun, Qi, et autres
Publié: (2024)
LibraGen: Playing a Balance Game in Subject-Driven Video Generation
par: Zhu, Jiahao, et autres
Publié: (2026)
par: Zhu, Jiahao, et autres
Publié: (2026)
Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation
par: Yang, Yuanbo, et autres
Publié: (2024)
par: Yang, Yuanbo, et autres
Publié: (2024)
Generate Any Scene: Scene Graph Driven Data Synthesis for Visual Generation Training
par: Gao, Ziqi, et autres
Publié: (2024)
par: Gao, Ziqi, et autres
Publié: (2024)
TriSplat: Simulation-Ready Feed-Forward 3D Scene Reconstruction
par: Wang, Weijie, et autres
Publié: (2026)
par: Wang, Weijie, et autres
Publié: (2026)
MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
par: Gao, Ruiyuan, et autres
Publié: (2024)
par: Gao, Ruiyuan, et autres
Publié: (2024)
FLEG: Feed-Forward Language Embedded Gaussian Splatting from Any Views via Compact Semantic Representation
par: Tian, Qijian, et autres
Publié: (2025)
par: Tian, Qijian, et autres
Publié: (2025)
SemanticSplat: Feed-Forward 3D Scene Understanding with Language-Aware Gaussian Fields
par: Li, Qijing, et autres
Publié: (2025)
par: Li, Qijing, et autres
Publié: (2025)
Multi-modal Sensor Fusion for Auto Driving Perception: A Survey
par: Huang, Keli, et autres
Publié: (2022)
par: Huang, Keli, et autres
Publié: (2022)
Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion
par: Jevtić, Aleksandar, et autres
Publié: (2025)
par: Jevtić, Aleksandar, et autres
Publié: (2025)
MASt3R-Fusion: Integrating Feed-Forward Visual Model with IMU, GNSS for High-Functionality SLAM
par: Zhou, Yuxuan, et autres
Publié: (2025)
par: Zhou, Yuxuan, et autres
Publié: (2025)
EchoScene: Indoor Scene Generation via Information Echo over Scene Graph Diffusion
par: Zhai, Guangyao, et autres
Publié: (2024)
par: Zhai, Guangyao, et autres
Publié: (2024)
Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective
par: Wang, Weijie, et autres
Publié: (2026)
par: Wang, Weijie, et autres
Publié: (2026)
AdaptVision: Dynamic Input Scaling in MLLMs for Versatile Scene Understanding
par: Wang, Yonghui, et autres
Publié: (2024)
par: Wang, Yonghui, et autres
Publié: (2024)
Spatial Decomposition and Temporal Fusion based Inter Prediction for Learned Video Compression
par: Sheng, Xihua, et autres
Publié: (2024)
par: Sheng, Xihua, et autres
Publié: (2024)
Prediction and Reference Quality Adaptation for Learned Video Compression
par: Sheng, Xihua, et autres
Publié: (2024)
par: Sheng, Xihua, et autres
Publié: (2024)
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
par: Liu, Xuewen, et autres
Publié: (2026)
par: Liu, Xuewen, et autres
Publié: (2026)
VGD: Visual Geometry Gaussian Splatting for Feed-Forward Surround-view Driving Reconstruction
par: Lin, Junhong, et autres
Publié: (2025)
par: Lin, Junhong, et autres
Publié: (2025)
DrivingScene: A Multi-Task Online Feed-Forward 3D Gaussian Splatting Method for Dynamic Driving Scenes
par: Hou, Qirui, et autres
Publié: (2025)
par: Hou, Qirui, et autres
Publié: (2025)
Unbiased Video Scene Graph Generation via Visual and Semantic Dual Debiasing
par: Li, Yanjun, et autres
Publié: (2025)
par: Li, Yanjun, et autres
Publié: (2025)
ROOT: VLM based System for Indoor Scene Understanding and Beyond
par: Wang, Yonghui, et autres
Publié: (2024)
par: Wang, Yonghui, et autres
Publié: (2024)
Auto Cherry-Picker: Learning from High-quality Generative Data Driven by Language
par: Chen, Yicheng, et autres
Publié: (2024)
par: Chen, Yicheng, et autres
Publié: (2024)
AnimateAnyMesh: A Feed-Forward 4D Foundation Model for Text-Driven Universal Mesh Animation
par: Wu, Zijie, et autres
Publié: (2025)
par: Wu, Zijie, et autres
Publié: (2025)
Documents similaires
-
ProGVC: Progressive-based Generative Video Compression via Auto-Regressive Context Modeling
par: Li, Daowen, et autres
Publié: (2026) -
ScaleWeaver: Weaving Efficient Controllable T2I Generation with Multi-Scale Reference Attention
par: Liu, Keli, et autres
Publié: (2025) -
EchoGen: Cycle-Consistent Learning for Unified Layout-Image Generation and Understanding
par: Zou, Kai, et autres
Publié: (2026) -
StepVAR: Structure-Texture Guided Pruning for Visual Autoregressive Models
par: Liu, Keli, et autres
Publié: (2026) -
Controllable Generative Video Compression
par: Ding, Ding, et autres
Publié: (2026)