LSReGen: Large-Scale Regional Generator via Backward Guidance Framework
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Bowen, Yang, Cheng, Liu, Xuanhui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Arbitrary-Scale Spacecraft Image Super-Resolution via Salient Region-Guidance
por: Yang, Jingfan, et al.
Publicado: (2025)
por: Yang, Jingfan, et al.
Publicado: (2025)
UniMapGen: A Generative Framework for Large-Scale Map Construction from Multi-modal Data
por: Yuan, Yujian, et al.
Publicado: (2025)
por: Yuan, Yujian, et al.
Publicado: (2025)
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
por: Chen, Yuqing, et al.
Publicado: (2026)
por: Chen, Yuqing, et al.
Publicado: (2026)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
por: Tan, Zhiyu, et al.
Publicado: (2024)
por: Tan, Zhiyu, et al.
Publicado: (2024)
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
por: Jiang, Kaixun, et al.
Publicado: (2026)
por: Jiang, Kaixun, et al.
Publicado: (2026)
Controllable Generation of Large-Scale 3D Urban Layouts with Semantic and Structural Guidance
por: Niu, Mengyuan, et al.
Publicado: (2025)
por: Niu, Mengyuan, et al.
Publicado: (2025)
ExpertGen: Training-Free Expert Guidance for Controllable Text-to-Face Generation
por: Shi, Liang, et al.
Publicado: (2025)
por: Shi, Liang, et al.
Publicado: (2025)
EliGen: Entity-Level Controlled Image Generation with Regional Attention
por: Zhang, Hong, et al.
Publicado: (2025)
por: Zhang, Hong, et al.
Publicado: (2025)
Scaling Backwards: Minimal Synthetic Pre-training?
por: Nakamura, Ryo, et al.
Publicado: (2024)
por: Nakamura, Ryo, et al.
Publicado: (2024)
Layout Control and Semantic Guidance with Attention Loss Backward for T2I Diffusion Model
por: Li, Guandong
Publicado: (2024)
por: Li, Guandong
Publicado: (2024)
UniFlowRestore: A General Video Restoration Framework via Flow Matching and Prompt Guidance
por: Sun, Shuning, et al.
Publicado: (2025)
por: Sun, Shuning, et al.
Publicado: (2025)
Follow Your Motion: A Generic Temporal Consistency Portrait Editing Framework with Trajectory Guidance
por: Yang, Haijie, et al.
Publicado: (2025)
por: Yang, Haijie, et al.
Publicado: (2025)
SSG: Scaled Spatial Guidance for Multi-Scale Visual Autoregressive Generation
por: Shin, Youngwoo, et al.
Publicado: (2026)
por: Shin, Youngwoo, et al.
Publicado: (2026)
Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
por: Chu, Ruihang, et al.
Publicado: (2025)
por: Chu, Ruihang, et al.
Publicado: (2025)
GenAR: Next-Scale Autoregressive Generation for Spatial Gene Expression Prediction
por: Ouyang, Jiarui, et al.
Publicado: (2025)
por: Ouyang, Jiarui, et al.
Publicado: (2025)
ScaleMoGen: Autoregressive Next-Scale Prediction for Human Motion Generation
por: Hwang, Inwoo, et al.
Publicado: (2026)
por: Hwang, Inwoo, et al.
Publicado: (2026)
SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment
por: Zhao, Weiren, et al.
Publicado: (2026)
por: Zhao, Weiren, et al.
Publicado: (2026)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
por: Zhang, Weitian, et al.
Publicado: (2024)
por: Zhang, Weitian, et al.
Publicado: (2024)
RetiGen: A Framework for Generalized Retinal Diagnosis Using Multi-View Fundus Images
por: Chen, Ze, et al.
Publicado: (2024)
por: Chen, Ze, et al.
Publicado: (2024)
GenMask: Adapting DiT for Segmentation via Direct Mask Generation
por: Yang, Yuhuan, et al.
Publicado: (2026)
por: Yang, Yuhuan, et al.
Publicado: (2026)
StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation
por: Zhai, Shangjin, et al.
Publicado: (2025)
por: Zhai, Shangjin, et al.
Publicado: (2025)
Diffusion-based Aesthetic QR Code Generation via Scanning-Robust Perceptual Guidance
por: Liao, Jia-Wei, et al.
Publicado: (2024)
por: Liao, Jia-Wei, et al.
Publicado: (2024)
Flowing Backwards: Improving Normalizing Flows via Reverse Representation Alignment
por: Chen, Yang, et al.
Publicado: (2025)
por: Chen, Yang, et al.
Publicado: (2025)
ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework
por: Chen, Guanzhou, et al.
Publicado: (2026)
por: Chen, Guanzhou, et al.
Publicado: (2026)
SpikeGen: Decoupled "Rods and Cones" Visual Representation Processing with Latent Generative Framework
por: Dai, Gaole, et al.
Publicado: (2025)
por: Dai, Gaole, et al.
Publicado: (2025)
MoGen: A Unified Collaborative Framework for Controllable Multi-Object Image Generation
por: Li, Yanfeng, et al.
Publicado: (2026)
por: Li, Yanfeng, et al.
Publicado: (2026)
DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark
por: Chen, Haoxing, et al.
Publicado: (2024)
por: Chen, Haoxing, et al.
Publicado: (2024)
GenKOL: Modular Generative AI Framework For Scalable Virtual KOL Generation
por: To, Tan-Hiep, et al.
Publicado: (2025)
por: To, Tan-Hiep, et al.
Publicado: (2025)
Conditional Text-to-Image Generation with Reference Guidance
por: Kim, Taewook, et al.
Publicado: (2024)
por: Kim, Taewook, et al.
Publicado: (2024)
SQuadGen: Generating Simple Quad Layouts via Chart Distance Fields
por: Kong, Youkang, et al.
Publicado: (2026)
por: Kong, Youkang, et al.
Publicado: (2026)
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
por: Wei, Yujie, et al.
Publicado: (2025)
por: Wei, Yujie, et al.
Publicado: (2025)
ORID: Organ-Regional Information Driven Framework for Radiology Report Generation
por: Gu, Tiancheng, et al.
Publicado: (2024)
por: Gu, Tiancheng, et al.
Publicado: (2024)
Backward-Compatible Aligned Representations via an Orthogonal Transformation Layer
por: Ricci, Simone, et al.
Publicado: (2024)
por: Ricci, Simone, et al.
Publicado: (2024)
PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net
por: Yin, Jun, et al.
Publicado: (2025)
por: Yin, Jun, et al.
Publicado: (2025)
PivotMesh: Generic 3D Mesh Generation via Pivot Vertices Guidance
por: Weng, Haohan, et al.
Publicado: (2024)
por: Weng, Haohan, et al.
Publicado: (2024)
WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion
por: Wu, Yang, et al.
Publicado: (2025)
por: Wu, Yang, et al.
Publicado: (2025)
LipGen: Viseme-Guided Lip Video Generation for Enhancing Visual Speech Recognition
por: Hao, Bowen, et al.
Publicado: (2025)
por: Hao, Bowen, et al.
Publicado: (2025)
Classifier-free Guidance with Adaptive Scaling
por: Malarz, Dawid, et al.
Publicado: (2025)
por: Malarz, Dawid, et al.
Publicado: (2025)
SkyLink: A Large Vision-Language Model Driven Re-ranking Framework for Cross-View UAV geolocalization
por: Liu, Bowen, et al.
Publicado: (2026)
por: Liu, Bowen, et al.
Publicado: (2026)
GenMed: A Pairwise Generative Reformulation of Medical Diagnostic Tasks
por: Zhang, Hantao, et al.
Publicado: (2026)
por: Zhang, Hantao, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Arbitrary-Scale Spacecraft Image Super-Resolution via Salient Region-Guidance
por: Yang, Jingfan, et al.
Publicado: (2025) -
UniMapGen: A Generative Framework for Large-Scale Map Construction from Multi-modal Data
por: Yuan, Yujian, et al.
Publicado: (2025) -
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
por: Chen, Yuqing, et al.
Publicado: (2026) -
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
por: Tan, Zhiyu, et al.
Publicado: (2024) -
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
por: Jiang, Kaixun, et al.
Publicado: (2026)