LSReGen: Large-Scale Regional Generator via Backward Guidance Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Bowen, Yang, Cheng, Liu, Xuanhui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Arbitrary-Scale Spacecraft Image Super-Resolution via Salient Region-Guidance
par: Yang, Jingfan, et autres
Publié: (2025)
par: Yang, Jingfan, et autres
Publié: (2025)
UniMapGen: A Generative Framework for Large-Scale Map Construction from Multi-modal Data
par: Yuan, Yujian, et autres
Publié: (2025)
par: Yuan, Yujian, et autres
Publié: (2025)
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
par: Chen, Yuqing, et autres
Publié: (2026)
par: Chen, Yuqing, et autres
Publié: (2026)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
par: Tan, Zhiyu, et autres
Publié: (2024)
par: Tan, Zhiyu, et autres
Publié: (2024)
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
par: Jiang, Kaixun, et autres
Publié: (2026)
par: Jiang, Kaixun, et autres
Publié: (2026)
Controllable Generation of Large-Scale 3D Urban Layouts with Semantic and Structural Guidance
par: Niu, Mengyuan, et autres
Publié: (2025)
par: Niu, Mengyuan, et autres
Publié: (2025)
ExpertGen: Training-Free Expert Guidance for Controllable Text-to-Face Generation
par: Shi, Liang, et autres
Publié: (2025)
par: Shi, Liang, et autres
Publié: (2025)
EliGen: Entity-Level Controlled Image Generation with Regional Attention
par: Zhang, Hong, et autres
Publié: (2025)
par: Zhang, Hong, et autres
Publié: (2025)
Scaling Backwards: Minimal Synthetic Pre-training?
par: Nakamura, Ryo, et autres
Publié: (2024)
par: Nakamura, Ryo, et autres
Publié: (2024)
Layout Control and Semantic Guidance with Attention Loss Backward for T2I Diffusion Model
par: Li, Guandong
Publié: (2024)
par: Li, Guandong
Publié: (2024)
UniFlowRestore: A General Video Restoration Framework via Flow Matching and Prompt Guidance
par: Sun, Shuning, et autres
Publié: (2025)
par: Sun, Shuning, et autres
Publié: (2025)
Follow Your Motion: A Generic Temporal Consistency Portrait Editing Framework with Trajectory Guidance
par: Yang, Haijie, et autres
Publié: (2025)
par: Yang, Haijie, et autres
Publié: (2025)
SSG: Scaled Spatial Guidance for Multi-Scale Visual Autoregressive Generation
par: Shin, Youngwoo, et autres
Publié: (2026)
par: Shin, Youngwoo, et autres
Publié: (2026)
Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
par: Chu, Ruihang, et autres
Publié: (2025)
par: Chu, Ruihang, et autres
Publié: (2025)
GenAR: Next-Scale Autoregressive Generation for Spatial Gene Expression Prediction
par: Ouyang, Jiarui, et autres
Publié: (2025)
par: Ouyang, Jiarui, et autres
Publié: (2025)
ScaleMoGen: Autoregressive Next-Scale Prediction for Human Motion Generation
par: Hwang, Inwoo, et autres
Publié: (2026)
par: Hwang, Inwoo, et autres
Publié: (2026)
SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment
par: Zhao, Weiren, et autres
Publié: (2026)
par: Zhao, Weiren, et autres
Publié: (2026)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
par: Zhang, Weitian, et autres
Publié: (2024)
par: Zhang, Weitian, et autres
Publié: (2024)
RetiGen: A Framework for Generalized Retinal Diagnosis Using Multi-View Fundus Images
par: Chen, Ze, et autres
Publié: (2024)
par: Chen, Ze, et autres
Publié: (2024)
GenMask: Adapting DiT for Segmentation via Direct Mask Generation
par: Yang, Yuhuan, et autres
Publié: (2026)
par: Yang, Yuhuan, et autres
Publié: (2026)
StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation
par: Zhai, Shangjin, et autres
Publié: (2025)
par: Zhai, Shangjin, et autres
Publié: (2025)
Diffusion-based Aesthetic QR Code Generation via Scanning-Robust Perceptual Guidance
par: Liao, Jia-Wei, et autres
Publié: (2024)
par: Liao, Jia-Wei, et autres
Publié: (2024)
Flowing Backwards: Improving Normalizing Flows via Reverse Representation Alignment
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework
par: Chen, Guanzhou, et autres
Publié: (2026)
par: Chen, Guanzhou, et autres
Publié: (2026)
SpikeGen: Decoupled "Rods and Cones" Visual Representation Processing with Latent Generative Framework
par: Dai, Gaole, et autres
Publié: (2025)
par: Dai, Gaole, et autres
Publié: (2025)
MoGen: A Unified Collaborative Framework for Controllable Multi-Object Image Generation
par: Li, Yanfeng, et autres
Publié: (2026)
par: Li, Yanfeng, et autres
Publié: (2026)
DeMamba: AI-Generated Video Detection on Million-Scale GenVideo Benchmark
par: Chen, Haoxing, et autres
Publié: (2024)
par: Chen, Haoxing, et autres
Publié: (2024)
GenKOL: Modular Generative AI Framework For Scalable Virtual KOL Generation
par: To, Tan-Hiep, et autres
Publié: (2025)
par: To, Tan-Hiep, et autres
Publié: (2025)
Conditional Text-to-Image Generation with Reference Guidance
par: Kim, Taewook, et autres
Publié: (2024)
par: Kim, Taewook, et autres
Publié: (2024)
SQuadGen: Generating Simple Quad Layouts via Chart Distance Fields
par: Kong, Youkang, et autres
Publié: (2026)
par: Kong, Youkang, et autres
Publié: (2026)
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
par: Wei, Yujie, et autres
Publié: (2025)
par: Wei, Yujie, et autres
Publié: (2025)
ORID: Organ-Regional Information Driven Framework for Radiology Report Generation
par: Gu, Tiancheng, et autres
Publié: (2024)
par: Gu, Tiancheng, et autres
Publié: (2024)
Backward-Compatible Aligned Representations via an Orthogonal Transformation Layer
par: Ricci, Simone, et autres
Publié: (2024)
par: Ricci, Simone, et autres
Publié: (2024)
PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net
par: Yin, Jun, et autres
Publié: (2025)
par: Yin, Jun, et autres
Publié: (2025)
PivotMesh: Generic 3D Mesh Generation via Pivot Vertices Guidance
par: Weng, Haohan, et autres
Publié: (2024)
par: Weng, Haohan, et autres
Publié: (2024)
WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion
par: Wu, Yang, et autres
Publié: (2025)
par: Wu, Yang, et autres
Publié: (2025)
LipGen: Viseme-Guided Lip Video Generation for Enhancing Visual Speech Recognition
par: Hao, Bowen, et autres
Publié: (2025)
par: Hao, Bowen, et autres
Publié: (2025)
Classifier-free Guidance with Adaptive Scaling
par: Malarz, Dawid, et autres
Publié: (2025)
par: Malarz, Dawid, et autres
Publié: (2025)
SkyLink: A Large Vision-Language Model Driven Re-ranking Framework for Cross-View UAV geolocalization
par: Liu, Bowen, et autres
Publié: (2026)
par: Liu, Bowen, et autres
Publié: (2026)
GenMed: A Pairwise Generative Reformulation of Medical Diagnostic Tasks
par: Zhang, Hantao, et autres
Publié: (2026)
par: Zhang, Hantao, et autres
Publié: (2026)
Documents similaires
-
Towards Arbitrary-Scale Spacecraft Image Super-Resolution via Salient Region-Guidance
par: Yang, Jingfan, et autres
Publié: (2025) -
UniMapGen: A Generative Framework for Large-Scale Map Construction from Multi-modal Data
par: Yuan, Yujian, et autres
Publié: (2025) -
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
par: Chen, Yuqing, et autres
Publié: (2026) -
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
par: Tan, Zhiyu, et autres
Publié: (2024) -
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
par: Jiang, Kaixun, et autres
Publié: (2026)