iMontage: Unified, Versatile, Highly Dynamic Many-to-many Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fu, Zhoujie, Zeng, Xianfang, Lan, Jinghong, Liao, Xinyao, Chen, Cheng, Chen, Junyi, Wei, Jiacheng, Cheng, Wei, Liu, Shiyu, Chen, Yunuo, Yu, Gang, Lin, Guosheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
In-Context Learning with Unpaired Clips for Instruction-based Video Editing
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
par: Wu, Fan, et autres
Publié: (2025)
par: Wu, Fan, et autres
Publié: (2025)
MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
UniQ: Unified Decoder with Task-specific Queries for Efficient Scene Graph Generation
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
OmniSVG: A Unified Scalable Vector Graphics Generation Model
par: Yang, Yiying, et autres
Publié: (2025)
par: Yang, Yiying, et autres
Publié: (2025)
DreamDance: Animating Character Art via Inpainting Stable Gaussian Worlds
par: Zhang, Jiaxu, et autres
Publié: (2025)
par: Zhang, Jiaxu, et autres
Publié: (2025)
VINO: A Unified Visual Generator with Interleaved OmniModal Context
par: Chen, Junyi, et autres
Publié: (2026)
par: Chen, Junyi, et autres
Publié: (2026)
RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models
par: Yang, Yufeng, et autres
Publié: (2026)
par: Yang, Yufeng, et autres
Publié: (2026)
OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens
par: Yang, Yiying, et autres
Publié: (2026)
par: Yang, Yiying, et autres
Publié: (2026)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
par: Tu, Chongjun, et autres
Publié: (2025)
par: Tu, Chongjun, et autres
Publié: (2025)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
RegionE: Adaptive Region-Aware Generation for Efficient Image Editing
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
SC-Captioner: Improving Image Captioning with Self-Correction by Reinforcement Learning
par: Zhang, Lin, et autres
Publié: (2025)
par: Zhang, Lin, et autres
Publié: (2025)
MVAnimate: Enhancing Character Animation with Multi-View Optimization
par: Sun, Tianyu, et autres
Publié: (2026)
par: Sun, Tianyu, et autres
Publié: (2026)
Sync4D: Video Guided Controllable Dynamics for Physics-Based 4D Generation
par: Fu, Zhoujie, et autres
Publié: (2024)
par: Fu, Zhoujie, et autres
Publié: (2024)
OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation
par: Chang, Jingjing, et autres
Publié: (2025)
par: Chang, Jingjing, et autres
Publié: (2025)
Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
MikuDance: Animating Character Art with Mixed Motion Dynamics
par: Zhang, Jiaxu, et autres
Publié: (2024)
par: Zhang, Jiaxu, et autres
Publié: (2024)
Sculpt3D: Multi-View Consistent Text-to-3D Generation with Sparse 3D Prior
par: Chen, Cheng, et autres
Publié: (2024)
par: Chen, Cheng, et autres
Publié: (2024)
StyleMe3D: Stylization with Disentangled Priors by Multiple Encoders on 3D Gaussians
par: Zhuang, Cailin, et autres
Publié: (2025)
par: Zhuang, Cailin, et autres
Publié: (2025)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
par: Yin, Fukun, et autres
Publié: (2025)
par: Yin, Fukun, et autres
Publié: (2025)
Logic of Montage
par: Takahashi, Hayami, et autres
Publié: (2025)
par: Takahashi, Hayami, et autres
Publié: (2025)
Large Language Model for Lossless Image Compression with Visual Prompts
par: Du, Junhao, et autres
Publié: (2025)
par: Du, Junhao, et autres
Publié: (2025)
MeshXL: Neural Coordinate Field for Generative 3D Foundation Models
par: Chen, Sijin, et autres
Publié: (2024)
par: Chen, Sijin, et autres
Publié: (2024)
MVPaint: Synchronized Multi-View Diffusion for Painting Anything 3D
par: Cheng, Wei, et autres
Publié: (2024)
par: Cheng, Wei, et autres
Publié: (2024)
Trademark Images and Perception: Godard, Deleuze and Montage
par: Irmgard Emmelhainz
Publié: (2014)
par: Irmgard Emmelhainz
Publié: (2014)
WithAnyone: Towards Controllable and ID Consistent Image Generation
par: Xu, Hengyuan, et autres
Publié: (2025)
par: Xu, Hengyuan, et autres
Publié: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
par: Zhuang, Cailin, et autres
Publié: (2025)
par: Zhuang, Cailin, et autres
Publié: (2025)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
par: Jiang, Zhangqi, et autres
Publié: (2026)
par: Jiang, Zhangqi, et autres
Publié: (2026)
High‐Resolution 3D Imaging with Tunable Point Cloud Projection Based on Meta‐Device
par: Yin Zhou, et autres
Publié: (2025)
par: Yin Zhou, et autres
Publié: (2025)
High-dimensional Many-to-many-to-many Mediation Analysis
par: Nguyen, Tien Dat, et autres
Publié: (2026)
par: Nguyen, Tien Dat, et autres
Publié: (2026)
CADCrafter: Generating Computer-Aided Design Models from Unconstrained Images
par: Chen, Cheng, et autres
Publié: (2025)
par: Chen, Cheng, et autres
Publié: (2025)
Montage and Radio Astronomy
par: Berriman, G. Bruce, et autres
Publié: (2024)
par: Berriman, G. Bruce, et autres
Publié: (2024)
Prim2Room: Layout-Controllable Room Mesh Generation from Primitives
par: Feng, Chengzeng, et autres
Publié: (2024)
par: Feng, Chengzeng, et autres
Publié: (2024)
A Unified Causal View of Instruction Tuning
par: Chen, Lu, et autres
Publié: (2024)
par: Chen, Lu, et autres
Publié: (2024)
UniVerse-1: Unified Audio-Video Generation via Stitching of Experts
par: Wang, Duomin, et autres
Publié: (2025)
par: Wang, Duomin, et autres
Publié: (2025)
Interpret the estimand framework from a causal inference perspective
par: Zeng, Jinghong
Publié: (2024)
par: Zeng, Jinghong
Publié: (2024)
A Bayesian Approach to Estimate Causal Average Treatment Effects Under Unmeasured Confounding
par: Jinghong Zeng
Publié: (2026)
par: Jinghong Zeng
Publié: (2026)
Text-Video Multi-Grained Integration for Video Moment Montage
par: Yin, Zhihui, et autres
Publié: (2024)
par: Yin, Zhihui, et autres
Publié: (2024)
Text-to-Image Rectified Flow as Plug-and-Play Priors
par: Yang, Xiaofeng, et autres
Publié: (2024)
par: Yang, Xiaofeng, et autres
Publié: (2024)
Documents similaires
-
In-Context Learning with Unpaired Clips for Instruction-based Video Editing
par: Liao, Xinyao, et autres
Publié: (2025) -
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
par: Wu, Fan, et autres
Publié: (2025) -
MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent
par: Liao, Xinyao, et autres
Publié: (2025) -
UniQ: Unified Decoder with Task-specific Queries for Efficient Scene Graph Generation
par: Liao, Xinyao, et autres
Publié: (2025) -
OmniSVG: A Unified Scalable Vector Graphics Generation Model
par: Yang, Yiying, et autres
Publié: (2025)