JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Yiyang, Liu, Xingchao, Chen, Xiaokang, Liu, Wen, Wu, Chengyue, Wu, Zhiyu, Pan, Zizheng, Xie, Zhenda, Zhang, Haowei, yu, Xingkai, Zhao, Liang, Wang, Yisong, Liu, Jiaying, Ruan, Chong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation
par: Wu, Chengyue, et autres
Publié: (2024)
par: Wu, Chengyue, et autres
Publié: (2024)
Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling
par: Chen, Xiaokang, et autres
Publié: (2025)
par: Chen, Xiaokang, et autres
Publié: (2025)
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
par: Zhang, Shujian, et autres
Publié: (2024)
par: Zhang, Shujian, et autres
Publié: (2024)
DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
par: Wu, Zhiyu, et autres
Publié: (2024)
par: Wu, Zhiyu, et autres
Publié: (2024)
SlimFlow: Training Smaller One-Step Diffusion Models with Rectified Flow
par: Zhu, Yuanzhi, et autres
Publié: (2024)
par: Zhu, Yuanzhi, et autres
Publié: (2024)
Rectified Flow For Structure Based Drug Design
par: Zhang, Daiheng, et autres
Publié: (2024)
par: Zhang, Daiheng, et autres
Publié: (2024)
SCoT: Unifying Consistency Models and Rectified Flows via Straight-Consistent Trajectories
par: Wu, Zhangkai, et autres
Publié: (2025)
par: Wu, Zhangkai, et autres
Publié: (2025)
FUDOKI: Discrete Flow-based Unified Understanding and Generation via Kinetic-Optimal Velocities
par: Wang, Jin, et autres
Publié: (2025)
par: Wang, Jin, et autres
Publié: (2025)
MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion
par: Wu, Lehong, et autres
Publié: (2024)
par: Wu, Lehong, et autres
Publié: (2024)
Efficient Rectified Flow for Image Fusion
par: Wang, Zirui, et autres
Publié: (2025)
par: Wang, Zirui, et autres
Publié: (2025)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
par: Wu, Size, et autres
Publié: (2025)
par: Wu, Size, et autres
Publié: (2025)
TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models
par: Li, Yangguang, et autres
Publié: (2025)
par: Li, Yangguang, et autres
Publié: (2025)
NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers
par: Ma, Yuhang, et autres
Publié: (2025)
par: Ma, Yuhang, et autres
Publié: (2025)
Text-to-Image Rectified Flow as Plug-and-Play Priors
par: Yang, Xiaofeng, et autres
Publié: (2024)
par: Yang, Xiaofeng, et autres
Publié: (2024)
Accelerating Rectified Flow Models via Trajectory-Aware Caching
par: Liu, Xiao, et autres
Publié: (2026)
par: Liu, Xiao, et autres
Publié: (2026)
Fast LiDAR Data Generation with Rectified Flows
par: Nakashima, Kazuto, et autres
Publié: (2024)
par: Nakashima, Kazuto, et autres
Publié: (2024)
WaterFlow: Explicit Physics-Prior Rectified Flow for Underwater Saliency Mask Generation
par: Li, Runting, et autres
Publié: (2025)
par: Li, Runting, et autres
Publié: (2025)
GeneFlow: Translation of Single-cell Gene Expression to Histopathological Images via Rectified Flow
par: Wang, Mengbo, et autres
Publié: (2025)
par: Wang, Mengbo, et autres
Publié: (2025)
Rectified Diffusion: Straightness Is Not Your Need in Rectified Flow
par: Wang, Fu-Yun, et autres
Publié: (2024)
par: Wang, Fu-Yun, et autres
Publié: (2024)
InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation
par: Liu, Xingchao, et autres
Publié: (2023)
par: Liu, Xingchao, et autres
Publié: (2023)
RecTok: Reconstruction Distillation along Rectified Flow
par: Shi, Qingyu, et autres
Publié: (2025)
par: Shi, Qingyu, et autres
Publié: (2025)
I-Max: Maximize the Resolution Potential of Pre-trained Rectified Flow Transformers with Projected Flow
par: Du, Ruoyi, et autres
Publié: (2024)
par: Du, Ruoyi, et autres
Publié: (2024)
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation
par: Qu, Liao, et autres
Publié: (2024)
par: Qu, Liao, et autres
Publié: (2024)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
par: Ma, Yongjia, et autres
Publié: (2025)
par: Ma, Yongjia, et autres
Publié: (2025)
Autoregressive Flow Matching for Motion Prediction
par: Xie, Johnathan, et autres
Publié: (2025)
par: Xie, Johnathan, et autres
Publié: (2025)
R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow
par: Wu, Zijie, et autres
Publié: (2026)
par: Wu, Zijie, et autres
Publié: (2026)
NextFlow: Unified Sequential Modeling Activates Multimodal Understanding and Generation
par: Zhang, Huichao, et autres
Publié: (2026)
par: Zhang, Huichao, et autres
Publié: (2026)
Consistency Flow Matching: Defining Straight Flows with Velocity Consistency
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
Towards Hierarchical Rectified Flow
par: Zhang, Yichi, et autres
Publié: (2025)
par: Zhang, Yichi, et autres
Publié: (2025)
Variational Rectified Flow Matching
par: Guo, Pengsheng, et autres
Publié: (2025)
par: Guo, Pengsheng, et autres
Publié: (2025)
Generalization and Memorization in Rectified Flow
par: Rao, Mingxing, et autres
Publié: (2026)
par: Rao, Mingxing, et autres
Publié: (2026)
FlowIE: Efficient Image Enhancement via Rectified Flow
par: Zhu, Yixuan, et autres
Publié: (2024)
par: Zhu, Yixuan, et autres
Publié: (2024)
Rectified-CFG++ for Flow Based Models
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
Taming Rectified Flow for Inversion and Editing
par: Wang, Jiangshan, et autres
Publié: (2024)
par: Wang, Jiangshan, et autres
Publié: (2024)
Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing
par: Xiao, Yisong, et autres
Publié: (2025)
par: Xiao, Yisong, et autres
Publié: (2025)
DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow Editing
par: Xie, Chenxi, et autres
Publié: (2025)
par: Xie, Chenxi, et autres
Publié: (2025)
Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods
par: Lupascu, Marian, et autres
Publié: (2025)
par: Lupascu, Marian, et autres
Publié: (2025)
Latent Posterior-Mean Rectified Flow for Higher-Fidelity Perceptual Face Restoration
par: Luo, Xin, et autres
Publié: (2025)
par: Luo, Xin, et autres
Publié: (2025)
Improving the Training of Rectified Flows
par: Lee, Sangyun, et autres
Publié: (2024)
par: Lee, Sangyun, et autres
Publié: (2024)
TReFT: Taming Rectified Flow Models For One-Step Image Translation
par: Li, Shengqian, et autres
Publié: (2025)
par: Li, Shengqian, et autres
Publié: (2025)
Documents similaires
-
Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation
par: Wu, Chengyue, et autres
Publié: (2024) -
Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling
par: Chen, Xiaokang, et autres
Publié: (2025) -
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
par: Zhang, Shujian, et autres
Publié: (2024) -
DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
par: Wu, Zhiyu, et autres
Publié: (2024) -
SlimFlow: Training Smaller One-Step Diffusion Models with Rectified Flow
par: Zhu, Yuanzhi, et autres
Publié: (2024)