Salvato in:
| Autori principali: | Mo, Shentong, Li, Lanqing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.06706 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient 3D Shape Generation via Diffusion Mamba with Bidirectional SSMs
di: Mo, Shentong
Pubblicazione: (2024)
di: Mo, Shentong
Pubblicazione: (2024)
Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Chain of Uncertain Rewards with Large Language Models for Reinforcement Learning
di: Mo, Shentong
Pubblicazione: (2026)
di: Mo, Shentong
Pubblicazione: (2026)
On Statistical Rates and Provably Efficient Criteria of Latent Diffusion Transformers (DiTs)
di: Hu, Jerry Yao-Chieh, et al.
Pubblicazione: (2024)
di: Hu, Jerry Yao-Chieh, et al.
Pubblicazione: (2024)
The Dynamic Duo of Collaborative Masking and Target for Advanced Masked Autoencoder Learning
di: Mo, Shentong
Pubblicazione: (2024)
di: Mo, Shentong
Pubblicazione: (2024)
Improving Visual Representation Alignment Generation with GRPO
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
pMoE: Prompting Diverse Experts Together Wins More in Visual Adaptation
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
Distilled Protein Backbone Generation
di: Xie, Liyang, et al.
Pubblicazione: (2025)
di: Xie, Liyang, et al.
Pubblicazione: (2025)
GMAIL: Generative Modality Alignment for generated Image Learning
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
LVRPO: Language-Visual Alignment with GRPO for Multimodal Understanding and Generation
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
DMT-JEPA: Discriminative Masked Targets for Joint-Embedding Predictive Architecture
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Protein Counterfactuals via Diffusion-Guided Latent Optimization
di: Kłos, Weronika, et al.
Pubblicazione: (2026)
di: Kłos, Weronika, et al.
Pubblicazione: (2026)
Foley-Flow: Coordinated Video-to-Audio Generation with Masked Audio-Visual Alignment and Dynamic Conditional Flows
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
Aligning Audio-Visual Joint Representations with an Agentic Workflow
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Connecting Joint-Embedding Predictive Architecture with Contrastive Self-supervised Learning
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
MultiMed: Massively Multimodal and Multitask Medical Understanding
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
A Large-scale Medical Visual Task Adaptation Benchmark
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
ReQFlow: Rectified Quaternion Flow for Efficient and High-Quality Protein Backbone Generation
di: Yue, Angxiao, et al.
Pubblicazione: (2025)
di: Yue, Angxiao, et al.
Pubblicazione: (2025)
LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers
di: Shen, Xuan, et al.
Pubblicazione: (2024)
di: Shen, Xuan, et al.
Pubblicazione: (2024)
Backbone-Equated Diffusion OOD via Sparse Internal Snapshots
di: Rouzoumka, Yadang Alexis, et al.
Pubblicazione: (2026)
di: Rouzoumka, Yadang Alexis, et al.
Pubblicazione: (2026)
DiffGAP: A Lightweight Diffusion Module in Contrastive Space for Bridging Cross-Model Gap
di: Mo, Shentong, et al.
Pubblicazione: (2025)
di: Mo, Shentong, et al.
Pubblicazione: (2025)
Constraint Decoupled Latent Diffusion for Protein Backmapping
di: Han, Xu, et al.
Pubblicazione: (2024)
di: Han, Xu, et al.
Pubblicazione: (2024)
JTreeformer: Graph-Transformer via Latent-Diffusion Model for Molecular Generation
di: Shi, Ji, et al.
Pubblicazione: (2025)
di: Shi, Ji, et al.
Pubblicazione: (2025)
SE(3)-Stochastic Flow Matching for Protein Backbone Generation
di: Bose, Avishek Joey, et al.
Pubblicazione: (2023)
di: Bose, Avishek Joey, et al.
Pubblicazione: (2023)
Efficient and Adaptive Human Activity Recognition via LLM Backbones
di: Bredikhin, Aleksandr, et al.
Pubblicazione: (2026)
di: Bredikhin, Aleksandr, et al.
Pubblicazione: (2026)
Joint Design of Protein Surface and Structure Using a Diffusion Bridge Model
di: Li, Guanlue, et al.
Pubblicazione: (2025)
di: Li, Guanlue, et al.
Pubblicazione: (2025)
Constrained Diffusion for Protein Design with Hard Structural Constraints
di: Christopher, Jacob K., et al.
Pubblicazione: (2025)
di: Christopher, Jacob K., et al.
Pubblicazione: (2025)
DiSK: A Diffusion Model for Structured Knowledge
di: Kitouni, Ouail, et al.
Pubblicazione: (2023)
di: Kitouni, Ouail, et al.
Pubblicazione: (2023)
From Tokenizer Bias to Backbone Capability: A Controlled Study of LLMs for Time Series Forecasting
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
Exploring Diffusion Transformer Designs via Grafting
di: Chandrasegaran, Keshigeyan, et al.
Pubblicazione: (2025)
di: Chandrasegaran, Keshigeyan, et al.
Pubblicazione: (2025)
LaDi-RL: Latent Diffusion Reasoning Prevents Entropy Collapse in Reinforcement Learning
di: Kang, Haoqiang, et al.
Pubblicazione: (2026)
di: Kang, Haoqiang, et al.
Pubblicazione: (2026)
GMS-CAVP: Improving Audio-Video Correspondence with Multi-Scale Contrastive and Generative Pretraining
di: Mo, Shentong, et al.
Pubblicazione: (2026)
di: Mo, Shentong, et al.
Pubblicazione: (2026)
DiLaDiff: Distilled Latent-Augmented Diffusion for Language Modeling
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2026)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2026)
LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning
di: Kang, Haoqiang, et al.
Pubblicazione: (2025)
di: Kang, Haoqiang, et al.
Pubblicazione: (2025)
Structure-based RNA Design by Step-wise Optimization of Latent Diffusion Model
di: Si, Qi, et al.
Pubblicazione: (2026)
di: Si, Qi, et al.
Pubblicazione: (2026)
PI-Mamba: Linear-Time Protein Backbone Generation via Spectrally Initialized Flow Matching
di: Wu, Tianyu, et al.
Pubblicazione: (2026)
di: Wu, Tianyu, et al.
Pubblicazione: (2026)
Text-to-Audio Generation Synchronized with Videos
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
ProteinOPD: Towards Effective and Efficient Preference Alignment for Protein Design
di: Zhang, Yulin, et al.
Pubblicazione: (2026)
di: Zhang, Yulin, et al.
Pubblicazione: (2026)
LaDi-WM: A Latent Diffusion-based World Model for Predictive Manipulation
di: Huang, Yuhang, et al.
Pubblicazione: (2025)
di: Huang, Yuhang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Efficient 3D Shape Generation via Diffusion Mamba with Bidirectional SSMs
di: Mo, Shentong
Pubblicazione: (2024) -
Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation
di: Mo, Shentong, et al.
Pubblicazione: (2024) -
Chain of Uncertain Rewards with Large Language Models for Reinforcement Learning
di: Mo, Shentong
Pubblicazione: (2026) -
On Statistical Rates and Provably Efficient Criteria of Latent Diffusion Transformers (DiTs)
di: Hu, Jerry Yao-Chieh, et al.
Pubblicazione: (2024) -
The Dynamic Duo of Collaborative Masking and Target for Advanced Masked Autoencoder Learning
di: Mo, Shentong
Pubblicazione: (2024)