HOFAR: High-Order Augmentation of Flow Autoregressive Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Yingyu, Sha, Zhizhou, Shi, Zhenmei, Song, Zhao, Wan, Mingda |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
High-Order Matching for One-Step Shortcut Diffusion Models
par: Chen, Bo, et autres
Publié: (2025)
par: Chen, Bo, et autres
Publié: (2025)
On Computational Limits and Provably Efficient Criteria of Visual Autoregressive Models: A Fine-Grained Complexity Analysis
par: Ke, Yekun, et autres
Publié: (2025)
par: Ke, Yekun, et autres
Publié: (2025)
Force Matching with Relativistic Constraints: A Physics-Inspired Approach to Stable and Efficient Generative Modeling
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
Universal Approximation of Visual Autoregressive Transformers
par: Chen, Yifang, et autres
Publié: (2025)
par: Chen, Yifang, et autres
Publié: (2025)
On Computational Limits of FlowAR Models: Expressivity and Efficiency
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
Visual Autoregressive Transformers Must Use $Ω(n^2 d)$ Memory
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
Theoretical Guarantees for High Order Trajectory Refinement in Generative Flows
par: Gong, Chengyue, et autres
Publié: (2025)
par: Gong, Chengyue, et autres
Publié: (2025)
RichSpace: Enriching Text-to-Video Prompt Space via Text Embedding Interpolation
par: Cao, Yuefan, et autres
Publié: (2025)
par: Cao, Yuefan, et autres
Publié: (2025)
Unraveling the Smoothness Properties of Diffusion Models: A Gaussian Mixture Perspective
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Multi-Layer Transformers Gradient Can be Approximated in Almost Linear Time
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Text-to-Image Diffusion Models Cannot Count, and Prompt Refinement Cannot Help
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
Can You Count to Nine? A Human Evaluation Benchmark for Counting Limits in Modern Text-to-Video Models
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
HSR-Enhanced Sparse Attention Acceleration
par: Chen, Bo, et autres
Publié: (2024)
par: Chen, Bo, et autres
Publié: (2024)
Looped ReLU MLPs May Be All You Need as Practical Programmable Computers
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Theoretical Constraints on the Expressive Power of $\mathsf{RoPE}$-based Tensor Attention Transformers
par: Li, Xiaoyu, et autres
Publié: (2024)
par: Li, Xiaoyu, et autres
Publié: (2024)
Differential Privacy Mechanisms in Neural Tangent Kernel Regression
par: Gu, Jiuxiang, et autres
Publié: (2024)
par: Gu, Jiuxiang, et autres
Publié: (2024)
Towards High-Order Mean Flow Generative Models: Feasibility, Expressivity, and Provably Efficient Criteria
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
T2VTextBench: A Human Evaluation Benchmark for Textual Control in Video Generation Models
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
Towards Infinite-Long Prefix in Transformer
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Circuit Complexity Bounds for Visual Autoregressive Model
par: Ke, Yekun, et autres
Publié: (2025)
par: Ke, Yekun, et autres
Publié: (2025)
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
par: Tang, Haotian, et autres
Publié: (2024)
par: Tang, Haotian, et autres
Publié: (2024)
Control-Augmented Autoregressive Diffusion for Data Assimilation
par: Srivastava, Prakhar, et autres
Publié: (2025)
par: Srivastava, Prakhar, et autres
Publié: (2025)
Dissecting Submission Limit in Desk-Rejections: A Mathematical Analysis of Fairness in AI Conference Policies
par: Cao, Yuefan, et autres
Publié: (2025)
par: Cao, Yuefan, et autres
Publié: (2025)
Learning Discrete Autoregressive Priors with Wasserstein Gradient Flow
par: Zheng, Bowen, et autres
Publié: (2026)
par: Zheng, Bowen, et autres
Publié: (2026)
Generative Modelling with High-Order Langevin Dynamics
par: Shi, Ziqiang, et autres
Publié: (2024)
par: Shi, Ziqiang, et autres
Publié: (2024)
Astra: General Interactive World Model with Autoregressive Denoising
par: Zhu, Yixuan, et autres
Publié: (2025)
par: Zhu, Yixuan, et autres
Publié: (2025)
Neural Algorithmic Reasoning for Hypergraphs with Looped Transformers
par: Huang, Zekai, et autres
Publié: (2025)
par: Huang, Zekai, et autres
Publié: (2025)
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
par: Lin, Huawei, et autres
Publié: (2025)
par: Lin, Huawei, et autres
Publié: (2025)
Improving Consistency Models with Generator-Augmented Flows
par: Issenhuth, Thibaut, et autres
Publié: (2024)
par: Issenhuth, Thibaut, et autres
Publié: (2024)
PointNSP: Autoregressive 3D Point Cloud Generation with Next-Scale Level-of-Detail Prediction
par: Meng, Ziqiao, et autres
Publié: (2025)
par: Meng, Ziqiao, et autres
Publié: (2025)
Training Tensor Attention Efficiently: From Cubic to Almost Linear Time
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
When Can We Solve the Weighted Low Rank Approximation Problem in Truly Subquadratic Time?
par: Li, Chenyang, et autres
Publié: (2025)
par: Li, Chenyang, et autres
Publié: (2025)
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
par: Li, Songlin, et autres
Publié: (2024)
par: Li, Songlin, et autres
Publié: (2024)
Multimodal Fusion at Three Tiers: Physics-Driven Data Generation and Vision-Language Guidance for Brain Tumor Segmentation
par: Zhang, Mingda
Publié: (2025)
par: Zhang, Mingda
Publié: (2025)
Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
MeanFlow Transformers with Representation Autoencoders
par: Hu, Zheyuan, et autres
Publié: (2025)
par: Hu, Zheyuan, et autres
Publié: (2025)
RefineNet: Enhancing Text-to-Image Conversion with High-Resolution and Detail Accuracy through Hierarchical Transformers and Progressive Refinement
par: Shi, Fan
Publié: (2023)
par: Shi, Fan
Publié: (2023)
Learning to Inference Adaptively for Multimodal Large Language Models
par: Xu, Zhuoyan, et autres
Publié: (2025)
par: Xu, Zhuoyan, et autres
Publié: (2025)
VAN-AD: Visual Masked Autoencoder with Normalizing Flow For Time Series Anomaly Detection
par: Chen, PengYu, et autres
Publié: (2026)
par: Chen, PengYu, et autres
Publié: (2026)
Documents similaires
-
High-Order Matching for One-Step Shortcut Diffusion Models
par: Chen, Bo, et autres
Publié: (2025) -
On Computational Limits and Provably Efficient Criteria of Visual Autoregressive Models: A Fine-Grained Complexity Analysis
par: Ke, Yekun, et autres
Publié: (2025) -
Force Matching with Relativistic Constraints: A Physics-Inspired Approach to Stable and Efficient Generative Modeling
par: Cao, Yang, et autres
Publié: (2025) -
Universal Approximation of Visual Autoregressive Transformers
par: Chen, Yifang, et autres
Publié: (2025) -
On Computational Limits of FlowAR Models: Expressivity and Efficiency
par: Cao, Yang, et autres
Publié: (2025)