AOT-POT: Adaptive Operator Transformation for Large-Scale PDE Pre-training
Fuente:
arXiv
Saved in:
| Main Authors: | Lv, Qitan, Wang, Hong, Hao, Zhongkai, Wu, Wen, Xu, Xuenan, Zhou, Bowen, Wu, Feng, Zhang, Chao |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HIPPO: Accelerating Video Large Language Models Inference via Holistic-aware Parallel Speculative Decoding
by: Lv, Qitan, et al.
Published: (2026)
by: Lv, Qitan, et al.
Published: (2026)
DPOT: Auto-Regressive Denoising Operator Transformer for Large-Scale PDE Pre-Training
by: Hao, Zhongkai, et al.
Published: (2024)
by: Hao, Zhongkai, et al.
Published: (2024)
Mixture-of-Experts Operator Transformer for Large-Scale PDE Pre-Training
by: Wang, Hong, et al.
Published: (2025)
by: Wang, Hong, et al.
Published: (2025)
Accelerating PDE-Constrained Optimization by the Derivative of Neural Operators
by: Cheng, Ze, et al.
Published: (2025)
by: Cheng, Ze, et al.
Published: (2025)
PEAC: Unsupervised Pre-training for Cross-Embodiment Reinforcement Learning
by: Ying, Chengyang, et al.
Published: (2024)
by: Ying, Chengyang, et al.
Published: (2024)
SciTS: Scientific Time Series Understanding and Generation with LLMs
by: Wu, Wen, et al.
Published: (2025)
by: Wu, Wen, et al.
Published: (2025)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
by: Zhang, Anqi, et al.
Published: (2024)
by: Zhang, Anqi, et al.
Published: (2024)
STEP: Scientific Time-Series Encoder Pretraining via Cross-Domain Distillation
by: Zhang, Chen, et al.
Published: (2026)
by: Zhang, Chen, et al.
Published: (2026)
LENS: Large Pre-trained Transformer for Exploring Financial Time Series Regularities
by: Xu, Yuanjian, et al.
Published: (2024)
by: Xu, Yuanjian, et al.
Published: (2024)
Accelerating Data Generation for Neural Operators via Krylov Subspace Recycling
by: Wang, Hong, et al.
Published: (2024)
by: Wang, Hong, et al.
Published: (2024)
Pre-training of Lightweight Vision Transformers on Small Datasets with Minimally Scaled Images
by: Tan, Jen Hong
Published: (2024)
by: Tan, Jen Hong
Published: (2024)
Modeling All-Atom Glycan Structures via Hierarchical Message Passing and Multi-Scale Pre-training
by: Xu, Minghao, et al.
Published: (2025)
by: Xu, Minghao, et al.
Published: (2025)
Revisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models
by: Lai, Zhengfeng, et al.
Published: (2024)
by: Lai, Zhengfeng, et al.
Published: (2024)
Unisolver: PDE-Conditional Transformers Towards Universal Neural PDE Solvers
by: Zhou, Hang, et al.
Published: (2024)
by: Zhou, Hang, et al.
Published: (2024)
Exploiting Edited Large Language Models as General Scientific Optimizers
by: Lv, Qitan, et al.
Published: (2025)
by: Lv, Qitan, et al.
Published: (2025)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
by: Chen, Hanzhu, et al.
Published: (2024)
by: Chen, Hanzhu, et al.
Published: (2024)
FLMarket: Enabling Privacy-preserved Pre-training Data Pricing for Federated Learning
by: Wen, Zhenyu, et al.
Published: (2024)
by: Wen, Zhenyu, et al.
Published: (2024)
Timer: Generative Pre-trained Transformers Are Large Time Series Models
by: Liu, Yong, et al.
Published: (2024)
by: Liu, Yong, et al.
Published: (2024)
GraphGPT: Generative Pre-trained Graph Eulerian Transformer
by: Zhao, Qifang, et al.
Published: (2023)
by: Zhao, Qifang, et al.
Published: (2023)
Operator Learning with Domain Decomposition for Geometry Generalization in PDE Solving
by: Huang, Jianing, et al.
Published: (2025)
by: Huang, Jianing, et al.
Published: (2025)
Unlabeled Data vs. Pre-trained Knowledge: Rethinking SSL in the Era of Large Models
by: Lv, Song-Lin, et al.
Published: (2025)
by: Lv, Song-Lin, et al.
Published: (2025)
Where to Add PDE Diffusion in Transformers
by: Zhang, Yukun, et al.
Published: (2025)
by: Zhang, Yukun, et al.
Published: (2025)
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
by: Cai, Xu, et al.
Published: (2025)
by: Cai, Xu, et al.
Published: (2025)
Adaptive Kernel Density Estimation with Pre-training
by: Zhang, Ruitong, et al.
Published: (2026)
by: Zhang, Ruitong, et al.
Published: (2026)
Graph Generative Pre-trained Transformer
by: Chen, Xiaohui, et al.
Published: (2025)
by: Chen, Xiaohui, et al.
Published: (2025)
Model Merging in Pre-training of Large Language Models
by: Li, Yunshui, et al.
Published: (2025)
by: Li, Yunshui, et al.
Published: (2025)
NESTOR: A Nested MOE-based Neural Operator for Large-Scale PDE Pre-Training
by: Sun, Dengdi, et al.
Published: (2026)
by: Sun, Dengdi, et al.
Published: (2026)
CrossTrafficLLM: A Human-Centric Framework for Interpretable Traffic Intelligence via Large Language Model
by: Du, Zeming, et al.
Published: (2025)
by: Du, Zeming, et al.
Published: (2025)
From Uniform to Adaptive: General Skip-Block Mechanisms for Efficient PDE Neural Operators
by: Liu, Lei, et al.
Published: (2025)
by: Liu, Lei, et al.
Published: (2025)
Scaling Proprioceptive-Visual Learning with Heterogeneous Pre-trained Transformers
by: Wang, Lirui, et al.
Published: (2024)
by: Wang, Lirui, et al.
Published: (2024)
How Does Critical Batch Size Scale in Pre-training?
by: Zhang, Hanlin, et al.
Published: (2024)
by: Zhang, Hanlin, et al.
Published: (2024)
Zero-shot Meta-learning for Tabular Prediction Tasks with Adversarially Pre-trained Transformer
by: Wu, Yulun, et al.
Published: (2025)
by: Wu, Yulun, et al.
Published: (2025)
Bias Mitigation in Fine-tuning Pre-trained Models for Enhanced Fairness and Efficiency
by: Zhang, Yixuan, et al.
Published: (2024)
by: Zhang, Yixuan, et al.
Published: (2024)
DSO: Dual-Scale Neural Operators for Stable Long-term Fluid Dynamics Forecasting
by: Dong, Huanshuo, et al.
Published: (2026)
by: Dong, Huanshuo, et al.
Published: (2026)
Improved Operator Learning by Orthogonal Attention
by: Xiao, Zipeng, et al.
Published: (2023)
by: Xiao, Zipeng, et al.
Published: (2023)
Revisiting Diffusion Models: From Generative Pre-training to One-Step Generation
by: Zheng, Bowen, et al.
Published: (2025)
by: Zheng, Bowen, et al.
Published: (2025)
LVM-GP: Uncertainty-Aware PDE Solver via coupling latent variable model and Gaussian process
by: Feng, Xiaodong, et al.
Published: (2025)
by: Feng, Xiaodong, et al.
Published: (2025)
Discovering Physical Directions in Weight Space: Composing Neural PDE Experts
by: Wang, Pengkai, et al.
Published: (2026)
by: Wang, Pengkai, et al.
Published: (2026)
OSF: On Pre-training and Scaling of Sleep Foundation Models
by: Shuai, Zitao, et al.
Published: (2026)
by: Shuai, Zitao, et al.
Published: (2026)
S$^2$ALM: Sequence-Structure Pre-trained Large Language Model for Comprehensive Antibody Representation Learning
by: Yin, Mingze, et al.
Published: (2024)
by: Yin, Mingze, et al.
Published: (2024)
Similar Items
-
HIPPO: Accelerating Video Large Language Models Inference via Holistic-aware Parallel Speculative Decoding
by: Lv, Qitan, et al.
Published: (2026) -
DPOT: Auto-Regressive Denoising Operator Transformer for Large-Scale PDE Pre-Training
by: Hao, Zhongkai, et al.
Published: (2024) -
Mixture-of-Experts Operator Transformer for Large-Scale PDE Pre-Training
by: Wang, Hong, et al.
Published: (2025) -
Accelerating PDE-Constrained Optimization by the Derivative of Neural Operators
by: Cheng, Ze, et al.
Published: (2025) -
PEAC: Unsupervised Pre-training for Cross-Embodiment Reinforcement Learning
by: Ying, Chengyang, et al.
Published: (2024)