VisionTS++: Cross-Modal Time Series Foundation Model with Continual Pre-trained Vision Backbones
Fuente:
arXiv
Saved in:
| Main Authors: | Shen, Lefei, Chen, Mouxiang, Liu, Xu, Fu, Han, Ren, Xiaoxue, Sun, Jianling, Li, Zhuo, Liu, Chenghao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VisionTS: Visual Masked Autoencoders Are Free-Lunch Zero-Shot Time Series Forecasters
by: Chen, Mouxiang, et al.
Published: (2024)
by: Chen, Mouxiang, et al.
Published: (2024)
Calibration of Time-Series Forecasting: Detecting and Adapting Context-Driven Distribution Shift
by: Chen, Mouxiang, et al.
Published: (2023)
by: Chen, Mouxiang, et al.
Published: (2023)
TSFMAudit: Data Contamination Auditing in Forecasting Time Series Foundation Models
by: Li, Hongkai, et al.
Published: (2026)
by: Li, Hongkai, et al.
Published: (2026)
The Power of Architecture: Deep Dive into Transformer Architectures for Long-Term Time Series Forecasting
by: Shen, Lefei, et al.
Published: (2025)
by: Shen, Lefei, et al.
Published: (2025)
Identifiability Matters: Revealing the Hidden Recoverable Condition in Unbiased Learning to Rank
by: Chen, Mouxiang, et al.
Published: (2023)
by: Chen, Mouxiang, et al.
Published: (2023)
JumpCoder: Go Beyond Autoregressive Coder via Online Modification
by: Chen, Mouxiang, et al.
Published: (2024)
by: Chen, Mouxiang, et al.
Published: (2024)
HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone
by: Fu, Guanyiman, et al.
Published: (2026)
by: Fu, Guanyiman, et al.
Published: (2026)
Centroid-centered Modeling for Efficient Vision Transformer Pre-training
by: Yan, Xin, et al.
Published: (2023)
by: Yan, Xin, et al.
Published: (2023)
PEMT: Multi-Task Correlation Guided Mixture-of-Experts Enables Parameter-Efficient Transfer Learning
by: Lin, Zhisheng, et al.
Published: (2024)
by: Lin, Zhisheng, et al.
Published: (2024)
MLLM4TS: Leveraging Vision and Multimodal Language Models for General Time-Series Analysis
by: Liu, Qinghua, et al.
Published: (2025)
by: Liu, Qinghua, et al.
Published: (2025)
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
by: Kim, Sanghwan, et al.
Published: (2024)
by: Kim, Sanghwan, et al.
Published: (2024)
CoMP: Continual Multimodal Pre-training for Vision Foundation Models
by: Chen, Yitong, et al.
Published: (2025)
by: Chen, Yitong, et al.
Published: (2025)
Advancing Graph Representation Learning with Large Language Models: A Comprehensive Survey of Techniques
by: Mao, Qiheng, et al.
Published: (2024)
by: Mao, Qiheng, et al.
Published: (2024)
In-context Pre-trained Time-Series Foundation Models adapt to Unseen Tasks
by: Xu, Shangqing, et al.
Published: (2026)
by: Xu, Shangqing, et al.
Published: (2026)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
by: Yao, Yuang, et al.
Published: (2025)
by: Yao, Yuang, et al.
Published: (2025)
FiCoTS: Fine-to-Coarse LLM-Enhanced Hierarchical Cross-Modality Interaction for Time Series Forecasting
by: Lyu, Yafei, et al.
Published: (2025)
by: Lyu, Yafei, et al.
Published: (2025)
Time-FFM: Towards LM-Empowered Federated Foundation Model for Time Series Forecasting
by: Liu, Qingxiang, et al.
Published: (2024)
by: Liu, Qingxiang, et al.
Published: (2024)
Low-Rank Adaptation of Pre-trained Vision Backbones for Energy-Efficient Image Coding for Machine
by: Zhang, Yichi, et al.
Published: (2025)
by: Zhang, Yichi, et al.
Published: (2025)
Continual Forgetting for Pre-trained Vision Models
by: Zhao, Hongbo, et al.
Published: (2024)
by: Zhao, Hongbo, et al.
Published: (2024)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
by: Zhang, Chengsheng, et al.
Published: (2026)
by: Zhang, Chengsheng, et al.
Published: (2026)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
by: Niu, Peisong, et al.
Published: (2025)
by: Niu, Peisong, et al.
Published: (2025)
Revisiting Continual Semantic Segmentation with Pre-trained Vision Models
by: Zhang, Duzhen, et al.
Published: (2025)
by: Zhang, Duzhen, et al.
Published: (2025)
CollabOD: Collaborative Multi-Backbone with Cross-scale Vision for UAV Small Object Detection
by: Bai, Xuecheng, et al.
Published: (2026)
by: Bai, Xuecheng, et al.
Published: (2026)
Practical Continual Forgetting for Pre-trained Vision Models
by: Zhao, Hongbo, et al.
Published: (2025)
by: Zhao, Hongbo, et al.
Published: (2025)
VLP: A Survey on Vision-Language Pre-training
by: Chen, Feilong, et al.
Published: (2022)
by: Chen, Feilong, et al.
Published: (2022)
Vision KAN: Towards an Attention-Free Backbone for Vision with Kolmogorov-Arnold Networks
by: Yang, Zhuoqin, et al.
Published: (2026)
by: Yang, Zhuoqin, et al.
Published: (2026)
TS-ACL: Closed-Form Solution for Time Series-oriented Continual Learning
by: Li, Jiaxu, et al.
Published: (2024)
by: Li, Jiaxu, et al.
Published: (2024)
TS-Memory: Plug-and-Play Memory for Time Series Foundation Models
by: Lyu, Sisuo, et al.
Published: (2026)
by: Lyu, Sisuo, et al.
Published: (2026)
VIP: Vision Instructed Pre-training for Robotic Manipulation
by: Li, Zhuoling, et al.
Published: (2024)
by: Li, Zhuoling, et al.
Published: (2024)
Cross-Domain Pre-training with Language Models for Transferable Time Series Representations
by: Cheng, Mingyue, et al.
Published: (2024)
by: Cheng, Mingyue, et al.
Published: (2024)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
by: Yamaguchi, Shin'ya, et al.
Published: (2025)
by: Yamaguchi, Shin'ya, et al.
Published: (2025)
Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training
by: Liu, Haowei, et al.
Published: (2024)
by: Liu, Haowei, et al.
Published: (2024)
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
by: Zhang, Haiming, et al.
Published: (2024)
by: Zhang, Haiming, et al.
Published: (2024)
VETime: Vision Enhanced Zero-Shot Time Series Anomaly Detection
by: Yang, Yingyuan, et al.
Published: (2026)
by: Yang, Yingyuan, et al.
Published: (2026)
OATS: Online Data Augmentation for Time Series Foundation Models
by: Deng, Junwei, et al.
Published: (2026)
by: Deng, Junwei, et al.
Published: (2026)
VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks
by: Chu, Xiangxiang, et al.
Published: (2024)
by: Chu, Xiangxiang, et al.
Published: (2024)
LLM4TS: Aligning Pre-Trained LLMs as Data-Efficient Time-Series Forecasters
by: Chang, Ching, et al.
Published: (2023)
by: Chang, Ching, et al.
Published: (2023)
EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE
by: Chen, Junyi, et al.
Published: (2023)
by: Chen, Junyi, et al.
Published: (2023)
B4: Towards Optimal Assessment of Plausible Code Solutions with Plausible Tests
by: Chen, Mouxiang, et al.
Published: (2024)
by: Chen, Mouxiang, et al.
Published: (2024)
PromptMID: Modal Invariant Descriptors Based on Diffusion and Vision Foundation Models for Optical-SAR Image Matching
by: Nie, Han, et al.
Published: (2025)
by: Nie, Han, et al.
Published: (2025)
Similar Items
-
VisionTS: Visual Masked Autoencoders Are Free-Lunch Zero-Shot Time Series Forecasters
by: Chen, Mouxiang, et al.
Published: (2024) -
Calibration of Time-Series Forecasting: Detecting and Adapting Context-Driven Distribution Shift
by: Chen, Mouxiang, et al.
Published: (2023) -
TSFMAudit: Data Contamination Auditing in Forecasting Time Series Foundation Models
by: Li, Hongkai, et al.
Published: (2026) -
The Power of Architecture: Deep Dive into Transformer Architectures for Long-Term Time Series Forecasting
by: Shen, Lefei, et al.
Published: (2025) -
Identifiability Matters: Revealing the Hidden Recoverable Condition in Unbiased Learning to Rank
by: Chen, Mouxiang, et al.
Published: (2023)