Manifold-Aware Temporal Domain Generalization for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Yiheng, Cai, Zekun, Song, Xinyuan, Kobayashi, Hiroki Hill, Song, Xuan, Shibasaki, Ryosuke, Zhao, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Continuous Domain Generalization
par: Cai, Zekun, et autres
Publié: (2025)
par: Cai, Zekun, et autres
Publié: (2025)
Continuous Temporal Domain Generalization
par: Cai, Zekun, et autres
Publié: (2024)
par: Cai, Zekun, et autres
Publié: (2024)
Large Language Models as Urban Residents: An LLM Agent Framework for Personal Mobility Generation
par: Wang, Jiawei, et autres
Publié: (2024)
par: Wang, Jiawei, et autres
Publié: (2024)
Mixture of Experts in Large Language Models
par: Zhang, Danyang, et autres
Publié: (2025)
par: Zhang, Danyang, et autres
Publié: (2025)
StructPrune: Structured Global Pruning asymptotics with $\mathcal{O}(\sqrt{N})$ GPU Memory
par: Song, Xinyuan, et autres
Publié: (2025)
par: Song, Xinyuan, et autres
Publié: (2025)
The Curse of Depth in Large Language Models
par: Sun, Wenfang, et autres
Publié: (2025)
par: Sun, Wenfang, et autres
Publié: (2025)
REMA: A Unified Reasoning Manifold Framework for Interpreting Large Language Model
par: Li, Bo, et autres
Publié: (2025)
par: Li, Bo, et autres
Publié: (2025)
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
par: Cho, Seonglae, et autres
Publié: (2026)
par: Cho, Seonglae, et autres
Publié: (2026)
Latent Semantic Manifolds in Large Language Models
par: Mabrok, Mohamed A.
Publié: (2026)
par: Mabrok, Mohamed A.
Publié: (2026)
Matrix Sensing with Kernel Optimal Loss: Robustness and Optimization Landscape
par: Song, Xinyuan, et autres
Publié: (2025)
par: Song, Xinyuan, et autres
Publié: (2025)
TrajGPT-R: Generating Urban Mobility Trajectory with Reinforcement Learning-Enhanced Generative Pre-trained Transformer
par: Wang, Jiawei, et autres
Publié: (2026)
par: Wang, Jiawei, et autres
Publié: (2026)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
par: Liu, Xiaoyun, et autres
Publié: (2026)
par: Liu, Xiaoyun, et autres
Publié: (2026)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
par: Zhao, Yao, et autres
Publié: (2023)
par: Zhao, Yao, et autres
Publié: (2023)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
par: Liang, Feng, et autres
Publié: (2025)
par: Liang, Feng, et autres
Publié: (2025)
Temporal-Aware Graph Attention Network for Cryptocurrency Transaction Fraud Detection
par: Zheng, Zhi, et autres
Publié: (2025)
par: Zheng, Zhi, et autres
Publié: (2025)
LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation
par: Song, Siqing, et autres
Publié: (2026)
par: Song, Siqing, et autres
Publié: (2026)
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
par: Cai, Hengrui, et autres
Publié: (2023)
par: Cai, Hengrui, et autres
Publié: (2023)
Temporal Alignment Guidance: On-Manifold Sampling in Diffusion Models
par: Park, Youngrok, et autres
Publié: (2025)
par: Park, Youngrok, et autres
Publié: (2025)
Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation
par: Wu, Yecheng, et autres
Publié: (2026)
par: Wu, Yecheng, et autres
Publié: (2026)
Learning to Recommend Multi-Agent Subgraphs from Calling Trees
par: Song, Xinyuan, et autres
Publié: (2026)
par: Song, Xinyuan, et autres
Publié: (2026)
Domain-Shift-Aware Conformal Prediction for Large Language Models
par: Lin, Zhexiao, et autres
Publié: (2025)
par: Lin, Zhexiao, et autres
Publié: (2025)
Scalable Best-of-N Selection for Large Language Models via Self-Certainty
par: Kang, Zhewei, et autres
Publié: (2025)
par: Kang, Zhewei, et autres
Publié: (2025)
AISA: Awakening Intrinsic Safety Awareness in Large Language Models against Jailbreak Attacks
par: Song, Weiming, et autres
Publié: (2026)
par: Song, Weiming, et autres
Publié: (2026)
Activation Sparsity Opportunities for Compressing General Large Language Models
par: Dhar, Nobel, et autres
Publié: (2024)
par: Dhar, Nobel, et autres
Publié: (2024)
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
par: Liang, Kaiqu, et autres
Publié: (2025)
par: Liang, Kaiqu, et autres
Publié: (2025)
Local Manifold Approximation and Projection for Manifold-Aware Diffusion Planning
par: Lee, Kyowoon, et autres
Publié: (2025)
par: Lee, Kyowoon, et autres
Publié: (2025)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)
par: Song, Ziang, et autres
Publié: (2023)
Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models
par: Ruan, Jiaoyang, et autres
Publié: (2026)
par: Ruan, Jiaoyang, et autres
Publié: (2026)
CorDA: Context-Oriented Decomposition Adaptation of Large Language Models for Task-Aware Parameter-Efficient Fine-tuning
par: Yang, Yibo, et autres
Publié: (2024)
par: Yang, Yibo, et autres
Publié: (2024)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
par: Zhao, Yanlong, et autres
Publié: (2026)
par: Zhao, Yanlong, et autres
Publié: (2026)
Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback
par: Zhou, Yucheng, et autres
Publié: (2025)
par: Zhou, Yucheng, et autres
Publié: (2025)
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023)
par: Crispino, Nicholas, et autres
Publié: (2023)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
par: Lu, Yao, et autres
Publié: (2025)
par: Lu, Yao, et autres
Publié: (2025)
Large Language Model Pruning
par: Huang, Hanjuan, et autres
Publié: (2024)
par: Huang, Hanjuan, et autres
Publié: (2024)
Beyond One-Size-Fits-All: Adaptive Subgraph Denoising for Zero-Shot Graph Learning with Large Language Models
par: Li, Fengzhi, et autres
Publié: (2026)
par: Li, Fengzhi, et autres
Publié: (2026)
Mitigating Overthinking in Large Reasoning Models via Manifold Steering
par: Huang, Yao, et autres
Publié: (2025)
par: Huang, Yao, et autres
Publié: (2025)
Fourier Asymmetric Attention on Domain Generalization for Pan-Cancer Drug Response Prediction
par: Song, Ran, et autres
Publié: (2025)
par: Song, Ran, et autres
Publié: (2025)
Temporal Prototype-Aware Learning for Active Voltage Control on Power Distribution Networks
par: Xu, Feiyang, et autres
Publié: (2024)
par: Xu, Feiyang, et autres
Publié: (2024)
Sharpness-Aware Teleportation on Riemannian Manifolds
par: Truong, Tuan, et autres
Publié: (2023)
par: Truong, Tuan, et autres
Publié: (2023)
Documents similaires
-
Continuous Domain Generalization
par: Cai, Zekun, et autres
Publié: (2025) -
Continuous Temporal Domain Generalization
par: Cai, Zekun, et autres
Publié: (2024) -
Large Language Models as Urban Residents: An LLM Agent Framework for Personal Mobility Generation
par: Wang, Jiawei, et autres
Publié: (2024) -
Mixture of Experts in Large Language Models
par: Zhang, Danyang, et autres
Publié: (2025) -
StructPrune: Structured Global Pruning asymptotics with $\mathcal{O}(\sqrt{N})$ GPU Memory
par: Song, Xinyuan, et autres
Publié: (2025)