Early Period of Training Impacts Adaptation for Out-of-Distribution Generalization: An Empirical Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Chen Cecilia, Gurevych, Iryna |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring
par: Paul, Indraneil, et autres
Publié: (2026)
par: Paul, Indraneil, et autres
Publié: (2026)
Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale
par: Rohweder, Jonas, et autres
Publié: (2026)
par: Rohweder, Jonas, et autres
Publié: (2026)
Beyond Generalization: A Survey of Out-Of-Distribution Adaptation on Graphs
par: Liu, Shuhan, et autres
Publié: (2024)
par: Liu, Shuhan, et autres
Publié: (2024)
Auditing Language Model Unlearning via Information Decomposition
par: Goel, Anmol, et autres
Publié: (2026)
par: Goel, Anmol, et autres
Publié: (2026)
EMGBench: Benchmarking Out-of-Distribution Generalization and Adaptation for Electromyography
par: Yang, Jehan, et autres
Publié: (2024)
par: Yang, Jehan, et autres
Publié: (2024)
An Empirical Study of Pre-trained Model Selection for Out-of-Distribution Generalization and Calibration
par: Naganuma, Hiroki, et autres
Publié: (2023)
par: Naganuma, Hiroki, et autres
Publié: (2023)
Towards Automated Error Discovery: A Study in Conversational AI
par: Petrak, Dominic, et autres
Publié: (2025)
par: Petrak, Dominic, et autres
Publié: (2025)
A Survey of Deep Graph Learning under Distribution Shifts: from Graph Out-of-Distribution Generalization to Adaptation
par: Zhang, Kexin, et autres
Publié: (2024)
par: Zhang, Kexin, et autres
Publié: (2024)
Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling
par: Tamoyan, Hovhannes, et autres
Publié: (2025)
par: Tamoyan, Hovhannes, et autres
Publié: (2025)
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2024)
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2024)
Differentially Private Steering for Large Language Model Alignment
par: Goel, Anmol, et autres
Publié: (2025)
par: Goel, Anmol, et autres
Publié: (2025)
How Quantization Shapes Bias in Large Language Models
par: Marcuzzi, Federico, et autres
Publié: (2025)
par: Marcuzzi, Federico, et autres
Publié: (2025)
HDT: Hierarchical Document Transformer
par: He, Haoyu, et autres
Publié: (2024)
par: He, Haoyu, et autres
Publié: (2024)
Out-of-Distribution Generalization on Graphs via Progressive Inference
par: Xu, Yiming, et autres
Publié: (2025)
par: Xu, Yiming, et autres
Publié: (2025)
AICD Bench: A Challenging Benchmark for AI-Generated Code Detection
par: Orel, Daniil, et autres
Publié: (2026)
par: Orel, Daniil, et autres
Publié: (2026)
SPARE: Single-Pass Annotation with Reference-Guided Evaluation for Automatic Process Supervision and Reward Modelling
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2025)
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2025)
Uncertainty-Aware Decoding with Minimum Bayes Risk
par: Daheim, Nico, et autres
Publié: (2025)
par: Daheim, Nico, et autres
Publié: (2025)
ABCD-LINK: Annotation Bootstrapping for Cross-Document Fine-Grained Links
par: Basch, Serwar, et autres
Publié: (2025)
par: Basch, Serwar, et autres
Publié: (2025)
Cultural Learning-Based Culture Adaptation of Language Models
par: Liu, Chen Cecilia, et autres
Publié: (2025)
par: Liu, Chen Cecilia, et autres
Publié: (2025)
Out-of-Distribution Generalization in Graph Foundation Models
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
A Survey on Evaluation of Out-of-Distribution Generalization
par: Yu, Han, et autres
Publié: (2024)
par: Yu, Han, et autres
Publié: (2024)
Subgraph Aggregation for Out-of-Distribution Generalization on Graphs
par: Liu, Bowen, et autres
Publié: (2024)
par: Liu, Bowen, et autres
Publié: (2024)
Weight Averaging for Out-of-Distribution Generalization and Few-Shot Domain Adaptation
par: Xu, Shijian
Publié: (2025)
par: Xu, Shijian
Publié: (2025)
Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding
par: Wang, Hanyin, et autres
Publié: (2025)
par: Wang, Hanyin, et autres
Publié: (2025)
HYPO: Hyperspherical Out-of-Distribution Generalization
par: Bai, Haoyue, et autres
Publié: (2024)
par: Bai, Haoyue, et autres
Publié: (2024)
Towards Robust Out-of-Distribution Generalization Bounds via Sharpness
par: Zou, Yingtian, et autres
Publié: (2024)
par: Zou, Yingtian, et autres
Publié: (2024)
Distributed Federated Learning by Alternating Periods of Training
par: Bhattacharyya, Shamik, et autres
Publié: (2026)
par: Bhattacharyya, Shamik, et autres
Publié: (2026)
Generalizing Reward Modeling for Out-of-Distribution Preference Learning
par: Jia, Chen
Publié: (2024)
par: Jia, Chen
Publié: (2024)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)
par: Daheim, Nico, et autres
Publié: (2024)
An Efficient Quantum Classifier Based on Hamiltonian Representations
par: Tiblias, Federico, et autres
Publié: (2025)
par: Tiblias, Federico, et autres
Publié: (2025)
Mixture Data for Training Cannot Ensure Out-of-distribution Generalization
par: Zhang, Songming, et autres
Publié: (2023)
par: Zhang, Songming, et autres
Publié: (2023)
Sparsity and Out-of-Distribution Generalization
par: Aaronson, Scott, et autres
Publié: (2026)
par: Aaronson, Scott, et autres
Publié: (2026)
DivIL: Unveiling and Addressing Over-Invariance for Out-of- Distribution Generalization
par: Wang, Jiaqi, et autres
Publié: (2025)
par: Wang, Jiaqi, et autres
Publié: (2025)
On the Benefits of Over-parameterization for Out-of-Distribution Generalization
par: Hao, Yifan, et autres
Publié: (2024)
par: Hao, Yifan, et autres
Publié: (2024)
On the Out-of-Distribution Generalization of Self-Supervised Learning
par: Qiang, Wenwen, et autres
Publié: (2025)
par: Qiang, Wenwen, et autres
Publié: (2025)
Invariant Graph Transformer for Out-of-Distribution Generalization
par: Liao, Tianyin, et autres
Publié: (2025)
par: Liao, Tianyin, et autres
Publié: (2025)
How to Handle Different Types of Out-of-Distribution Scenarios in Computational Argumentation? A Comprehensive and Fine-Grained Field Study
par: Waldis, Andreas, et autres
Publié: (2023)
par: Waldis, Andreas, et autres
Publié: (2023)
Enhancing Distribution and Label Consistency for Graph Out-of-Distribution Generalization
par: Wang, Song, et autres
Publié: (2025)
par: Wang, Song, et autres
Publié: (2025)
How to Weight Multitask Finetuning? Fast Previews via Bayesian Model-Merging
par: Maldonado, Hugo Monzón, et autres
Publié: (2024)
par: Maldonado, Hugo Monzón, et autres
Publié: (2024)
Documents similaires
-
Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring
par: Paul, Indraneil, et autres
Publié: (2026) -
Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale
par: Rohweder, Jonas, et autres
Publié: (2026) -
Beyond Generalization: A Survey of Out-Of-Distribution Adaptation on Graphs
par: Liu, Shuhan, et autres
Publié: (2024) -
Auditing Language Model Unlearning via Information Decomposition
par: Goel, Anmol, et autres
Publié: (2026) -
EMGBench: Benchmarking Out-of-Distribution Generalization and Adaptation for Electromyography
par: Yang, Jehan, et autres
Publié: (2024)