Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Qi, Liu, Yihong, Schütze, Hinrich |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
por: Han, Xudong, et al.
Publicado: (2025)
por: Han, Xudong, et al.
Publicado: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
por: Fadli, Samih
Publicado: (2025)
por: Fadli, Samih
Publicado: (2025)
D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models
por: Ubukata, Shunsuke
Publicado: (2026)
por: Ubukata, Shunsuke
Publicado: (2026)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
por: Hashemi, Helia, et al.
Publicado: (2024)
por: Hashemi, Helia, et al.
Publicado: (2024)
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
por: Kugler, Kai
Publicado: (2025)
por: Kugler, Kai
Publicado: (2025)
MCP: A Control-Theoretic Orchestration Framework for Synergistic Efficiency and Interpretability in Multimodal Large Language Models
por: Zhang, Luyan
Publicado: (2025)
por: Zhang, Luyan
Publicado: (2025)
Bridging the Gap: An Intermediate Language for Enhanced and Cost-Effective Grapheme-to-Phoneme Conversion with Homographs with Multiple Pronunciations Disambiguation
por: Bertina, Abbas, et al.
Publicado: (2025)
por: Bertina, Abbas, et al.
Publicado: (2025)
The Data Efficiency Frontier of Financial Foundation Models: Scaling Laws from Continued Pretraining
por: Ponnock, Jesse
Publicado: (2025)
por: Ponnock, Jesse
Publicado: (2025)
Layer-Aware Embedding Fusion for LLMs in Text Classifications
por: Gwak, Jiho, et al.
Publicado: (2025)
por: Gwak, Jiho, et al.
Publicado: (2025)
KSHSeek: Data-Driven Approaches to Mitigating and Detecting Knowledge-Shortcut Hallucinations in Generative Models
por: Liu, Zhongxin, et al.
Publicado: (2025)
por: Liu, Zhongxin, et al.
Publicado: (2025)
On the Influence of Discourse Relations in Persuasive Texts
por: Turk, Nawar, et al.
Publicado: (2025)
por: Turk, Nawar, et al.
Publicado: (2025)
Calibrated Confidence Estimation for Tabular Question Answering
por: Voss, Lukas
Publicado: (2026)
por: Voss, Lukas
Publicado: (2026)
Character-Level Transformer for Tajik-Persian Transliteration with a Parallel Lexical Corpus
por: Arabov, Mullosharaf K.
Publicado: (2026)
por: Arabov, Mullosharaf K.
Publicado: (2026)
Mitigating Cross-Lingual Cultural Inconsistencies in LLMs via Consensus-Driven Preference Optimisation
por: Resck, Lucas, et al.
Publicado: (2026)
por: Resck, Lucas, et al.
Publicado: (2026)
Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning
por: Zhang, Bowen, et al.
Publicado: (2025)
por: Zhang, Bowen, et al.
Publicado: (2025)
EmoLoom-2B: Fast Base-Model Screening for Emotion Classification and VAD with Lexicon-Weak Supervision and KV-Off Evaluation
por: Li, Zilin, et al.
Publicado: (2026)
por: Li, Zilin, et al.
Publicado: (2026)
TRiMS: Real-Time Tracking of Minimal Sufficient Length for Efficient Reasoning via RL
por: Bian, Tingcheng, et al.
Publicado: (2026)
por: Bian, Tingcheng, et al.
Publicado: (2026)
Mixup Model Merge: Enhancing Model Merging Performance through Randomized Linear Interpolation
por: Zhou, Yue, et al.
Publicado: (2025)
por: Zhou, Yue, et al.
Publicado: (2025)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
por: Chua, Jaymari, et al.
Publicado: (2025)
por: Chua, Jaymari, et al.
Publicado: (2025)
Self-Pruned Key-Value Attention: Learning When to Write by Predicting Future Utility
por: Szilvasy, Gergely, et al.
Publicado: (2026)
por: Szilvasy, Gergely, et al.
Publicado: (2026)
Learning the meanings of function words from grounded language using a visual question answering model
por: Portelance, Eva, et al.
Publicado: (2023)
por: Portelance, Eva, et al.
Publicado: (2023)
PRISMA: Preference-Reinforced Self-Training Approach for Interpretable Emotionally Intelligent Negotiation Dialogues
por: Kajare, Prajwal Vijay, et al.
Publicado: (2026)
por: Kajare, Prajwal Vijay, et al.
Publicado: (2026)
Domain-Specific Pretraining of Language Models: A Comparative Study in the Medical Field
por: Kerner, Tobias
Publicado: (2024)
por: Kerner, Tobias
Publicado: (2024)
Computational Economics in Large Language Models: Exploring Model Behavior and Incentive Design under Resource Constraints
por: Reddy, Sandeep, et al.
Publicado: (2025)
por: Reddy, Sandeep, et al.
Publicado: (2025)
Language Models Are Implicitly Continuous
por: Marro, Samuele, et al.
Publicado: (2025)
por: Marro, Samuele, et al.
Publicado: (2025)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
por: Du, Bangde, et al.
Publicado: (2025)
por: Du, Bangde, et al.
Publicado: (2025)
Physics-R1: An Audited Olympiad Corpus and Recipe for Visual Physics Reasoning
por: Yang, Shan
Publicado: (2026)
por: Yang, Shan
Publicado: (2026)
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
por: Aharon, Eliya Naomi, et al.
Publicado: (2026)
por: Aharon, Eliya Naomi, et al.
Publicado: (2026)
Sarcasm Detection in a Less-Resourced Language
por: Đoković, Lazar, et al.
Publicado: (2024)
por: Đoković, Lazar, et al.
Publicado: (2024)
Machine Unlearning for Masked Diffusion Language Models
por: Lee, Georu, et al.
Publicado: (2026)
por: Lee, Georu, et al.
Publicado: (2026)
Combining Language and Topic Models for Hierarchical Text Classification
por: Toit, Jaco du, et al.
Publicado: (2025)
por: Toit, Jaco du, et al.
Publicado: (2025)
Truth as a Compression Artifact in Language Model Training
por: Krestnikov, Konstantin
Publicado: (2026)
por: Krestnikov, Konstantin
Publicado: (2026)
Intention Collapse: Intention-Level Metrics for Reasoning in Language Models
por: Vera, Patricio
Publicado: (2026)
por: Vera, Patricio
Publicado: (2026)
Memory Bank Compression for Continual Adaptation of Large Language Models
por: Katraouras, Thomas, et al.
Publicado: (2026)
por: Katraouras, Thomas, et al.
Publicado: (2026)
Distilling Self-Consistency into Verbal Confidence: A Pre-Registered Negative Result and Post-Hoc Rescue on Gemma 3 4B
por: Cacioli, Jon-Paul
Publicado: (2026)
por: Cacioli, Jon-Paul
Publicado: (2026)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
por: Zhu, Jiajun, et al.
Publicado: (2025)
por: Zhu, Jiajun, et al.
Publicado: (2025)
Exemplar Retrieval Without Overhypothesis Induction: Limits of Distributional Sequence Learning in Early Word Learning
por: Cacioli, Jon-Paul
Publicado: (2026)
por: Cacioli, Jon-Paul
Publicado: (2026)
Kronecker Embeddings: Byte-Level Structured Token Representations for Parameter-Efficient Language Models
por: Shravan, Rohan
Publicado: (2026)
por: Shravan, Rohan
Publicado: (2026)
How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework
por: Saghir, Hamidreza
Publicado: (2026)
por: Saghir, Hamidreza
Publicado: (2026)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
por: Schesch, Benedikt, et al.
Publicado: (2026)
por: Schesch, Benedikt, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
por: Han, Xudong, et al.
Publicado: (2025) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
por: Fadli, Samih
Publicado: (2025) -
D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models
por: Ubukata, Shunsuke
Publicado: (2026) -
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
por: Hashemi, Helia, et al.
Publicado: (2024) -
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
por: Kugler, Kai
Publicado: (2025)