The Mystery of the Pathological Path-star Task for Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Frydenlund, Arvid |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Language Models, Graph Searching, and Supervision Adulteration: When More Supervision is Less and How to Make More More
par: Frydenlund, Arvid
Publié: (2025)
par: Frydenlund, Arvid
Publié: (2025)
Unraveling the Mystery of Scaling Laws: Part I
par: Su, Hui, et autres
Publié: (2024)
par: Su, Hui, et autres
Publié: (2024)
Adaptive Task Vectors for Large Language Models
par: Kang, Joonseong, et autres
Publié: (2025)
par: Kang, Joonseong, et autres
Publié: (2025)
Unveiling the Mystery of Weight in Large Foundation Models: Gaussian Distribution Never Fades
par: Si, Chongjie, et autres
Publié: (2025)
par: Si, Chongjie, et autres
Publié: (2025)
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
PaPaformer: Language Model from Pre-trained Parallel Paths
par: Tapaninaho, Joonas, et autres
Publié: (2025)
par: Tapaninaho, Joonas, et autres
Publié: (2025)
Benchmarking Large Language Models for Math Reasoning Tasks
par: Seßler, Kathrin, et autres
Publié: (2024)
par: Seßler, Kathrin, et autres
Publié: (2024)
A Sober Look at Progress in Language Model Reasoning: Pitfalls and Paths to Reproducibility
par: Hochlehnert, Andreas, et autres
Publié: (2025)
par: Hochlehnert, Andreas, et autres
Publié: (2025)
Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models
par: Cao, Jinghan, et autres
Publié: (2026)
par: Cao, Jinghan, et autres
Publié: (2026)
Scaling Laws for Downstream Task Performance of Large Language Models
par: Isik, Berivan, et autres
Publié: (2024)
par: Isik, Berivan, et autres
Publié: (2024)
Frustratingly Easy Task-aware Pruning for Large Language Models
par: Tian, Yuanhe, et autres
Publié: (2025)
par: Tian, Yuanhe, et autres
Publié: (2025)
Circuit Component Reuse Across Tasks in Transformer Language Models
par: Merullo, Jack, et autres
Publié: (2023)
par: Merullo, Jack, et autres
Publié: (2023)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
par: Lin, Fangru, et autres
Publié: (2024)
par: Lin, Fangru, et autres
Publié: (2024)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
par: Qi, Zhen, et autres
Publié: (2024)
par: Qi, Zhen, et autres
Publié: (2024)
Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling
par: Grangier, David, et autres
Publié: (2024)
par: Grangier, David, et autres
Publié: (2024)
What Do Language Models Learn in Context? The Structured Task Hypothesis
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
How Does Code Pretraining Affect Language Model Task Performance?
par: Petty, Jackson, et autres
Publié: (2024)
par: Petty, Jackson, et autres
Publié: (2024)
Language Models Improve When Pretraining Data Matches Target Tasks
par: Mizrahi, David, et autres
Publié: (2025)
par: Mizrahi, David, et autres
Publié: (2025)
Adapting Decoder-Based Language Models for Diverse Encoder Downstream Tasks
par: Suganthan, Paul, et autres
Publié: (2025)
par: Suganthan, Paul, et autres
Publié: (2025)
Capable but Unreliable: Canonical Path Deviation as a Causal Mechanism of Agent Failure in Long-Horizon Tasks
par: Lee, Wilson Y.
Publié: (2026)
par: Lee, Wilson Y.
Publié: (2026)
Exact Byte-Level Probabilities from Tokenized Language Models for FIM-Tasks and Model Ensembles
par: Phan, Buu, et autres
Publié: (2024)
par: Phan, Buu, et autres
Publié: (2024)
Can Memory-Augmented Language Models Generalize on Reasoning-in-a-Haystack Tasks?
par: Das, Payel, et autres
Publié: (2025)
par: Das, Payel, et autres
Publié: (2025)
Cross-Lingual Empirical Evaluation of Large Language Models for Arabic Medical Tasks
par: Abouzahir, Chaimae, et autres
Publié: (2026)
par: Abouzahir, Chaimae, et autres
Publié: (2026)
Can Character-based Language Models Improve Downstream Task Performance in Low-Resource and Noisy Language Scenarios?
par: Riabi, Arij, et autres
Publié: (2021)
par: Riabi, Arij, et autres
Publié: (2021)
Revisiting SMoE Language Models by Evaluating Inefficiencies with Task Specific Expert Pruning
par: Sarkar, Soumajyoti, et autres
Publié: (2024)
par: Sarkar, Soumajyoti, et autres
Publié: (2024)
Biased or Flawed? Mitigating Stereotypes in Generative Language Models by Addressing Task-Specific Flaws
par: Jha, Akshita, et autres
Publié: (2024)
par: Jha, Akshita, et autres
Publié: (2024)
Sociodemographic Bias in Language Models: A Survey and Forward Path
par: Gupta, Vipul, et autres
Publié: (2023)
par: Gupta, Vipul, et autres
Publié: (2023)
BoRA: Bayesian Hierarchical Low-Rank Adaption for Multi-Task Large Language Models
par: Eide, Simen, et autres
Publié: (2024)
par: Eide, Simen, et autres
Publié: (2024)
Synergizing Unsupervised and Supervised Learning: A Hybrid Approach for Accurate Natural Language Task Modeling
par: Talukdar, Wrick, et autres
Publié: (2024)
par: Talukdar, Wrick, et autres
Publié: (2024)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
par: Ramakrishna, Anil, et autres
Publié: (2025)
par: Ramakrishna, Anil, et autres
Publié: (2025)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
par: Wang, Xinyu, et autres
Publié: (2024)
par: Wang, Xinyu, et autres
Publié: (2024)
Large Language Model Agent for Modular Task Execution in Drug Discovery
par: Ock, Janghoon, et autres
Publié: (2025)
par: Ock, Janghoon, et autres
Publié: (2025)
Disentangling Language Roles in Multilingual LLM Task Execution
par: Zhan, Qishi, et autres
Publié: (2026)
par: Zhan, Qishi, et autres
Publié: (2026)
Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language Models
par: Eiras, Francisco, et autres
Publié: (2024)
par: Eiras, Francisco, et autres
Publié: (2024)
Layer by Layer: Uncovering Where Multi-Task Learning Happens in Instruction-Tuned Large Language Models
par: Zhao, Zheng, et autres
Publié: (2024)
par: Zhao, Zheng, et autres
Publié: (2024)
Dynamic Adaptation of LoRA Fine-Tuning for Efficient and Task-Specific Optimization of Large Language Models
par: Liao, Xiaoxuan, et autres
Publié: (2025)
par: Liao, Xiaoxuan, et autres
Publié: (2025)
Mortgage Language Model: Domain-Adaptive Pretraining with Residual Instruction, Alignment Tuning, and Task-Specific Routing
par: Jain, Manish, et autres
Publié: (2025)
par: Jain, Manish, et autres
Publié: (2025)
Evaluating Language-Model Agents on Realistic Autonomous Tasks
par: Kinniment, Megan, et autres
Publié: (2023)
par: Kinniment, Megan, et autres
Publié: (2023)
Large Language Models as Generalizable Policies for Embodied Tasks
par: Szot, Andrew, et autres
Publié: (2023)
par: Szot, Andrew, et autres
Publié: (2023)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
par: Hu, Jiacheng, et autres
Publié: (2024)
par: Hu, Jiacheng, et autres
Publié: (2024)
Documents similaires
-
Language Models, Graph Searching, and Supervision Adulteration: When More Supervision is Less and How to Make More More
par: Frydenlund, Arvid
Publié: (2025) -
Unraveling the Mystery of Scaling Laws: Part I
par: Su, Hui, et autres
Publié: (2024) -
Adaptive Task Vectors for Large Language Models
par: Kang, Joonseong, et autres
Publié: (2025) -
Unveiling the Mystery of Weight in Large Foundation Models: Gaussian Distribution Never Fades
par: Si, Chongjie, et autres
Publié: (2025) -
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
par: Zhou, Junjie, et autres
Publié: (2025)