Salvato in:
| Autori principali: | Usatenko, O. V., Melnyk, S. S., Pritula, G. M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.04412 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Large Language Models as Markov Chains
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
Understanding the Repeat Curse in Large Language Models from a Feature Perspective
di: Yao, Junchi, et al.
Pubblicazione: (2025)
di: Yao, Junchi, et al.
Pubblicazione: (2025)
Delving into the Reversal Curse: How Far Can Large Language Models Generalize?
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
Curse of High Dimensionality Issue in Transformer for Long-context Modeling
di: Zhang, Shuhai, et al.
Pubblicazione: (2025)
di: Zhang, Shuhai, et al.
Pubblicazione: (2025)
DiffER: Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models
di: He, Shaokai, et al.
Pubblicazione: (2026)
di: He, Shaokai, et al.
Pubblicazione: (2026)
Induction Head Toxicity Mechanistically Explains Repetition Curse in Large Language Models
di: Wang, Shuxun, et al.
Pubblicazione: (2025)
di: Wang, Shuxun, et al.
Pubblicazione: (2025)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
di: Blevins, Terra, et al.
Pubblicazione: (2024)
di: Blevins, Terra, et al.
Pubblicazione: (2024)
Recovering Mental Representations from Large Language Models with Markov Chain Monte Carlo
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
di: Zhu, Jian-Qiao, et al.
Pubblicazione: (2024)
Large Language Models for Single-Step and Multi-Step Flight Trajectory Prediction
di: Luo, Kaiwei, et al.
Pubblicazione: (2025)
di: Luo, Kaiwei, et al.
Pubblicazione: (2025)
Evaluating the Reversal Curse in Model Editing
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
Maintaining Informative Coherence: Migrating Hallucinations in Large Language Models via Absorbing Markov Chains
di: Wu, Jiemin, et al.
Pubblicazione: (2024)
di: Wu, Jiemin, et al.
Pubblicazione: (2024)
Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
A Multi-Dimensional Audit of Politically Aligned Large Language Models
di: Korver, Lisa, et al.
Pubblicazione: (2026)
di: Korver, Lisa, et al.
Pubblicazione: (2026)
Is Sarcasm Detection A Step-by-Step Reasoning Process in Large Language Models?
di: Yao, Ben, et al.
Pubblicazione: (2024)
di: Yao, Ben, et al.
Pubblicazione: (2024)
T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
di: Chen, Zehui, et al.
Pubblicazione: (2023)
di: Chen, Zehui, et al.
Pubblicazione: (2023)
Instruct Large Language Models to Generate Scientific Literature Survey Step by Step
di: Lai, Yuxuan, et al.
Pubblicazione: (2024)
di: Lai, Yuxuan, et al.
Pubblicazione: (2024)
Step-by-Step Unmasking for Parameter-Efficient Fine-tuning of Large Language Models
di: Agarwal, Aradhye, et al.
Pubblicazione: (2024)
di: Agarwal, Aradhye, et al.
Pubblicazione: (2024)
Resprompt: Residual Connection Prompting Advances Multi-Step Reasoning in Large Language Models
di: Jiang, Song, et al.
Pubblicazione: (2023)
di: Jiang, Song, et al.
Pubblicazione: (2023)
Multi-Step Reasoning with Large Language Models, a Survey
di: Plaat, Aske, et al.
Pubblicazione: (2024)
di: Plaat, Aske, et al.
Pubblicazione: (2024)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
Chain of Agents: Large Language Models Collaborating on Long-Context Tasks
di: Zhang, Yusen, et al.
Pubblicazione: (2024)
di: Zhang, Yusen, et al.
Pubblicazione: (2024)
Modeling Multi-Dimensional Cognitive States in Large Language Models under Cognitive Crowding
di: Zhong, Lin, et al.
Pubblicazione: (2026)
di: Zhong, Lin, et al.
Pubblicazione: (2026)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
di: Wu, Da, et al.
Pubblicazione: (2023)
di: Wu, Da, et al.
Pubblicazione: (2023)
Random telegraph processes with non-local memory
di: Apostolov, S. S., et al.
Pubblicazione: (2024)
di: Apostolov, S. S., et al.
Pubblicazione: (2024)
Towards Hierarchical Multi-Step Reward Models for Enhanced Reasoning in Large Language Models
di: Wang, Teng, et al.
Pubblicazione: (2025)
di: Wang, Teng, et al.
Pubblicazione: (2025)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
di: Zhang, Yiran, et al.
Pubblicazione: (2025)
di: Zhang, Yiran, et al.
Pubblicazione: (2025)
Additive Large Language Models for Semi-Structured Text
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
Graph Elicitation for Guiding Multi-Step Reasoning in Large Language Models
di: Park, Jinyoung, et al.
Pubblicazione: (2023)
di: Park, Jinyoung, et al.
Pubblicazione: (2023)
Symbolic Chain-of-Thought Distillation: Small Models Can Also "Think" Step-by-Step
di: Li, Liunian Harold, et al.
Pubblicazione: (2023)
di: Li, Liunian Harold, et al.
Pubblicazione: (2023)
Uncertainty Quantification of Large Language Models through Multi-Dimensional Responses
di: Chen, Tiejin, et al.
Pubblicazione: (2025)
di: Chen, Tiejin, et al.
Pubblicazione: (2025)
MultiSlav: Using Cross-Lingual Knowledge Transfer to Combat the Curse of Multilinguality
di: Kot, Artur, et al.
Pubblicazione: (2025)
di: Kot, Artur, et al.
Pubblicazione: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2024)
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2024)
Multi-LogiEval: Towards Evaluating Multi-Step Logical Reasoning Ability of Large Language Models
di: Patel, Nisarg, et al.
Pubblicazione: (2024)
di: Patel, Nisarg, et al.
Pubblicazione: (2024)
Markov Constraint as Large Language Model Surrogate
di: Bonlarron, Alexandre, et al.
Pubblicazione: (2024)
di: Bonlarron, Alexandre, et al.
Pubblicazione: (2024)
Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
Comparing Labeled Markov Chains: A Cantor-Kantorovich Approach
di: Banse, Adrien, et al.
Pubblicazione: (2025)
di: Banse, Adrien, et al.
Pubblicazione: (2025)
Early Stopping Chain-of-thoughts in Large Language Models
di: Mao, Minjia, et al.
Pubblicazione: (2025)
di: Mao, Minjia, et al.
Pubblicazione: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024) -
Large Language Models as Markov Chains
di: Zekri, Oussama, et al.
Pubblicazione: (2024) -
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
di: Zheng, Tianshi, et al.
Pubblicazione: (2025) -
Understanding the Repeat Curse in Large Language Models from a Feature Perspective
di: Yao, Junchi, et al.
Pubblicazione: (2025) -
Delving into the Reversal Curse: How Far Can Large Language Models Generalize?
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)