Salvato in:
| Autori principali: | Ye, Xinwu, Li, Chengfan, Chen, Siming, Wei, Wei, Tang, Xiangru |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.01891 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
di: Luo, Yuqi, et al.
Pubblicazione: (2024)
di: Luo, Yuqi, et al.
Pubblicazione: (2024)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Engineering A Large Language Model From Scratch
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
PersonalLLM: Tailoring LLMs to Individual Preferences
di: Zollo, Thomas P., et al.
Pubblicazione: (2024)
di: Zollo, Thomas P., et al.
Pubblicazione: (2024)
Benchmarking Cognitive Biases in Large Language Models as Evaluators
di: Koo, Ryan, et al.
Pubblicazione: (2023)
di: Koo, Ryan, et al.
Pubblicazione: (2023)
Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
di: Sun, Luoyang, et al.
Pubblicazione: (2026)
di: Sun, Luoyang, et al.
Pubblicazione: (2026)
Skill Availability and Presentation Granularity in Large-Language-Model Agents: A Controlled SkillsBench Study
di: Xu, Xiaonan, et al.
Pubblicazione: (2026)
di: Xu, Xiaonan, et al.
Pubblicazione: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
Adapting While Learning: Grounding LLMs for Scientific Problems with Intelligent Tool Usage Adaptation
di: Lyu, Bohan, et al.
Pubblicazione: (2024)
di: Lyu, Bohan, et al.
Pubblicazione: (2024)
Ensemble Language Models for Multilingual Sentiment Analysis
di: Hasan, Md Arid
Pubblicazione: (2024)
di: Hasan, Md Arid
Pubblicazione: (2024)
RBCorr: Response Bias Correction in Language Models
di: Bhatt, Om, et al.
Pubblicazione: (2026)
di: Bhatt, Om, et al.
Pubblicazione: (2026)
Compact Example-Based Explanations for Language Models
di: Schoenegger, Loris, et al.
Pubblicazione: (2026)
di: Schoenegger, Loris, et al.
Pubblicazione: (2026)
On the Effect of (Near) Duplicate Subwords in Language Modelling
di: Schäfer, Anton, et al.
Pubblicazione: (2024)
di: Schäfer, Anton, et al.
Pubblicazione: (2024)
The Open Source Advantage in Large Language Models (LLMs)
di: Manchanda, Jiya, et al.
Pubblicazione: (2024)
di: Manchanda, Jiya, et al.
Pubblicazione: (2024)
Overcoming Long-Context Limitations of State-Space Models via Context-Dependent Sparse Attention
di: Zhan, Zhihao, et al.
Pubblicazione: (2025)
di: Zhan, Zhihao, et al.
Pubblicazione: (2025)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models
di: Zhang, Gongbo, et al.
Pubblicazione: (2026)
di: Zhang, Gongbo, et al.
Pubblicazione: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
di: Kalajdzievski, Damjan
Pubblicazione: (2024)
di: Kalajdzievski, Damjan
Pubblicazione: (2024)
Distilling Robustness into Natural Language Inference Models with Domain-Targeted Augmentation
di: Stacey, Joe, et al.
Pubblicazione: (2023)
di: Stacey, Joe, et al.
Pubblicazione: (2023)
Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders
di: Patel, Het, et al.
Pubblicazione: (2026)
di: Patel, Het, et al.
Pubblicazione: (2026)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
di: Borobia, Hector, et al.
Pubblicazione: (2026)
di: Borobia, Hector, et al.
Pubblicazione: (2026)
Language Models Are Implicitly Continuous
di: Marro, Samuele, et al.
Pubblicazione: (2025)
di: Marro, Samuele, et al.
Pubblicazione: (2025)
$\text{Memory}^3$: Language Modeling with Explicit Memory
di: Yang, Hongkang, et al.
Pubblicazione: (2024)
di: Yang, Hongkang, et al.
Pubblicazione: (2024)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
Reconstructing Syllable Sequences in Abugida Scripts with Incomplete Inputs
di: Thu, Ye Kyaw, et al.
Pubblicazione: (2025)
di: Thu, Ye Kyaw, et al.
Pubblicazione: (2025)
Large Language Models Generate Harmful Content Using a Distinct, Unified Mechanism
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
Improving the Capabilities of Large Language Model Based Marketing Analytics Copilots With Semantic Search And Fine-Tuning
di: Gao, Yilin, et al.
Pubblicazione: (2024)
di: Gao, Yilin, et al.
Pubblicazione: (2024)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
di: Wang, Fali, et al.
Pubblicazione: (2025)
di: Wang, Fali, et al.
Pubblicazione: (2025)
The Role of Language Imbalance in Cross-lingual Generalisation: Insights from Cloned Language Experiments
di: Schäfer, Anton, et al.
Pubblicazione: (2024)
di: Schäfer, Anton, et al.
Pubblicazione: (2024)
Context-Aware Clustering using Large Language Models
di: Tipirneni, Sindhu, et al.
Pubblicazione: (2024)
di: Tipirneni, Sindhu, et al.
Pubblicazione: (2024)
Combining Language and Topic Models for Hierarchical Text Classification
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
Memory Bank Compression for Continual Adaptation of Large Language Models
di: Katraouras, Thomas, et al.
Pubblicazione: (2026)
di: Katraouras, Thomas, et al.
Pubblicazione: (2026)
Constraint-Driven Small Language Models Based on Agent and OpenAlex Knowledge Graph: Mining Conceptual Pathways and Discovering Innovation Points in Academic Papers
di: Xia, Ziye, et al.
Pubblicazione: (2025)
di: Xia, Ziye, et al.
Pubblicazione: (2025)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
di: Luo, Yuqi, et al.
Pubblicazione: (2024) -
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026) -
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023) -
Engineering A Large Language Model From Scratch
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024) -
PersonalLLM: Tailoring LLMs to Individual Preferences
di: Zollo, Thomas P., et al.
Pubblicazione: (2024)