Efficient Adaptive Transformer: An Empirical Study and Reproducible Framework
Fuente:
arXiv
Salvato in:
| Autore principale: | Miller, Jan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Empirical Study on Cross-lingual Vocabulary Adaptation for Efficient Language Model Inference
di: Yamaguchi, Atsuki, et al.
Pubblicazione: (2024)
di: Yamaguchi, Atsuki, et al.
Pubblicazione: (2024)
Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
Elastic Attention: Test-time Adaptive Sparsity Ratios for Efficient Transformers
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
Reproducibility Study of "XRec: Large Language Models for Explainable Recommendation"
di: Mishra, Ranjan, et al.
Pubblicazione: (2025)
di: Mishra, Ranjan, et al.
Pubblicazione: (2025)
Parameter Efficient Instruction Tuning: An Empirical Study
di: He, Pengfei
Pubblicazione: (2024)
di: He, Pengfei
Pubblicazione: (2024)
What Affects the Stability of Tool Learning? An Empirical Study on the Robustness of Tool Learning Frameworks
di: Huang, Chengrui, et al.
Pubblicazione: (2024)
di: Huang, Chengrui, et al.
Pubblicazione: (2024)
Rethinking Transformer-based Multi-document Summarization: An Empirical Investigation
di: Ma, Congbo, et al.
Pubblicazione: (2024)
di: Ma, Congbo, et al.
Pubblicazione: (2024)
OAgents: An Empirical Study of Building Effective Agents
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
Ensuring Reproducibility in Generative AI Systems for General Use Cases: A Framework for Regression Testing and Open Datasets
di: Morishige, Masumi, et al.
Pubblicazione: (2025)
di: Morishige, Masumi, et al.
Pubblicazione: (2025)
Dissecting Tool-Integrated Reasoning: An Empirical Study and Analysis
di: Zhao, Yufeng, et al.
Pubblicazione: (2025)
di: Zhao, Yufeng, et al.
Pubblicazione: (2025)
An Empirical Study on Prompt Compression for Large Language Models
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
An Empirical Study of Validating Synthetic Data for Formula Generation
di: Singh, Usneek, et al.
Pubblicazione: (2024)
di: Singh, Usneek, et al.
Pubblicazione: (2024)
Algebraic Quantum Intelligence: A New Framework for Reproducible Machine Creativity
di: Yano, Kazuo, et al.
Pubblicazione: (2026)
di: Yano, Kazuo, et al.
Pubblicazione: (2026)
Foundations of LLM Knowledge Materialization: Termination, Reproducibility, Robustness
di: Giordano, Luca, et al.
Pubblicazione: (2025)
di: Giordano, Luca, et al.
Pubblicazione: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Safety Through Reasoning: An Empirical Study of Reasoning Guardrail Models
di: Sreedhar, Makesh Narsimhan, et al.
Pubblicazione: (2025)
di: Sreedhar, Makesh Narsimhan, et al.
Pubblicazione: (2025)
Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models
di: Liu, Ruikang, et al.
Pubblicazione: (2025)
di: Liu, Ruikang, et al.
Pubblicazione: (2025)
Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
di: Liu, Shuodi, et al.
Pubblicazione: (2025)
di: Liu, Shuodi, et al.
Pubblicazione: (2025)
A Proposed S.C.O.R.E. Evaluation Framework for Large Language Models : Safety, Consensus, Objectivity, Reproducibility and Explainability
di: Tan, Ting Fang, et al.
Pubblicazione: (2024)
di: Tan, Ting Fang, et al.
Pubblicazione: (2024)
ADEPT: Adaptive Dynamic Early-Exit Process for Transformers
di: Yoo, Sangmin, et al.
Pubblicazione: (2026)
di: Yoo, Sangmin, et al.
Pubblicazione: (2026)
Projected Compression: Trainable Projection for Efficient Transformer Compression
di: Stefaniak, Maciej, et al.
Pubblicazione: (2025)
di: Stefaniak, Maciej, et al.
Pubblicazione: (2025)
Neuro-Symbolic Frameworks: Conceptual Characterization and Empirical Comparative Analysis
di: Sinha, Sania, et al.
Pubblicazione: (2025)
di: Sinha, Sania, et al.
Pubblicazione: (2025)
An Empirical Study of Conformal Prediction in LLM with ASP Scaffolds for Robust Reasoning
di: Kaur, Navdeep, et al.
Pubblicazione: (2025)
di: Kaur, Navdeep, et al.
Pubblicazione: (2025)
Do Prompts Reshape Representations? An Empirical Study of Prompting Effects on Embeddings
di: Gonzalez-Gutierrez, Cesar, et al.
Pubblicazione: (2025)
di: Gonzalez-Gutierrez, Cesar, et al.
Pubblicazione: (2025)
An Empirical Study of the Role of Incompleteness and Ambiguity in Interactions with Large Language Models
di: Naik, Riya, et al.
Pubblicazione: (2025)
di: Naik, Riya, et al.
Pubblicazione: (2025)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
Evaluating Large Language Models for Abstract Evaluation Tasks: An Empirical Study
di: Liu, Yinuo, et al.
Pubblicazione: (2026)
di: Liu, Yinuo, et al.
Pubblicazione: (2026)
An Empirical Study of SFT-DPO Interaction and Parameterization in Small Language Models
di: Feng, Yuming, et al.
Pubblicazione: (2026)
di: Feng, Yuming, et al.
Pubblicazione: (2026)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
di: Yang, Xinqi, et al.
Pubblicazione: (2024)
di: Yang, Xinqi, et al.
Pubblicazione: (2024)
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
di: Li, Zirui, et al.
Pubblicazione: (2026)
di: Li, Zirui, et al.
Pubblicazione: (2026)
Tandem Transformers for Inference Efficient LLMs
di: S, Aishwarya P, et al.
Pubblicazione: (2024)
di: S, Aishwarya P, et al.
Pubblicazione: (2024)
Explore the Potential of LLMs in Misinformation Detection: An Empirical Study
di: Chen, Mengyang, et al.
Pubblicazione: (2023)
di: Chen, Mengyang, et al.
Pubblicazione: (2023)
The Thinking Spectrum: An Empirical Study of Tunable Reasoning in LLMs through Model Merging
di: Lan, Xiaochong, et al.
Pubblicazione: (2025)
di: Lan, Xiaochong, et al.
Pubblicazione: (2025)
Large Language Models as Universal Predictors? An Empirical Study on Small Tabular Datasets
di: Pavlidis, Nikolaos, et al.
Pubblicazione: (2025)
di: Pavlidis, Nikolaos, et al.
Pubblicazione: (2025)
The Dunning-Kruger Effect in Large Language Models: An Empirical Study of Confidence Calibration
di: Ghosh, Sudipta, et al.
Pubblicazione: (2026)
di: Ghosh, Sudipta, et al.
Pubblicazione: (2026)
Investigating Persuasion Techniques in Arabic: An Empirical Study Leveraging Large Language Models
di: Alzahrani, Abdurahmman, et al.
Pubblicazione: (2024)
di: Alzahrani, Abdurahmman, et al.
Pubblicazione: (2024)
Nomic Embed: Training a Reproducible Long Context Text Embedder
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
Latent Trajectory Dynamics in Large Language Models: A Manifold Evolution Framework with Empirical Validation
di: Zhang, Yukun, et al.
Pubblicazione: (2025)
di: Zhang, Yukun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
An Empirical Study on Cross-lingual Vocabulary Adaptation for Efficient Language Model Inference
di: Yamaguchi, Atsuki, et al.
Pubblicazione: (2024) -
Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study
di: Hu, Zhengyu, et al.
Pubblicazione: (2025) -
Elastic Attention: Test-time Adaptive Sparsity Ratios for Efficient Transformers
di: Tang, Zecheng, et al.
Pubblicazione: (2026) -
Reproducibility Study of "XRec: Large Language Models for Explainable Recommendation"
di: Mishra, Ranjan, et al.
Pubblicazione: (2025) -
Parameter Efficient Instruction Tuning: An Empirical Study
di: He, Pengfei
Pubblicazione: (2024)