LLMBox: A Comprehensive Library for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Tang, Tianyi, Hu, Yiwen, Li, Bingqian, Luo, Wenyang, Qin, Zijing, Sun, Haoxiang, Wang, Jiapeng, Xu, Shiyi, Cheng, Xiaoxue, Guo, Geyang, Peng, Han, Zheng, Bowen, Tang, Yiru, Min, Yingqian, Chen, Yushuo, Chen, Jie, Zhao, Yuanqian, Ding, Luran, Wang, Yuhao, Dong, Zican, Xia, Chunxuan, Li, Junyi, Zhou, Kun, Zhao, Wayne Xin, Wen, Ji-Rong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey on Long Text Modeling with Transformers
por: Dong, Zican, et al.
Publicado: (2023)
por: Dong, Zican, et al.
Publicado: (2023)
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
por: Dong, Zican, et al.
Publicado: (2023)
por: Dong, Zican, et al.
Publicado: (2023)
How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices
por: Peng, Han, et al.
Publicado: (2025)
por: Peng, Han, et al.
Publicado: (2025)
Beyond Imitation: Leveraging Fine-grained Quality Signals for Alignment
por: Guo, Geyang, et al.
Publicado: (2023)
por: Guo, Geyang, et al.
Publicado: (2023)
Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems
por: Min, Yingqian, et al.
Publicado: (2024)
por: Min, Yingqian, et al.
Publicado: (2024)
ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests
por: Xu, Shiyi, et al.
Publicado: (2025)
por: Xu, Shiyi, et al.
Publicado: (2025)
Enhancing LLM Reasoning with Reward-guided Tree Search
por: Jiang, Jinhao, et al.
Publicado: (2024)
por: Jiang, Jinhao, et al.
Publicado: (2024)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
por: Sun, Haoxiang, et al.
Publicado: (2025)
por: Sun, Haoxiang, et al.
Publicado: (2025)
Resonant Phenomenon in a Stochastic Delayed Bistable Chemical System
por: Chunxuan Li
Publicado: (2015)
por: Chunxuan Li
Publicado: (2015)
A Survey of Large Language Models
por: Zhao, Wayne Xin, et al.
Publicado: (2023)
por: Zhao, Wayne Xin, et al.
Publicado: (2023)
LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation
por: Dong, Zican, et al.
Publicado: (2025)
por: Dong, Zican, et al.
Publicado: (2025)
ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution
por: Dong, Zican, et al.
Publicado: (2026)
por: Dong, Zican, et al.
Publicado: (2026)
Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework
por: Chen, Jie, et al.
Publicado: (2025)
por: Chen, Jie, et al.
Publicado: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
por: Chen, Yushuo, et al.
Publicado: (2024)
por: Chen, Yushuo, et al.
Publicado: (2024)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
por: Dong, Zican, et al.
Publicado: (2024)
por: Dong, Zican, et al.
Publicado: (2024)
RecNet: Self-Evolving Preference Propagation for Agentic Recommender Systems
por: Li, Bingqian, et al.
Publicado: (2026)
por: Li, Bingqian, et al.
Publicado: (2026)
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
por: Wang, Xiaolei, et al.
Publicado: (2025)
por: Wang, Xiaolei, et al.
Publicado: (2025)
YuLan-Mini: An Open Data-efficient Language Model
por: Hu, Yiwen, et al.
Publicado: (2024)
por: Hu, Yiwen, et al.
Publicado: (2024)
A hybrid carrier‐based discontinuous PWM with neutral‐point voltage ripple and current distortion reduction for Vienna rectifier
por: Yushuo Pei, et al.
Publicado: (2024)
por: Yushuo Pei, et al.
Publicado: (2024)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
por: Tang, Xinyu, et al.
Publicado: (2025)
por: Tang, Xinyu, et al.
Publicado: (2025)
Situación de la mortalidad por causas reducibles en menores de cinco años, Colombia, 1985-2004
por: Albenia Lurán
Publicado: (2009)
por: Albenia Lurán
Publicado: (2009)
Entropy-Guided Token Dropout: Training Autoregressive Language Models with Limited Domain Data
por: Wang, Jiapeng, et al.
Publicado: (2025)
por: Wang, Jiapeng, et al.
Publicado: (2025)
Efficient and Stable Short‐Wave Infrared‐Emitting from Partly Inverse Spinel ZnGa 2 O 4 : Fe 3+ , Ni 2+ for Versatile Applications: Self‐Photoluminescence, Anion Substitution, and Energy Transfer Study
por: Chunxuan Chen, et al.
Publicado: (2025)
por: Chunxuan Chen, et al.
Publicado: (2025)
The Dawn After the Dark: An Empirical Study on Factuality Hallucination in Large Language Models
por: Li, Junyi, et al.
Publicado: (2024)
por: Li, Junyi, et al.
Publicado: (2024)
CAFE: Retrieval Head-based Coarse-to-Fine Information Seeking to Enhance Multi-Document QA Capability
por: Peng, Han, et al.
Publicado: (2025)
por: Peng, Han, et al.
Publicado: (2025)
On Minimization/Maximization of the Generalized Multi-Order Complex Quadratic Form With Constant-Modulus Constraints
por: Shi, Chunxuan, et al.
Publicado: (2025)
por: Shi, Chunxuan, et al.
Publicado: (2025)
P‐4.9: Applications and Future Trends of Agents in the Metaverse
por: Luran Xing, et al.
Publicado: (2025)
por: Luran Xing, et al.
Publicado: (2025)
P‐4.4: Applications and Prospects of Multimodal Emotion Analysis in Emotion‐Driven Virtual Worlds
por: Luran Xing, et al.
Publicado: (2025)
por: Luran Xing, et al.
Publicado: (2025)
REAR: A Relevance-Aware Retrieval-Augmented Framework for Open-Domain Question Answering
por: Wang, Yuhao, et al.
Publicado: (2024)
por: Wang, Yuhao, et al.
Publicado: (2024)
Self-Indexing KVCache: Predicting Sparse Attention from Compressed Keys
por: Yang, Xu, et al.
Publicado: (2026)
por: Yang, Xu, et al.
Publicado: (2026)
An Edge-Cloud Collaborative Architecture for Proactive Elderly Care: Real-Time Risk Assessment and Three-Level Emergency Response
por: Zhou, Lijie, et al.
Publicado: (2026)
por: Zhou, Lijie, et al.
Publicado: (2026)
A Multi-Modal CNN-LSTM Framework with Multi-Head Attention and Focal Loss for Real-Time Elderly Fall Detection
por: Zhou, Lijie, et al.
Publicado: (2026)
por: Zhou, Lijie, et al.
Publicado: (2026)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
por: Yang, Shiyi, et al.
Publicado: (2025)
por: Yang, Shiyi, et al.
Publicado: (2025)
ControlHair: Physically-based Video Diffusion for Controllable Dynamic Hair Rendering
por: Lin, Weikai, et al.
Publicado: (2025)
por: Lin, Weikai, et al.
Publicado: (2025)
Curse or blessing? Impact of the scope and duration of negative attainment discrepancy on ESG practices
por: Shan Li, et al.
Publicado: (2024)
por: Shan Li, et al.
Publicado: (2024)
Recent Progress of Substituted Allylboron Compounds in Catalytic Asymmetric Allylation Reactions
por: Xiaoxue Tang, et al.
Publicado: (2024)
por: Xiaoxue Tang, et al.
Publicado: (2024)
Engineering Glucagon via Molecular and Formulation Strategies: From Natural Hormone to Effective and Stable Therapeutics
por: Xin Li, et al.
Publicado: (2025)
por: Xin Li, et al.
Publicado: (2025)
Ejemplares similares
-
A Survey on Long Text Modeling with Transformers
por: Dong, Zican, et al.
Publicado: (2023) -
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
por: Dong, Zican, et al.
Publicado: (2023) -
How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices
por: Peng, Han, et al.
Publicado: (2025) -
Beyond Imitation: Leveraging Fine-grained Quality Signals for Alignment
por: Guo, Geyang, et al.
Publicado: (2023) -
Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems
por: Min, Yingqian, et al.
Publicado: (2024)