EffGen: Enabling Small Language Models as Capable Autonomous Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Srivastava, Gaurav, Hussain, Aafiya, Wang, Chi, Lin, Yingyan Celine, Wang, Xuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BeyondBench: Contamination-Resistant Evaluation of Reasoning in Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
SoundBreak: A Systematic Study of Audio-Only Adversarial Attacks on Trimodal Models
di: Hussain, Aafiya, et al.
Pubblicazione: (2026)
di: Hussain, Aafiya, et al.
Pubblicazione: (2026)
DEBATE, TRAIN, EVOLVE: Self Evolution of Language Model Reasoning
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
di: You, Haoran, et al.
Pubblicazione: (2024)
di: You, Haoran, et al.
Pubblicazione: (2024)
Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
di: Yi, Rongjie, et al.
Pubblicazione: (2024)
di: Yi, Rongjie, et al.
Pubblicazione: (2024)
Hindsight is 20/20: Building Agent Memory that Retains, Recalls, and Reflects
di: Latimer, Chris, et al.
Pubblicazione: (2025)
di: Latimer, Chris, et al.
Pubblicazione: (2025)
Domain-Adapted Small Language Models for Reliable Clinical Triage
di: Aljohani, Manar, et al.
Pubblicazione: (2026)
di: Aljohani, Manar, et al.
Pubblicazione: (2026)
Hymba: A Hybrid-head Architecture for Small Language Models
di: Dong, Xin, et al.
Pubblicazione: (2024)
di: Dong, Xin, et al.
Pubblicazione: (2024)
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
Evaluating Language-Model Agents on Realistic Autonomous Tasks
di: Kinniment, Megan, et al.
Pubblicazione: (2023)
di: Kinniment, Megan, et al.
Pubblicazione: (2023)
MLR-Copilot: Autonomous Machine Learning Research based on Large Language Models Agents
di: Li, Ruochen, et al.
Pubblicazione: (2024)
di: Li, Ruochen, et al.
Pubblicazione: (2024)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
Squat: Quant Small Language Models on the Edge
di: Shen, Xuan, et al.
Pubblicazione: (2024)
di: Shen, Xuan, et al.
Pubblicazione: (2024)
AttriLens-Mol: Attribute Guided Reinforcement Learning for Molecular Property Prediction with Large Language Models
di: Lin, Xuan, et al.
Pubblicazione: (2025)
di: Lin, Xuan, et al.
Pubblicazione: (2025)
ALAS: Autonomous Learning Agent for Self-Updating Language Models
di: Atreja, Dhruv
Pubblicazione: (2025)
di: Atreja, Dhruv
Pubblicazione: (2025)
What Do Large Language Models Know? Tacit Knowledge as a Potential Causal-Explanatory Structure
di: Budding, Céline
Pubblicazione: (2025)
di: Budding, Céline
Pubblicazione: (2025)
Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed
di: Fu, Yonggan, et al.
Pubblicazione: (2025)
di: Fu, Yonggan, et al.
Pubblicazione: (2025)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
On Calibration of Large Language Models: From Response To Capability
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
di: Yang, Sin-Han, et al.
Pubblicazione: (2026)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
di: Wang, Siwei, et al.
Pubblicazione: (2024)
di: Wang, Siwei, et al.
Pubblicazione: (2024)
Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models
di: Wang, Wentian, et al.
Pubblicazione: (2024)
di: Wang, Wentian, et al.
Pubblicazione: (2024)
BlockBatch: Multi-Scale Consensus Decoding for Efficient Diffusion Language Model Inference
di: Wu, Xiaoyou, et al.
Pubblicazione: (2026)
di: Wu, Xiaoyou, et al.
Pubblicazione: (2026)
MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series
di: Zhang, Ge, et al.
Pubblicazione: (2024)
di: Zhang, Ge, et al.
Pubblicazione: (2024)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents
di: Zala, Abhay, et al.
Pubblicazione: (2024)
di: Zala, Abhay, et al.
Pubblicazione: (2024)
ShiftAddLLM: Accelerating Pretrained LLMs via Post-Training Multiplication-Less Reparameterization
di: You, Haoran, et al.
Pubblicazione: (2024)
di: You, Haoran, et al.
Pubblicazione: (2024)
LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models
di: Shi, Dachuan, et al.
Pubblicazione: (2025)
di: Shi, Dachuan, et al.
Pubblicazione: (2025)
OmniJARVIS: Unified Vision-Language-Action Tokenization Enables Open-World Instruction Following Agents
di: Wang, Zihao, et al.
Pubblicazione: (2024)
di: Wang, Zihao, et al.
Pubblicazione: (2024)
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
Fine-Tuning Small Language Models (SLMs) for Autonomous Web-based Geographical Information Systems (AWebGIS)
di: Ashani, Mahdi Nazari, et al.
Pubblicazione: (2025)
di: Ashani, Mahdi Nazari, et al.
Pubblicazione: (2025)
Non-instructional Fine-tuning: Enabling Instruction-Following Capabilities in Pre-trained Language Models without Instruction-Following Data
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
CTBench: A Comprehensive Benchmark for Evaluating Language Model Capabilities in Clinical Trial Design
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
Structured Agent Distillation for Large Language Model
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
A Review of Large Language Models and Autonomous Agents in Chemistry
di: Ramos, Mayk Caldas, et al.
Pubblicazione: (2024)
di: Ramos, Mayk Caldas, et al.
Pubblicazione: (2024)
Documenti analoghi
-
BeyondBench: Contamination-Resistant Evaluation of Reasoning in Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025) -
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025) -
SoundBreak: A Systematic Study of Audio-Only Adversarial Attacks on Trimodal Models
di: Hussain, Aafiya, et al.
Pubblicazione: (2026) -
DEBATE, TRAIN, EVOLVE: Self Evolution of Language Model Reasoning
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025) -
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
di: You, Haoran, et al.
Pubblicazione: (2024)