Putting It All into Context: Simplifying Agents with LCLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Mingjian, Ruan, Yangjun, Lastras, Luis, Kapanipathi, Pavan, Hashimoto, Tatsunori |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
par: Jiang, Mingjian, et autres
Publié: (2024)
par: Jiang, Mingjian, et autres
Publié: (2024)
Observational Scaling Laws and the Predictability of Language Model Performance
par: Ruan, Yangjun, et autres
Publié: (2024)
par: Ruan, Yangjun, et autres
Publié: (2024)
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025)
par: Ruan, Yangjun, et autres
Publié: (2025)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
par: Ruan, Yangjun, et autres
Publié: (2023)
par: Ruan, Yangjun, et autres
Publié: (2023)
Language Models with Conformal Factuality Guarantees
par: Mohri, Christopher, et autres
Publié: (2024)
par: Mohri, Christopher, et autres
Publié: (2024)
Understanding Finetuning for Factual Knowledge Extraction
par: Ghosal, Gaurav, et autres
Publié: (2024)
par: Ghosal, Gaurav, et autres
Publié: (2024)
Improving Pretraining Data Using Perplexity Correlations
par: Thrush, Tristan, et autres
Publié: (2024)
par: Thrush, Tristan, et autres
Publié: (2024)
MiGrATe: Mixed-Policy GRPO for Adaptation at Test-Time
par: Phan, Peter, et autres
Publié: (2025)
par: Phan, Peter, et autres
Publié: (2025)
Linguistic Calibration of Long-Form Generations
par: Band, Neil, et autres
Publié: (2024)
par: Band, Neil, et autres
Publié: (2024)
Robust Distortion-free Watermarks for Language Models
par: Kuditipudi, Rohith, et autres
Publié: (2023)
par: Kuditipudi, Rohith, et autres
Publié: (2023)
The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas
par: Si, Chenglei, et autres
Publié: (2025)
par: Si, Chenglei, et autres
Publié: (2025)
Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers
par: Si, Chenglei, et autres
Publié: (2024)
par: Si, Chenglei, et autres
Publié: (2024)
On the Learnability of Watermarks for Language Models
par: Gu, Chenchen, et autres
Publié: (2023)
par: Gu, Chenchen, et autres
Publié: (2023)
Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators
par: Dubois, Yann, et autres
Publié: (2024)
par: Dubois, Yann, et autres
Publié: (2024)
Eliciting Language Model Behaviors with Investigator Agents
par: Li, Xiang Lisa, et autres
Publié: (2025)
par: Li, Xiang Lisa, et autres
Publié: (2025)
Synthetic continued pretraining
par: Yang, Zitong, et autres
Publié: (2024)
par: Yang, Zitong, et autres
Publié: (2024)
Agentic Adversarial QA for Improving Domain-Specific LLMs
par: Grari, Vincent, et autres
Publié: (2026)
par: Grari, Vincent, et autres
Publié: (2026)
ToolRM: Outcome Reward Models for Tool-Calling Large Language Models
par: Agarwal, Mayank, et autres
Publié: (2025)
par: Agarwal, Mayank, et autres
Publié: (2025)
AutoBencher: Towards Declarative Benchmark Construction
par: Li, Xiang Lisa, et autres
Publié: (2024)
par: Li, Xiang Lisa, et autres
Publié: (2024)
Auditing Prompt Caching in Language Model APIs
par: Gu, Chenchen, et autres
Publié: (2025)
par: Gu, Chenchen, et autres
Publié: (2025)
Towards Execution-Grounded Automated AI Research
par: Si, Chenglei, et autres
Publié: (2026)
par: Si, Chenglei, et autres
Publié: (2026)
Formally Specifying the High-Level Behavior of LLM-Based Agents
par: Crouse, Maxwell, et autres
Publié: (2023)
par: Crouse, Maxwell, et autres
Publié: (2023)
$f$-PO: Generalizing Preference Optimization with $f$-divergence Minimization
par: Han, Jiaqi, et autres
Publié: (2024)
par: Han, Jiaqi, et autres
Publié: (2024)
Interpretability Illusions in the Generalization of Simplified Models
par: Friedman, Dan, et autres
Publié: (2023)
par: Friedman, Dan, et autres
Publié: (2023)
CTC-DRO: Robust Optimization for Reducing Language Disparities in Speech Recognition
par: Bartelds, Martijn, et autres
Publié: (2025)
par: Bartelds, Martijn, et autres
Publié: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
par: Dong, Honghua, et autres
Publié: (2024)
par: Dong, Honghua, et autres
Publié: (2024)
Synthetic Data for any Differentiable Target
par: Thrush, Tristan, et autres
Publié: (2026)
par: Thrush, Tristan, et autres
Publié: (2026)
Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks
par: Abdelaziz, Ibrahim, et autres
Publié: (2024)
par: Abdelaziz, Ibrahim, et autres
Publié: (2024)
Simplify-This: A Comparative Analysis of Prompt-Based and Fine-Tuned LLMs
par: Cohen, Eilam, et autres
Publié: (2026)
par: Cohen, Eilam, et autres
Publié: (2026)
AlpacaFarm: A Simulation Framework for Methods that Learn from Human Feedback
par: Dubois, Yann, et autres
Publié: (2023)
par: Dubois, Yann, et autres
Publié: (2023)
Temporal Entailment Pretraining for Clinical Language Models over EHR Data
par: Tanaka, Tatsunori, et autres
Publié: (2025)
par: Tanaka, Tatsunori, et autres
Publié: (2025)
FSPO: Few-Shot Optimization of Synthetic Preferences Personalizes to Real Users
par: Singh, Anikait, et autres
Publié: (2025)
par: Singh, Anikait, et autres
Publié: (2025)
Scaling Long-Horizon LLM Agent via Context-Folding
par: Sun, Weiwei, et autres
Publié: (2025)
par: Sun, Weiwei, et autres
Publié: (2025)
LLMSteer: Improving Long-Context LLM Inference by Steering Attention on Reused Contexts
par: Gu, Zhuohan, et autres
Publié: (2024)
par: Gu, Zhuohan, et autres
Publié: (2024)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
par: Ye, Rui, et autres
Publié: (2025)
par: Ye, Rui, et autres
Publié: (2025)
More Agents Is All You Need
par: Li, Junyou, et autres
Publié: (2024)
par: Li, Junyou, et autres
Publié: (2024)
Toward Conversational Agents with Context and Time Sensitive Long-term Memory
par: Alonso, Nick, et autres
Publié: (2024)
par: Alonso, Nick, et autres
Publié: (2024)
A Survey on Data Selection for Language Models
par: Albalak, Alon, et autres
Publié: (2024)
par: Albalak, Alon, et autres
Publié: (2024)
s1: Simple test-time scaling
par: Muennighoff, Niklas, et autres
Publié: (2025)
par: Muennighoff, Niklas, et autres
Publié: (2025)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
par: Gu, Zhuohan, et autres
Publié: (2026)
par: Gu, Zhuohan, et autres
Publié: (2026)
Documents similaires
-
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
par: Jiang, Mingjian, et autres
Publié: (2024) -
Observational Scaling Laws and the Predictability of Language Model Performance
par: Ruan, Yangjun, et autres
Publié: (2024) -
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025) -
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
par: Ruan, Yangjun, et autres
Publié: (2023) -
Language Models with Conformal Factuality Guarantees
par: Mohri, Christopher, et autres
Publié: (2024)