Enregistré dans:
| Auteurs principaux: | Sisate, Colin, Goldfinch, Alistair, Waterstone, Vincent, Kingsley, Sebastian, Blackthorn, Mariana |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.00048 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
User-LLM: Efficient LLM Contextualization with User Embeddings
par: Ning, Lin, et autres
Publié: (2024)
par: Ning, Lin, et autres
Publié: (2024)
A Case Study on Contextual Machine Translation in a Professional Scenario of Subtitling
par: Vincent, Sebastian, et autres
Publié: (2024)
par: Vincent, Sebastian, et autres
Publié: (2024)
Does Context Matter? ContextualJudgeBench for Evaluating LLM-based Judges in Contextual Settings
par: Xu, Austin, et autres
Publié: (2025)
par: Xu, Austin, et autres
Publié: (2025)
Contextual Drag: How Errors in the Context Affect LLM Reasoning
par: Cheng, Yun, et autres
Publié: (2026)
par: Cheng, Yun, et autres
Publié: (2026)
ShadowLLM: Predictor-based Contextual Sparsity for Large Language Models
par: Akhauri, Yash, et autres
Publié: (2024)
par: Akhauri, Yash, et autres
Publié: (2024)
RAP: Retrieval-Augmented Planning with Contextual Memory for Multimodal LLM Agents
par: Kagaya, Tomoyuki, et autres
Publié: (2024)
par: Kagaya, Tomoyuki, et autres
Publié: (2024)
Efficient Contextual LLM Cascades through Budget-Constrained Policy Learning
par: Zhang, Xuechen, et autres
Publié: (2024)
par: Zhang, Xuechen, et autres
Publié: (2024)
Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps
par: Chuang, Yung-Sung, et autres
Publié: (2024)
par: Chuang, Yung-Sung, et autres
Publié: (2024)
Code Comprehension then Auditing for Unsupervised LLM Evaluation
par: Patel, Bhrij, et autres
Publié: (2024)
par: Patel, Bhrij, et autres
Publié: (2024)
Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization
par: Sun, Jingyi, et autres
Publié: (2026)
par: Sun, Jingyi, et autres
Publié: (2026)
Position: The Most Expensive Part of an LLM should be its Training Data
par: Kandpal, Nikhil, et autres
Publié: (2025)
par: Kandpal, Nikhil, et autres
Publié: (2025)
On the Design of KL-Regularized Policy Gradient Algorithms for LLM Reasoning
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Interpreting and Controlling LLM Reasoning through Integrated Policy Gradient
par: Li, Changming, et autres
Publié: (2026)
par: Li, Changming, et autres
Publié: (2026)
LLM-Guided Indoor Navigation with Multimodal Map Understanding
par: Coffrini, Alberto, et autres
Publié: (2025)
par: Coffrini, Alberto, et autres
Publié: (2025)
TransformLLM: Adapting Large Language Models via LLM-Transformed Reading Comprehension Text
par: Arbel, Iftach, et autres
Publié: (2024)
par: Arbel, Iftach, et autres
Publié: (2024)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
par: Yang, Ningyuan, et autres
Publié: (2026)
par: Yang, Ningyuan, et autres
Publié: (2026)
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning
par: Jung, Jaehun, et autres
Publié: (2025)
par: Jung, Jaehun, et autres
Publié: (2025)
Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs
par: Cheng, Wenhua, et autres
Publié: (2023)
par: Cheng, Wenhua, et autres
Publié: (2023)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
par: Gu, Zhuohan, et autres
Publié: (2026)
par: Gu, Zhuohan, et autres
Publié: (2026)
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
par: Liu, Yibai, et autres
Publié: (2025)
par: Liu, Yibai, et autres
Publié: (2025)
Token Trails: Navigating Contextual Depths in Conversational AI with ChatLLM
par: Kowsher, Md., et autres
Publié: (2024)
par: Kowsher, Md., et autres
Publié: (2024)
Towards Optimizing the Costs of LLM Usage
par: Shekhar, Shivanshu, et autres
Publié: (2024)
par: Shekhar, Shivanshu, et autres
Publié: (2024)
From Noisy Traces to Stable Gradients: Bias-Variance Optimized Preference Optimization for Aligning Large Reasoning Models
par: Zhu, Mingkang, et autres
Publié: (2025)
par: Zhu, Mingkang, et autres
Publié: (2025)
GTPO: Stabilizing Group Relative Policy Optimization via Gradient and Entropy Control
par: Simoni, Marco, et autres
Publié: (2025)
par: Simoni, Marco, et autres
Publié: (2025)
LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
par: Shimabucoro, Luísa, et autres
Publié: (2024)
par: Shimabucoro, Luísa, et autres
Publié: (2024)
Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing
par: Li, Zhe, et autres
Publié: (2025)
par: Li, Zhe, et autres
Publié: (2025)
CCRS: A Zero-Shot LLM-as-a-Judge Framework for Comprehensive RAG Evaluation
par: Muhamed, Aashiq
Publié: (2025)
par: Muhamed, Aashiq
Publié: (2025)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
par: Yao, Jiarui, et autres
Publié: (2025)
par: Yao, Jiarui, et autres
Publié: (2025)
Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization
par: Su, Zhenpeng, et autres
Publié: (2025)
par: Su, Zhenpeng, et autres
Publié: (2025)
Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models
par: Li, Chengao, et autres
Publié: (2025)
par: Li, Chengao, et autres
Publié: (2025)
A Comprehensive Survey of Direct Preference Optimization: Datasets, Theories, Variants, and Applications
par: Xiao, Wenyi, et autres
Publié: (2024)
par: Xiao, Wenyi, et autres
Publié: (2024)
Balanced Accuracy: The Right Metric for Evaluating LLM Judges -- Explained through Youden's J statistic
par: Collot, Stephane, et autres
Publié: (2025)
par: Collot, Stephane, et autres
Publié: (2025)
MPO: Boosting LLM Agents with Meta Plan Optimization
par: Xiong, Weimin, et autres
Publié: (2025)
par: Xiong, Weimin, et autres
Publié: (2025)
Teaching LLMs How to Learn with Contextual Fine-Tuning
par: Choi, Younwoo, et autres
Publié: (2025)
par: Choi, Younwoo, et autres
Publié: (2025)
ReDit: Reward Dithering for Improved LLM Policy Optimization
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
par: Fan, Chongyu, et autres
Publié: (2024)
par: Fan, Chongyu, et autres
Publié: (2024)
Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents
par: Song, Yifan, et autres
Publié: (2024)
par: Song, Yifan, et autres
Publié: (2024)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
RCStat: A Statistical Framework for using Relative Contextualization in Transformers
par: Mahapatra, Debabrata, et autres
Publié: (2025)
par: Mahapatra, Debabrata, et autres
Publié: (2025)
Less is More: Local Intrinsic Dimensions of Contextual Language Models
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
Documents similaires
-
User-LLM: Efficient LLM Contextualization with User Embeddings
par: Ning, Lin, et autres
Publié: (2024) -
A Case Study on Contextual Machine Translation in a Professional Scenario of Subtitling
par: Vincent, Sebastian, et autres
Publié: (2024) -
Does Context Matter? ContextualJudgeBench for Evaluating LLM-based Judges in Contextual Settings
par: Xu, Austin, et autres
Publié: (2025) -
Contextual Drag: How Errors in the Context Affect LLM Reasoning
par: Cheng, Yun, et autres
Publié: (2026) -
ShadowLLM: Predictor-based Contextual Sparsity for Large Language Models
par: Akhauri, Yash, et autres
Publié: (2024)