Guardado en:
| Autores principales: | Kumar, Lokendra, Upadhye, Neelesh S., Piedy, Kannan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2601.03270 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adaptive Efficiency Optimization in SDLC: An MILP Approach for Balanced and Cost-Effective Resource Allocation
por: Kumar, Lokendra, et al.
Publicado: (2025)
por: Kumar, Lokendra, et al.
Publicado: (2025)
Leveraging Large Language Models for Solving Rare MIP Challenges
por: Wang, Teng, et al.
Publicado: (2024)
por: Wang, Teng, et al.
Publicado: (2024)
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
por: Fernando, Heshan, et al.
Publicado: (2024)
por: Fernando, Heshan, et al.
Publicado: (2024)
When and Why SignSGD Outperforms SGD: A Theoretical Study Based on $\ell_1$-norm Lower Bounds
por: Tao, Hongyi, et al.
Publicado: (2026)
por: Tao, Hongyi, et al.
Publicado: (2026)
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
por: Kharrat, Salma, et al.
Publicado: (2024)
por: Kharrat, Salma, et al.
Publicado: (2024)
ControlAgent: Automating Control System Design via Novel Integration of LLM Agents and Domain Expertise
por: Guo, Xingang, et al.
Publicado: (2024)
por: Guo, Xingang, et al.
Publicado: (2024)
Causal LLM Routing: End-to-End Regret Minimization from Observational Data
por: Tsiourvas, Asterios, et al.
Publicado: (2025)
por: Tsiourvas, Asterios, et al.
Publicado: (2025)
DiaBlo: Diagonal Blocks Are Sufficient For Finetuning
por: Gurses, Selcuk, et al.
Publicado: (2025)
por: Gurses, Selcuk, et al.
Publicado: (2025)
Gating is Weighting: Understanding Gated Linear Attention through In-context Learning
por: Li, Yingcong, et al.
Publicado: (2025)
por: Li, Yingcong, et al.
Publicado: (2025)
When and How Unlabeled Data Provably Improve In-Context Learning
por: Li, Yingcong, et al.
Publicado: (2025)
por: Li, Yingcong, et al.
Publicado: (2025)
Solving General Natural-Language-Description Optimization Problems with Large Language Models
por: Zhang, Jihai, et al.
Publicado: (2024)
por: Zhang, Jihai, et al.
Publicado: (2024)
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
por: Huang, Xinmeng, et al.
Publicado: (2024)
por: Huang, Xinmeng, et al.
Publicado: (2024)
Reinforcement Learning from Human Feedback with Active Queries
por: Ji, Kaixuan, et al.
Publicado: (2024)
por: Ji, Kaixuan, et al.
Publicado: (2024)
Reward Collapse in Aligning Large Language Models
por: Song, Ziang, et al.
Publicado: (2023)
por: Song, Ziang, et al.
Publicado: (2023)
Variance-reduced Zeroth-Order Methods for Fine-Tuning Language Models
por: Gautam, Tanmay, et al.
Publicado: (2024)
por: Gautam, Tanmay, et al.
Publicado: (2024)
Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
por: Chen, Siyu, et al.
Publicado: (2024)
por: Chen, Siyu, et al.
Publicado: (2024)
Variational Learning is Effective for Large Deep Networks
por: Shen, Yuesong, et al.
Publicado: (2024)
por: Shen, Yuesong, et al.
Publicado: (2024)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
por: Pan, Rui, et al.
Publicado: (2024)
por: Pan, Rui, et al.
Publicado: (2024)
Transformers as Support Vector Machines
por: Tarzanagh, Davoud Ataee, et al.
Publicado: (2023)
por: Tarzanagh, Davoud Ataee, et al.
Publicado: (2023)
Mechanics of Next Token Prediction with Self-Attention
por: Li, Yingcong, et al.
Publicado: (2024)
por: Li, Yingcong, et al.
Publicado: (2024)
Fine-grained Analysis of In-context Linear Estimation: Data, Architecture, and Beyond
por: Li, Yingcong, et al.
Publicado: (2024)
por: Li, Yingcong, et al.
Publicado: (2024)
Linguistically Conditioned Semantic Textual Similarity
por: Tu, Jingxuan, et al.
Publicado: (2024)
por: Tu, Jingxuan, et al.
Publicado: (2024)
Adversarial Representation Engineering: A General Model Editing Framework for Large Language Models
por: Zhang, Yihao, et al.
Publicado: (2024)
por: Zhang, Yihao, et al.
Publicado: (2024)
KurdSTS: The Kurdish Semantic Textual Similarity
por: Abdullah, Abdulhady Abas, et al.
Publicado: (2025)
por: Abdullah, Abdulhady Abas, et al.
Publicado: (2025)
Designing Service Systems from Textual Evidence
por: Ao, Ruicheng, et al.
Publicado: (2026)
por: Ao, Ruicheng, et al.
Publicado: (2026)
Secure LLM Fine-Tuning via Safety-Aware Probing
por: Wu, Chengcan, et al.
Publicado: (2025)
por: Wu, Chengcan, et al.
Publicado: (2025)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
por: Zhang, Zhixin, et al.
Publicado: (2025)
por: Zhang, Zhixin, et al.
Publicado: (2025)
Absorber LLM: Harnessing Causal Synchronization for Test-Time Training
por: Zhang, Zhixin, et al.
Publicado: (2026)
por: Zhang, Zhixin, et al.
Publicado: (2026)
Boosting Jailbreak Attack with Momentum
por: Zhang, Yihao, et al.
Publicado: (2024)
por: Zhang, Yihao, et al.
Publicado: (2024)
RAPO: Risk-Aware Preference Optimization for Generalizable Safe Reasoning
por: Wei, Zeming, et al.
Publicado: (2026)
por: Wei, Zeming, et al.
Publicado: (2026)
Exploring the Robustness of In-Context Learning with Noisy Labels
por: Cheng, Chen, et al.
Publicado: (2024)
por: Cheng, Chen, et al.
Publicado: (2024)
PowerStep: Memory-Efficient Adaptive Optimization via $\ell_p$-Norm Steepest Descent
por: Lu, Yao, et al.
Publicado: (2026)
por: Lu, Yao, et al.
Publicado: (2026)
How Multimodal Integration Boost the Performance of LLM for Optimization: Case Study on Capacitated Vehicle Routing Problems
por: Huang, Yuxiao, et al.
Publicado: (2024)
por: Huang, Yuxiao, et al.
Publicado: (2024)
Large Language Model for Discrete Optimization Problems: Evaluation and Step-by-step Reasoning
por: Qian, Tianhao, et al.
Publicado: (2026)
por: Qian, Tianhao, et al.
Publicado: (2026)
Ensuring Logic in the Fog: Sound POMDP Synthesis with LTL Objectives
por: Zhou, Can, et al.
Publicado: (2026)
por: Zhou, Can, et al.
Publicado: (2026)
Algorithmic Challenges in Ensuring Fairness at the Time of Decision
por: Salem, Jad, et al.
Publicado: (2021)
por: Salem, Jad, et al.
Publicado: (2021)
BONO-Bench: A Comprehensive Test Suite for Bi-objective Numerical Optimization with Traceable Pareto Sets
por: Schäpermeier, Lennart, et al.
Publicado: (2026)
por: Schäpermeier, Lennart, et al.
Publicado: (2026)
PESTS: Persian_English Cross Lingual Corpus for Semantic Textual Similarity
por: Abdous, Mohammad, et al.
Publicado: (2023)
por: Abdous, Mohammad, et al.
Publicado: (2023)
AI4OPT: AI Institute for Advances in Optimization
por: Van Hentenryck, Pascal, et al.
Publicado: (2023)
por: Van Hentenryck, Pascal, et al.
Publicado: (2023)
LLaMoCo: Instruction Tuning of Large Language Models for Optimization Code Generation
por: Ma, Zeyuan, et al.
Publicado: (2024)
por: Ma, Zeyuan, et al.
Publicado: (2024)
Ejemplares similares
-
Adaptive Efficiency Optimization in SDLC: An MILP Approach for Balanced and Cost-Effective Resource Allocation
por: Kumar, Lokendra, et al.
Publicado: (2025) -
Leveraging Large Language Models for Solving Rare MIP Challenges
por: Wang, Teng, et al.
Publicado: (2024) -
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
por: Fernando, Heshan, et al.
Publicado: (2024) -
When and Why SignSGD Outperforms SGD: A Theoretical Study Based on $\ell_1$-norm Lower Bounds
por: Tao, Hongyi, et al.
Publicado: (2026) -
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
por: Kharrat, Salma, et al.
Publicado: (2024)