Saved in:
| Main Authors: | He, Yun, Jin, Di, Wang, Chaoqi, Bi, Chloe, Mandyam, Karishma, Zhang, Hejia, Zhu, Chen, Li, Ning, Xu, Tengyu, Lv, Hongjiang, Bhosale, Shruti, Zhu, Chenguang, Sankararaman, Karthik Abinav, Helenowski, Eryk, Kambadur, Melanie, Tayade, Aditya, Ma, Hao, Fang, Han, Wang, Sinong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2410.15553 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Auxiliary Tasks Improves Reference-Free Hallucination Detection in Open-Domain Long-Form Generation
by: Qin, Chengwei, et al.
Published: (2025)
by: Qin, Chengwei, et al.
Published: (2025)
The Perfect Blend: Redefining RLHF with Mixture of Judges
by: Xu, Tengyu, et al.
Published: (2024)
by: Xu, Tengyu, et al.
Published: (2024)
Reinforcement Learning from User Feedback
by: Han, Eric, et al.
Published: (2025)
by: Han, Eric, et al.
Published: (2025)
Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization
by: Yu, Zishun, et al.
Published: (2025)
by: Yu, Zishun, et al.
Published: (2025)
Preference Optimization with Multi-Sample Comparisons
by: Wang, Chaoqi, et al.
Published: (2024)
by: Wang, Chaoqi, et al.
Published: (2024)
Generalized Parallel Scaling with Interdependent Generations
by: Dong, Harry, et al.
Published: (2025)
by: Dong, Harry, et al.
Published: (2025)
Bradley-Terry Policy Optimization for Generative Preference Modeling
by: Feng, Shengyu, et al.
Published: (2025)
by: Feng, Shengyu, et al.
Published: (2025)
Contextual Bandits with Packing and Covering Constraints: A Modular Lagrangian Approach via Regression
by: Slivkins, Aleksandrs, et al.
Published: (2022)
by: Slivkins, Aleksandrs, et al.
Published: (2022)
LlamaRL: A Distributed Asynchronous Reinforcement Learning Framework for Efficient Large-scale LLM Training
by: Wu, Bo, et al.
Published: (2025)
by: Wu, Bo, et al.
Published: (2025)
WILT: A Multi-Turn, Memorization-Robust Inductive Logic Benchmark for LLMs
by: Banatt, Eryk, et al.
Published: (2024)
by: Banatt, Eryk, et al.
Published: (2024)
Phenytoin Intoxication Masquerading as Generalized Chorea
by: Kamalesh Tayade
Published: (2026)
by: Kamalesh Tayade
Published: (2026)
Cooperative Task Execution in Multi-Agent Systems
by: Karishma, et al.
Published: (2024)
by: Karishma, et al.
Published: (2024)
Parallel-SFT: Improving Zero-Shot Cross-Programming-Language Transfer for Code RL
by: Wu, Zhaofeng, et al.
Published: (2026)
by: Wu, Zhaofeng, et al.
Published: (2026)
On the Equivalence of Graph Convolution and Mixup
by: Han, Xiaotian, et al.
Published: (2023)
by: Han, Xiaotian, et al.
Published: (2023)
An Adaptive Distributed Stencil Abstraction for GPUs
by: Bhosale, Aditya, et al.
Published: (2025)
by: Bhosale, Aditya, et al.
Published: (2025)
ALIGN: Aligned Delegation with Performance Guarantees for Multi-Agent LLM Reasoning
by: Zhu, Tong, et al.
Published: (2026)
by: Zhu, Tong, et al.
Published: (2026)
CACTI: Leveraging Copy Masking and Contextual Information to Improve Tabular Data Imputation
by: Gorla, Aditya, et al.
Published: (2025)
by: Gorla, Aditya, et al.
Published: (2025)
StAyaL | Multilingual Style Transfer
by: Thakrar, Karishma, et al.
Published: (2025)
by: Thakrar, Karishma, et al.
Published: (2025)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
by: Zhang, Yiran, et al.
Published: (2025)
by: Zhang, Yiran, et al.
Published: (2025)
Ciprofloxacin‐Associated Posterior Reversible Encephalopathy Syndrome ( PRES )
by: Kamalesh Tayade, et al.
Published: (2025)
by: Kamalesh Tayade, et al.
Published: (2025)
Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment
by: Wang, Chaoqi, et al.
Published: (2025)
by: Wang, Chaoqi, et al.
Published: (2025)
Multi-Level Damage-Aware Graph Learning for Resilient UAV Swarm Networks
by: Lin, Huan, et al.
Published: (2025)
by: Lin, Huan, et al.
Published: (2025)
The Gossiping Insert-Eliminate Algorithm for Multi-Agent Bandits
by: Chawla, Ronshee, et al.
Published: (2020)
by: Chawla, Ronshee, et al.
Published: (2020)
Do Understanding and Generation Fight? A Diagnostic Study of DPO for Unified Multimodal Models
by: Rao, Abinav, et al.
Published: (2026)
by: Rao, Abinav, et al.
Published: (2026)
Simulating, Visualizing and Playing with de Sitter and anti de Sitter spacetime
by: Kopczynski, Eryk
Published: (2023)
by: Kopczynski, Eryk
Published: (2023)
HGMP:Heterogeneous Graph Multi-Task Prompt Learning
by: Jiao, Pengfei, et al.
Published: (2025)
by: Jiao, Pengfei, et al.
Published: (2025)
Law of the Weakest Link: Cross Capabilities of Large Language Models
by: Zhong, Ming, et al.
Published: (2024)
by: Zhong, Ming, et al.
Published: (2024)
MAPRO: Recasting Multi-Agent Prompt Optimization as Maximum a Posteriori Inference
by: Zhang, Zheyuan, et al.
Published: (2025)
by: Zhang, Zheyuan, et al.
Published: (2025)
Architecting Clinical Collaboration: Multi-Agent Reasoning Systems for Multimodal Medical VQA
by: Thakrar, Karishma, et al.
Published: (2025)
by: Thakrar, Karishma, et al.
Published: (2025)
Rank-Aware Quantile Activation for Motion-Robust Crop Segmentation in UAV Imagery
by: Kiran, Abinav, et al.
Published: (2026)
by: Kiran, Abinav, et al.
Published: (2026)
Intent Mismatch Causes LLMs to Get Lost in Multi-Turn Conversation
by: Liu, Geng, et al.
Published: (2026)
by: Liu, Geng, et al.
Published: (2026)
Towards Principled Task Grouping for Multi-Task Learning
by: Wang, Chenguang, et al.
Published: (2024)
by: Wang, Chenguang, et al.
Published: (2024)
Evaluating LLM-based Agents for Multi-Turn Conversations: A Survey
by: Guan, Shengyue, et al.
Published: (2025)
by: Guan, Shengyue, et al.
Published: (2025)
Compact Multi-Service Antenna for Sensing and Communication Using Reconfigurable Complementary Spiral Resonator
by: Raza, Ali, et al.
Published: (2024)
by: Raza, Ali, et al.
Published: (2024)
SweRank+: Multilingual, Multi-Turn Code Ranking for Software Issue Localization
by: Reddy, Revanth Gangi, et al.
Published: (2025)
by: Reddy, Revanth Gangi, et al.
Published: (2025)
Beyond Continuity: Challenges of Context Switching in Multi-Turn Dialogue with LLMs
by: Sinha, Aditya, et al.
Published: (2026)
by: Sinha, Aditya, et al.
Published: (2026)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
by: Zhu, Yu, et al.
Published: (2026)
by: Zhu, Yu, et al.
Published: (2026)
Machine Learning Research Has Outpaced Its Communication Norms and NeurIPS Should Act
by: Rangarajan, Ajay Mandyam, et al.
Published: (2026)
by: Rangarajan, Ajay Mandyam, et al.
Published: (2026)
Mitigating Conversational Inertia in Multi-Turn Agents
by: Wan, Yang, et al.
Published: (2026)
by: Wan, Yang, et al.
Published: (2026)
A Static and Dynamic Attention Framework for Multi Turn Dialogue Generation
by: Zhang, Wei-Nan, et al.
Published: (2024)
by: Zhang, Wei-Nan, et al.
Published: (2024)
Similar Items
-
Learning Auxiliary Tasks Improves Reference-Free Hallucination Detection in Open-Domain Long-Form Generation
by: Qin, Chengwei, et al.
Published: (2025) -
The Perfect Blend: Redefining RLHF with Mixture of Judges
by: Xu, Tengyu, et al.
Published: (2024) -
Reinforcement Learning from User Feedback
by: Han, Eric, et al.
Published: (2025) -
Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization
by: Yu, Zishun, et al.
Published: (2025) -
Preference Optimization with Multi-Sample Comparisons
by: Wang, Chaoqi, et al.
Published: (2024)