Can Language Models Follow Multiple Turns of Entangled Instructions?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Han, Chi, Liu, Xin, Wang, Haodong, Li, Shiyang, Yang, Jingfeng, Jiang, Haoming, Wang, Zhengyang, Yin, Qingyu, Qiu, Liang, Yu, Changlong, Gao, Yifan, Li, Zheng, Yin, Bing, Shang, Jingbo, Ji, Heng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RNR: Teaching Large Language Models to Follow Roles and Rules
von: Wang, Kuan, et al.
Veröffentlicht: (2024)
von: Wang, Kuan, et al.
Veröffentlicht: (2024)
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
von: Zhang, Zhihan, et al.
Veröffentlicht: (2025)
von: Zhang, Zhihan, et al.
Veröffentlicht: (2025)
Data Diversity Matters for Robust Instruction Tuning
von: Bukharin, Alexander, et al.
Veröffentlicht: (2023)
von: Bukharin, Alexander, et al.
Veröffentlicht: (2023)
MEMORYLLM: Towards Self-Updatable Large Language Models
von: Wang, Yu, et al.
Veröffentlicht: (2024)
von: Wang, Yu, et al.
Veröffentlicht: (2024)
Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs
von: Cheng, Kewei, et al.
Veröffentlicht: (2024)
von: Cheng, Kewei, et al.
Veröffentlicht: (2024)
HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning
von: Wang, Weiqi, et al.
Veröffentlicht: (2026)
von: Wang, Weiqi, et al.
Veröffentlicht: (2026)
Incubating Text Classifiers Following User Instruction with Nothing but LLM
von: Peng, Letian, et al.
Veröffentlicht: (2024)
von: Peng, Letian, et al.
Veröffentlicht: (2024)
Learning to Optimize Multi-Objective Alignment Through Dynamic Reward Weighting
von: Lu, Yining, et al.
Veröffentlicht: (2025)
von: Lu, Yining, et al.
Veröffentlicht: (2025)
Scaling Laws for Predicting Downstream Performance in LLMs
von: Chen, Yangyi, et al.
Veröffentlicht: (2024)
von: Chen, Yangyi, et al.
Veröffentlicht: (2024)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
von: Chen, Yizhuo, et al.
Veröffentlicht: (2025)
von: Chen, Yizhuo, et al.
Veröffentlicht: (2025)
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
von: Zhang, Yuheng, et al.
Veröffentlicht: (2025)
von: Zhang, Yuheng, et al.
Veröffentlicht: (2025)
Entangled Relations: Leveraging NLI and Meta-analysis to Enhance Biomedical Relation Extraction
von: Hogan, William, et al.
Veröffentlicht: (2024)
von: Hogan, William, et al.
Veröffentlicht: (2024)
InstructAttribute: Fine-grained Object Attributes editing with Instruction
von: Yin, Xingxi, et al.
Veröffentlicht: (2025)
von: Yin, Xingxi, et al.
Veröffentlicht: (2025)
Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates
von: Dang, Hy, et al.
Veröffentlicht: (2025)
von: Dang, Hy, et al.
Veröffentlicht: (2025)
Shopping MMLU: A Massive Multi-Task Online Shopping Benchmark for Large Language Models
von: Jin, Yilun, et al.
Veröffentlicht: (2024)
von: Jin, Yilun, et al.
Veröffentlicht: (2024)
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
von: Xu, Siyuan, et al.
Veröffentlicht: (2026)
von: Xu, Siyuan, et al.
Veröffentlicht: (2026)
A Hierarchical and Evolvable Benchmark for Fine-Grained Code Instruction Following with Multi-Turn Feedback
von: Duan, Guoliang, et al.
Veröffentlicht: (2025)
von: Duan, Guoliang, et al.
Veröffentlicht: (2025)
Situated Natural Language Explanations
von: Zhu, Zining, et al.
Veröffentlicht: (2023)
von: Zhu, Zining, et al.
Veröffentlicht: (2023)
OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation
von: Wang, Zilong, et al.
Veröffentlicht: (2024)
von: Wang, Zilong, et al.
Veröffentlicht: (2024)
RRO: LLM Agent Optimization Through Rising Reward Trajectories
von: Wang, Zilong, et al.
Veröffentlicht: (2025)
von: Wang, Zilong, et al.
Veröffentlicht: (2025)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
von: He, Yun, et al.
Veröffentlicht: (2024)
von: He, Yun, et al.
Veröffentlicht: (2024)
Toward Zero-Shot Instruction Following
von: Lou, Renze, et al.
Veröffentlicht: (2023)
von: Lou, Renze, et al.
Veröffentlicht: (2023)
Training LLMs for Multi-Step Tool Orchestration with Constrained Data Synthesis and Graduated Rewards
von: Jiayang, Cheng, et al.
Veröffentlicht: (2026)
von: Jiayang, Cheng, et al.
Veröffentlicht: (2026)
IntentionQA: A Benchmark for Evaluating Purchase Intention Comprehension Abilities of Language Models in E-commerce
von: Ding, Wenxuan, et al.
Veröffentlicht: (2024)
von: Ding, Wenxuan, et al.
Veröffentlicht: (2024)
Leader-Follower Mean Field LQG Games with Multiplicative Noise
von: Wang, Bing-Chang, et al.
Veröffentlicht: (2025)
von: Wang, Bing-Chang, et al.
Veröffentlicht: (2025)
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
IF-VidCap: Can Video Caption Models Follow Instructions?
von: Li, Shihao, et al.
Veröffentlicht: (2025)
von: Li, Shihao, et al.
Veröffentlicht: (2025)
How Well Do Models Follow Visual Instructions? VIBE: A Systematic Benchmark for Visual Instruction-Driven Image Editing
von: Zhang, Huanyu, et al.
Veröffentlicht: (2026)
von: Zhang, Huanyu, et al.
Veröffentlicht: (2026)
SessionIntentBench: A Multi-task Inter-session Intention-shift Modeling Benchmark for E-commerce Customer Behavior Understanding
von: Yang, Yuqi, et al.
Veröffentlicht: (2025)
von: Yang, Yuqi, et al.
Veröffentlicht: (2025)
DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
von: Fan, Wei, et al.
Veröffentlicht: (2025)
von: Fan, Wei, et al.
Veröffentlicht: (2025)
BioD2C: A Dual-level Semantic Consistency Constraint Framework for Biomedical VQA
von: Ji, Zhengyang, et al.
Veröffentlicht: (2025)
von: Ji, Zhengyang, et al.
Veröffentlicht: (2025)
MMMT-IF: A Challenging Multimodal Multi-Turn Instruction Following Benchmark
von: Epstein, Elliot L., et al.
Veröffentlicht: (2024)
von: Epstein, Elliot L., et al.
Veröffentlicht: (2024)
Interpreting Social Bias in LVLMs via Information Flow Analysis and Multi-Round Dialogue Evaluation
von: Ji, Zhengyang, et al.
Veröffentlicht: (2025)
von: Ji, Zhengyang, et al.
Veröffentlicht: (2025)
PartInstruct: Part-level Instruction Following for Fine-grained Robot Manipulation
von: Yin, Yifan, et al.
Veröffentlicht: (2025)
von: Yin, Yifan, et al.
Veröffentlicht: (2025)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
von: Sun, Yuchong, et al.
Veröffentlicht: (2023)
von: Sun, Yuchong, et al.
Veröffentlicht: (2023)
Learning with Rare Success but Rich Feedback via Reflection-Enhanced Self-Distillation
von: Zhang, Yuwei, et al.
Veröffentlicht: (2026)
von: Zhang, Yuwei, et al.
Veröffentlicht: (2026)
ColorEdit: Training-free Image-Guided Color editing with diffusion model
von: Yin, Xingxi, et al.
Veröffentlicht: (2024)
von: Yin, Xingxi, et al.
Veröffentlicht: (2024)
From Word to World: Can Large Language Models be Implicit Text-based World Models?
von: Li, Yixia, et al.
Veröffentlicht: (2025)
von: Li, Yixia, et al.
Veröffentlicht: (2025)
Can LLMs Learn from Previous Mistakes? Investigating LLMs' Errors to Boost for Reasoning
von: Tong, Yongqi, et al.
Veröffentlicht: (2024)
von: Tong, Yongqi, et al.
Veröffentlicht: (2024)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
von: Zhuang, Yuchen, et al.
Veröffentlicht: (2025)
von: Zhuang, Yuchen, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
RNR: Teaching Large Language Models to Follow Roles and Rules
von: Wang, Kuan, et al.
Veröffentlicht: (2024) -
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
von: Zhang, Zhihan, et al.
Veröffentlicht: (2025) -
Data Diversity Matters for Robust Instruction Tuning
von: Bukharin, Alexander, et al.
Veröffentlicht: (2023) -
MEMORYLLM: Towards Self-Updatable Large Language Models
von: Wang, Yu, et al.
Veröffentlicht: (2024) -
Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs
von: Cheng, Kewei, et al.
Veröffentlicht: (2024)