Divide-Verify-Refine: Can LLMs Self-Align with Complex Instructions?
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xianren, Tang, Xianfeng, Liu, Hui, Wu, Zongyu, He, Qi, Lee, Dongwon, Wang, Suhang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
por: Zhang, Xianren, et al.
Publicado: (2025)
por: Zhang, Xianren, et al.
Publicado: (2025)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
por: Wang, Fali, et al.
Publicado: (2025)
por: Wang, Fali, et al.
Publicado: (2025)
A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness
por: Wang, Fali, et al.
Publicado: (2024)
por: Wang, Fali, et al.
Publicado: (2024)
Bridging Source and Target Domains via Link Prediction for Unsupervised Domain Adaptation on Graphs
por: Wang, Yilong, et al.
Publicado: (2025)
por: Wang, Yilong, et al.
Publicado: (2025)
Catastrophic Failure of LLM Unlearning via Quantization
por: Zhang, Zhiwei, et al.
Publicado: (2024)
por: Zhang, Zhiwei, et al.
Publicado: (2024)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
por: Lin, Minhua, et al.
Publicado: (2025)
por: Lin, Minhua, et al.
Publicado: (2025)
LLM and GNN are Complementary: Distilling LLM for Multimodal Graph Learning
por: Xu, Junjie, et al.
Publicado: (2024)
por: Xu, Junjie, et al.
Publicado: (2024)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
por: Cui, Yingqian, et al.
Publicado: (2025)
por: Cui, Yingqian, et al.
Publicado: (2025)
LLM Benchmark Datasets Should Be Contamination-Resistant
por: Al-Lawati, Ali, et al.
Publicado: (2026)
por: Al-Lawati, Ali, et al.
Publicado: (2026)
MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution
por: Lin, Minhua, et al.
Publicado: (2026)
por: Lin, Minhua, et al.
Publicado: (2026)
Incentivizing LLMs to Self-Verify Their Answers
por: Zhang, Fuxiang, et al.
Publicado: (2025)
por: Zhang, Fuxiang, et al.
Publicado: (2025)
GraphSkill: Documentation-Guided Hierarchical Retrieval-Augmented Coding for Complex Graph Reasoning
por: Wang, Fali, et al.
Publicado: (2026)
por: Wang, Fali, et al.
Publicado: (2026)
Position: Agentic Evolution is the Path to Evolving LLMs
por: Lin, Minhua, et al.
Publicado: (2026)
por: Lin, Minhua, et al.
Publicado: (2026)
Comprehensive Attribution: Inherently Explainable Vision Model with Feature Detector
por: Zhang, Xianren, et al.
Publicado: (2024)
por: Zhang, Xianren, et al.
Publicado: (2024)
How Far are LLMs from Real Search? A Comprehensive Study on Efficiency, Completeness, and Inherent Capabilities
por: Lin, Minhua, et al.
Publicado: (2025)
por: Lin, Minhua, et al.
Publicado: (2025)
From Solving to Verifying: A Unified Objective for Robust Reasoning in LLMs
por: Wang, Xiaoxuan, et al.
Publicado: (2025)
por: Wang, Xiaoxuan, et al.
Publicado: (2025)
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
por: Cui, Yingqian, et al.
Publicado: (2025)
por: Cui, Yingqian, et al.
Publicado: (2025)
Generalizing Test-time Compute-optimal Scaling as an Optimizable Graph
por: Wang, Fali, et al.
Publicado: (2025)
por: Wang, Fali, et al.
Publicado: (2025)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
por: Wang, Qibin, et al.
Publicado: (2025)
por: Wang, Qibin, et al.
Publicado: (2025)
A Survey of Calibration Process for Black-Box LLMs
por: Xie, Liangru, et al.
Publicado: (2024)
por: Xie, Liangru, et al.
Publicado: (2024)
From Local to Cluster: A Unified Framework for Causal Discovery with Latent Variables
por: Li, Zongyu
Publicado: (2026)
por: Li, Zongyu
Publicado: (2026)
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
por: Tang, Zhenchao, et al.
Publicado: (2025)
por: Tang, Zhenchao, et al.
Publicado: (2025)
Light-IF: Endowing LLMs with Generalizable Reasoning via Preview and Self-Checking for Complex Instruction Following
por: Wang, Chenyang, et al.
Publicado: (2025)
por: Wang, Chenyang, et al.
Publicado: (2025)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
por: Cheng, Jiale, et al.
Publicado: (2024)
por: Cheng, Jiale, et al.
Publicado: (2024)
Divide and Refine: Enhancing Multimodal Representation and Explainability for Emotion Recognition in Conversation
por: Mai, Anh-Tuan, et al.
Publicado: (2026)
por: Mai, Anh-Tuan, et al.
Publicado: (2026)
Explaining, Verifying, and Aligning Semantic Hierarchies in Vision-Language Model Embeddings
por: Schwalbe, Gesina, et al.
Publicado: (2026)
por: Schwalbe, Gesina, et al.
Publicado: (2026)
Query-Efficient Agentic Graph Extraction Attacks on GraphRAG Systems
por: Yang, Shuhua, et al.
Publicado: (2026)
por: Yang, Shuhua, et al.
Publicado: (2026)
Self-Evolving LLMs via Continual Instruction Tuning
por: Kang, Jiazheng, et al.
Publicado: (2025)
por: Kang, Jiazheng, et al.
Publicado: (2025)
Transformer-Squared: Self-adaptive LLMs
por: Sun, Qi, et al.
Publicado: (2025)
por: Sun, Qi, et al.
Publicado: (2025)
AIR: Complex Instruction Generation via Automatic Iterative Refinement
por: Liu, Wei, et al.
Publicado: (2025)
por: Liu, Wei, et al.
Publicado: (2025)
Learning with Less: Knowledge Distillation from Large Language Models via Unlabeled Data
por: Li, Juanhui, et al.
Publicado: (2024)
por: Li, Juanhui, et al.
Publicado: (2024)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
por: Liu, Liangxin, et al.
Publicado: (2024)
por: Liu, Liangxin, et al.
Publicado: (2024)
How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
por: Lin, Minhua, et al.
Publicado: (2026)
por: Lin, Minhua, et al.
Publicado: (2026)
Learning Fair Models without Sensitive Attributes: A Generative Approach
por: Zhu, Huaisheng, et al.
Publicado: (2022)
por: Zhu, Huaisheng, et al.
Publicado: (2022)
A Theoretical Understanding of Chain-of-Thought: Coherent Reasoning and Error-Aware Demonstration
por: Cui, Yingqian, et al.
Publicado: (2024)
por: Cui, Yingqian, et al.
Publicado: (2024)
Aligning CodeLLMs with Direct Preference Optimization
por: Miao, Yibo, et al.
Publicado: (2024)
por: Miao, Yibo, et al.
Publicado: (2024)
A Multi-objective Complex Network Pruning Framework Based on Divide-and-conquer and Global Performance Impairment Ranking
por: Shang, Ronghua, et al.
Publicado: (2023)
por: Shang, Ronghua, et al.
Publicado: (2023)
Towards Off-Policy Reinforcement Learning for Ranking Policies with Human Feedback
por: Xiao, Teng, et al.
Publicado: (2024)
por: Xiao, Teng, et al.
Publicado: (2024)
Aligning Findings with Diagnosis: A Self-Consistent Reinforcement Learning Framework for Trustworthy Radiology Reporting
por: Zhao, Kun, et al.
Publicado: (2026)
por: Zhao, Kun, et al.
Publicado: (2026)
LoopUS: Recasting Pretrained LLMs into Looped Latent Refinement Models
por: Park, Taekhyun, et al.
Publicado: (2026)
por: Park, Taekhyun, et al.
Publicado: (2026)
Ejemplares similares
-
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
por: Zhang, Xianren, et al.
Publicado: (2025) -
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
por: Wang, Fali, et al.
Publicado: (2025) -
A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness
por: Wang, Fali, et al.
Publicado: (2024) -
Bridging Source and Target Domains via Link Prediction for Unsupervised Domain Adaptation on Graphs
por: Wang, Yilong, et al.
Publicado: (2025) -
Catastrophic Failure of LLM Unlearning via Quantization
por: Zhang, Zhiwei, et al.
Publicado: (2024)