IF-CRITIC: Towards a Fine-Grained LLM Critic for Instruction-Following Evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Bosi, Niu, Yilin, Wang, Cunxiang, Ke, Pei, Ling, Xiaoying, Zhang, Ying, Zeng, Aohan, Wang, Hongning, Huang, Minlie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation
di: Wen, Bosi, et al.
Pubblicazione: (2026)
di: Wen, Bosi, et al.
Pubblicazione: (2026)
HPSS: Heuristic Prompting Strategy Search for LLM Evaluators
di: Wen, Bosi, et al.
Pubblicazione: (2025)
di: Wen, Bosi, et al.
Pubblicazione: (2025)
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
di: Ke, Pei, et al.
Pubblicazione: (2023)
di: Ke, Pei, et al.
Pubblicazione: (2023)
RAVEL: Reasoning Agents for Validating and Evaluating LLM Text Synthesis
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
Towards Efficient Exact Optimization of Language Model Alignment
di: Ji, Haozhe, et al.
Pubblicazione: (2024)
di: Ji, Haozhe, et al.
Pubblicazione: (2024)
Benchmarking Complex Instruction-Following with Multiple Constraints Composition
di: Wen, Bosi, et al.
Pubblicazione: (2024)
di: Wen, Bosi, et al.
Pubblicazione: (2024)
Language Model Decoding as Direct Metrics Optimization
di: Ji, Haozhe, et al.
Pubblicazione: (2023)
di: Ji, Haozhe, et al.
Pubblicazione: (2023)
HoWToBench: Holistic Evaluation for LLM's Capability in Human-level Writing using Tree of Writing
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
Does RLHF Scale? Exploring the Impacts From Data, Model, and Method
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
Data-Efficient RLVR via Off-Policy Influence Guidance
di: Zhu, Erle, et al.
Pubblicazione: (2025)
di: Zhu, Erle, et al.
Pubblicazione: (2025)
Learning Task Decomposition to Assist Humans in Competitive Programming
di: Wen, Jiaxin, et al.
Pubblicazione: (2024)
di: Wen, Jiaxin, et al.
Pubblicazione: (2024)
ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization
di: Zhang, Zhexin, et al.
Pubblicazione: (2023)
di: Zhang, Zhexin, et al.
Pubblicazione: (2023)
Training Language Model to Critique for Better Refinement
di: Yu, Tianshu, et al.
Pubblicazione: (2025)
di: Yu, Tianshu, et al.
Pubblicazione: (2025)
LongSafety: Evaluating Long-Context Safety of Large Language Models
di: Lu, Yida, et al.
Pubblicazione: (2025)
di: Lu, Yida, et al.
Pubblicazione: (2025)
Enhancing and Assessing Instruction-Following with Fine-Grained Instruction Variants
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
Agent-SafetyBench: Evaluating the Safety of LLM Agents
di: Zhang, Zhexin, et al.
Pubblicazione: (2024)
di: Zhang, Zhexin, et al.
Pubblicazione: (2024)
Unlocking Reasoning Potential in Large Langauge Models by Scaling Code-form Planning
di: Wen, Jiaxin, et al.
Pubblicazione: (2024)
di: Wen, Jiaxin, et al.
Pubblicazione: (2024)
AutoDetect: Towards a Unified Framework for Automated Weakness Detection in Large Language Models
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
StepMathAgent: A Step-Wise Agent for Evaluating Mathematical Processes through Tree-of-Error
di: Yang, Shu-Xun, et al.
Pubblicazione: (2025)
di: Yang, Shu-Xun, et al.
Pubblicazione: (2025)
Black-Box Prompt Optimization: Aligning Large Language Models without Model Training
di: Cheng, Jiale, et al.
Pubblicazione: (2023)
di: Cheng, Jiale, et al.
Pubblicazione: (2023)
From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks
di: Zhang, Zhexin, et al.
Pubblicazione: (2024)
di: Zhang, Zhexin, et al.
Pubblicazione: (2024)
AMOR: A Recipe for Building Adaptable Modular Knowledge Agents Through Process Feedback
di: Guan, Jian, et al.
Pubblicazione: (2024)
di: Guan, Jian, et al.
Pubblicazione: (2024)
Trust-Region Adaptive Policy Optimization
di: Su, Mingyu, et al.
Pubblicazione: (2025)
di: Su, Mingyu, et al.
Pubblicazione: (2025)
Guiding not Forcing: Enhancing the Transferability of Jailbreaking Attacks on LLMs via Removing Superfluous Constraints
di: Yang, Junxiao, et al.
Pubblicazione: (2025)
di: Yang, Junxiao, et al.
Pubblicazione: (2025)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
di: Wang, Yidong, et al.
Pubblicazione: (2023)
di: Wang, Yidong, et al.
Pubblicazione: (2023)
MM-CRITIC: A Holistic Evaluation of Large Multimodal Models as Multimodal Critique
di: Zeng, Gailun, et al.
Pubblicazione: (2025)
di: Zeng, Gailun, et al.
Pubblicazione: (2025)
From Tags to Trees: Structuring Fine-Grained Knowledge for Controllable Data Selection in LLM Instruction Tuning
di: Niu, Zihan, et al.
Pubblicazione: (2026)
di: Niu, Zihan, et al.
Pubblicazione: (2026)
Grounding LLMs in Scientific Discovery via Embodied Actions
di: Zhang, Bo, et al.
Pubblicazione: (2026)
di: Zhang, Bo, et al.
Pubblicazione: (2026)
A Hierarchical and Evolvable Benchmark for Fine-Grained Code Instruction Following with Multi-Turn Feedback
di: Duan, Guoliang, et al.
Pubblicazione: (2025)
di: Duan, Guoliang, et al.
Pubblicazione: (2025)
CharacterBench: Benchmarking Character Customization of Large Language Models
di: Zhou, Jinfeng, et al.
Pubblicazione: (2024)
di: Zhou, Jinfeng, et al.
Pubblicazione: (2024)
The Superalignment of Superhuman Intelligence with Large Language Models
di: Huang, Minlie, et al.
Pubblicazione: (2024)
di: Huang, Minlie, et al.
Pubblicazione: (2024)
Diverse and Fine-Grained Instruction-Following Ability Exploration with Synthetic Data
di: Gu, Zihui, et al.
Pubblicazione: (2024)
di: Gu, Zihui, et al.
Pubblicazione: (2024)
Think Socially via Cognitive Reasoning
di: Zhou, Jinfeng, et al.
Pubblicazione: (2025)
di: Zhou, Jinfeng, et al.
Pubblicazione: (2025)
SocialSim: Towards Socialized Simulation of Emotional Support Conversation
di: Chen, Zhuang, et al.
Pubblicazione: (2025)
di: Chen, Zhuang, et al.
Pubblicazione: (2025)
Following Devils' Footprint: Towards Real-time Detection of Price Manipulation Attacks
di: Zhang, Bosi, et al.
Pubblicazione: (2025)
di: Zhang, Bosi, et al.
Pubblicazione: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
di: Liu, Xiao, et al.
Pubblicazione: (2023)
di: Liu, Xiao, et al.
Pubblicazione: (2023)
Documenti analoghi
-
IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation
di: Wen, Bosi, et al.
Pubblicazione: (2026) -
HPSS: Heuristic Prompting Strategy Search for LLM Evaluators
di: Wen, Bosi, et al.
Pubblicazione: (2025) -
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
di: Ke, Pei, et al.
Pubblicazione: (2023) -
RAVEL: Reasoning Agents for Validating and Evaluating LLM Text Synthesis
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026) -
RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)