XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhenyu, Chen, Kehai, Long, Yunfei, Bai, Xuefeng, Zhang, Yaoyin, Wei, Xuchen, Li, Juntao, Zhang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
di: Wei, Xuchen, et al.
Pubblicazione: (2025)
di: Wei, Xuchen, et al.
Pubblicazione: (2025)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
di: Li, Xingzuo, et al.
Pubblicazione: (2025)
di: Li, Xingzuo, et al.
Pubblicazione: (2025)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
di: Duan, Yifan, et al.
Pubblicazione: (2025)
di: Duan, Yifan, et al.
Pubblicazione: (2025)
Exploring the Translation Mechanism of Large Language Models
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
A Survey on Human Preference Learning for Large Language Models
di: Jiang, Ruili, et al.
Pubblicazione: (2024)
di: Jiang, Ruili, et al.
Pubblicazione: (2024)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
LLM with Relation Classifier for Document-Level Relation Extraction
di: Li, Xingzuo, et al.
Pubblicazione: (2024)
di: Li, Xingzuo, et al.
Pubblicazione: (2024)
TF-Attack: Transferable and Fast Adversarial Attacks on Large Language Models
di: Li, Zelin, et al.
Pubblicazione: (2024)
di: Li, Zelin, et al.
Pubblicazione: (2024)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
di: Zhu, Yingjie, et al.
Pubblicazione: (2024)
di: Zhu, Yingjie, et al.
Pubblicazione: (2024)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
di: Chen, Andong, et al.
Pubblicazione: (2024)
di: Chen, Andong, et al.
Pubblicazione: (2024)
Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
di: Xu, Mufan, et al.
Pubblicazione: (2026)
di: Xu, Mufan, et al.
Pubblicazione: (2026)
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
di: Tang, Yihong, et al.
Pubblicazione: (2026)
di: Tang, Yihong, et al.
Pubblicazione: (2026)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
di: Zeng, Bo, et al.
Pubblicazione: (2025)
di: Zeng, Bo, et al.
Pubblicazione: (2025)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
di: Liu, Weijie, et al.
Pubblicazione: (2024)
di: Liu, Weijie, et al.
Pubblicazione: (2024)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
di: Chen, Andong, et al.
Pubblicazione: (2024)
di: Chen, Andong, et al.
Pubblicazione: (2024)
Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering
di: Zhang, Yu, et al.
Pubblicazione: (2024)
di: Zhang, Yu, et al.
Pubblicazione: (2024)
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
di: Zhu, Yingjie, et al.
Pubblicazione: (2025)
di: Zhu, Yingjie, et al.
Pubblicazione: (2025)
IHEval: Evaluating Language Models on Following the Instruction Hierarchy
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
di: Zhang, Zhihan, et al.
Pubblicazione: (2025)
Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey
di: Qu, Bingzheng, et al.
Pubblicazione: (2026)
di: Qu, Bingzheng, et al.
Pubblicazione: (2026)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
Evaluating Large Language Models at Evaluating Instruction Following
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
di: Xu, Mufan, et al.
Pubblicazione: (2024)
di: Xu, Mufan, et al.
Pubblicazione: (2024)
Mitigating Multimodal Hallucination via Phase-wise Self-reward
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
LexInstructEval: Lexical Instruction Following Evaluation for Large Language Models
di: Ren, Huimin, et al.
Pubblicazione: (2025)
di: Ren, Huimin, et al.
Pubblicazione: (2025)
Revisiting the Reliability of Language Models in Instruction-Following
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
di: Dong, Jianshuo, et al.
Pubblicazione: (2025)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
di: Yue, Liang, et al.
Pubblicazione: (2025)
di: Yue, Liang, et al.
Pubblicazione: (2025)
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
di: Li, Zirui, et al.
Pubblicazione: (2026)
di: Li, Zirui, et al.
Pubblicazione: (2026)
Constituency Parsing using LLMs
di: Bai, Xuefeng, et al.
Pubblicazione: (2023)
di: Bai, Xuefeng, et al.
Pubblicazione: (2023)
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
di: Yan, Jianhao, et al.
Pubblicazione: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
di: LI, Yizhi, et al.
Pubblicazione: (2024)
di: LI, Yizhi, et al.
Pubblicazione: (2024)
Mitigating Translationese Bias in Multilingual LLM-as-a-Judge via Disentangled Information Bottleneck
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
di: Wei, Xuchen, et al.
Pubblicazione: (2025) -
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
di: Li, Xingzuo, et al.
Pubblicazione: (2025) -
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
di: Duan, Yifan, et al.
Pubblicazione: (2025) -
Exploring the Translation Mechanism of Large Language Models
di: Zhang, Hongbin, et al.
Pubblicazione: (2025) -
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)