Salvato in:
| Autori principali: | Qi, Ji, Zhang, Chuchun, Wang, Xiaozhi, Zeng, Kaisheng, Yu, Jifan, Liu, Jinxin, Sun, Jiuding, Chen, Yuxiang, Hou, Lei, Li, Juanzi, Xu, Bin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2305.13981 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ADELIE: Aligning Large Language Models on Information Extraction
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
Event-level Knowledge Editing
di: Peng, Hao, et al.
Pubblicazione: (2024)
di: Peng, Hao, et al.
Pubblicazione: (2024)
ChatLog: Carefully Evaluating the Evolution of ChatGPT Across Time
di: Tu, Shangqing, et al.
Pubblicazione: (2023)
di: Tu, Shangqing, et al.
Pubblicazione: (2023)
Evaluating Generative Language Models in Information Extraction as Subjective Question Correction
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
VidCoM: Fast Video Comprehension through Large Language Models with Multimodal Tools
di: Qi, Ji, et al.
Pubblicazione: (2023)
di: Qi, Ji, et al.
Pubblicazione: (2023)
R-Eval: A Unified Toolkit for Evaluating Domain Knowledge of Retrieval Augmented Large Language Models
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
OpenEP: Open-Ended Future Event Prediction
di: Guan, Yong, et al.
Pubblicazione: (2024)
di: Guan, Yong, et al.
Pubblicazione: (2024)
StoryAlign: Evaluating and Training Reward Models for Story Generation
di: Xia, Haotian, et al.
Pubblicazione: (2026)
di: Xia, Haotian, et al.
Pubblicazione: (2026)
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
di: Qi, Yunjia, et al.
Pubblicazione: (2024)
VerIF: Verification Engineering for Reinforcement Learning in Instruction Following
di: Peng, Hao, et al.
Pubblicazione: (2025)
di: Peng, Hao, et al.
Pubblicazione: (2025)
LLMAEL: Large Language Models are Good Context Augmenters for Entity Linking
di: Xin, Amy, et al.
Pubblicazione: (2024)
di: Xin, Amy, et al.
Pubblicazione: (2024)
WaterBench: Towards Holistic Evaluation of Watermarks for Large Language Models
di: Tu, Shangqing, et al.
Pubblicazione: (2023)
di: Tu, Shangqing, et al.
Pubblicazione: (2023)
StoryWriter: A Multi-Agent Framework for Long Story Generation
di: Xia, Haotian, et al.
Pubblicazione: (2025)
di: Xia, Haotian, et al.
Pubblicazione: (2025)
MAVEN-Fact: A Large-scale Event Factuality Detection Dataset
di: Li, Chunyang, et al.
Pubblicazione: (2024)
di: Li, Chunyang, et al.
Pubblicazione: (2024)
Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
di: Peng, Hao, et al.
Pubblicazione: (2025)
di: Peng, Hao, et al.
Pubblicazione: (2025)
MM-MATH: Advancing Multimodal Math Evaluation with Process Evaluation and Fine-grained Classification
di: Sun, Kai, et al.
Pubblicazione: (2024)
di: Sun, Kai, et al.
Pubblicazione: (2024)
TacoERE: Cluster-aware Compression for Event Relation Extraction
di: Guan, Yong, et al.
Pubblicazione: (2024)
di: Guan, Yong, et al.
Pubblicazione: (2024)
A Cause-Effect Look at Alleviating Hallucination of Knowledge-grounded Dialogue Generation
di: Yu, Jifan, et al.
Pubblicazione: (2024)
di: Yu, Jifan, et al.
Pubblicazione: (2024)
WebSeer: Training Deeper Search Agents through Reinforcement Learning with Self-Reflection
di: He, Guanzhong, et al.
Pubblicazione: (2025)
di: He, Guanzhong, et al.
Pubblicazione: (2025)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
On the Paradoxical Interference between Instruction-Following and Task Solving
di: Qi, Yunjia, et al.
Pubblicazione: (2026)
di: Qi, Yunjia, et al.
Pubblicazione: (2026)
WildReward: Learning Reward Models from In-the-Wild Human Interactions
di: Peng, Hao, et al.
Pubblicazione: (2026)
di: Peng, Hao, et al.
Pubblicazione: (2026)
Knowledge-to-Jailbreak: Investigating Knowledge-driven Jailbreaking Attacks for Large Language Models
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
Auxiliary Metrics Help Decoding Skill Neurons in the Wild
di: Zhao, Yixiu, et al.
Pubblicazione: (2025)
di: Zhao, Yixiu, et al.
Pubblicazione: (2025)
EventSum: A Large-Scale Event-Centric Summarization Dataset for Chinese Multi-News Documents
di: Zhu, Mengna, et al.
Pubblicazione: (2024)
di: Zhu, Mengna, et al.
Pubblicazione: (2024)
MAVEN-Arg: Completing the Puzzle of All-in-One Event Understanding Dataset with Event Argument Annotation
di: Wang, Xiaozhi, et al.
Pubblicazione: (2023)
di: Wang, Xiaozhi, et al.
Pubblicazione: (2023)
Untangle the KNOT: Interweaving Conflicting Knowledge and Reasoning Skills in Large Language Models
di: Liu, Yantao, et al.
Pubblicazione: (2024)
di: Liu, Yantao, et al.
Pubblicazione: (2024)
AtomR: Atomic Operator-Empowered Large Language Models for Heterogeneous Knowledge Reasoning
di: Xin, Amy, et al.
Pubblicazione: (2024)
di: Xin, Amy, et al.
Pubblicazione: (2024)
Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons
di: Chen, Jianhui, et al.
Pubblicazione: (2024)
di: Chen, Jianhui, et al.
Pubblicazione: (2024)
KoLA: Carefully Benchmarking World Knowledge of Large Language Models
di: Yu, Jifan, et al.
Pubblicazione: (2023)
di: Yu, Jifan, et al.
Pubblicazione: (2023)
Rethink Deep Learning with Invariance in Data Representation
di: Qi, Shuren, et al.
Pubblicazione: (2024)
di: Qi, Shuren, et al.
Pubblicazione: (2024)
How Proficient Are Large Language Models in Formal Languages? An In-Depth Insight for Knowledge Base Question Answering
di: Liu, Jinxin, et al.
Pubblicazione: (2024)
di: Liu, Jinxin, et al.
Pubblicazione: (2024)
LecEval: An Automated Metric for Multimodal Knowledge Acquisition in Multimedia Learning
di: Yin, Joy Lim Jia, et al.
Pubblicazione: (2025)
di: Yin, Joy Lim Jia, et al.
Pubblicazione: (2025)
ReaRAG: Knowledge-guided Reasoning Enhances Factuality of Large Reasoning Models with Iterative Retrieval Augmented Generation
di: Lee, Zhicheng, et al.
Pubblicazione: (2025)
di: Lee, Zhicheng, et al.
Pubblicazione: (2025)
LinguaLens: Towards Interpreting Linguistic Mechanisms of Large Language Models via Sparse Auto-Encoder
di: Jing, Yi, et al.
Pubblicazione: (2025)
di: Jing, Yi, et al.
Pubblicazione: (2025)
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
di: Jing, Yi, et al.
Pubblicazione: (2026)
di: Jing, Yi, et al.
Pubblicazione: (2026)
Explainable Few-shot Knowledge Tracing
di: Li, Haoxuan, et al.
Pubblicazione: (2024)
di: Li, Haoxuan, et al.
Pubblicazione: (2024)
CMNEE: A Large-Scale Document-Level Event Extraction Dataset based on Open-Source Chinese Military News
di: Zhu, Mengna, et al.
Pubblicazione: (2024)
di: Zhu, Mengna, et al.
Pubblicazione: (2024)
MM-THEBench: Do Reasoning MLLMs Think Reasonably?
di: Huang, Zhidian, et al.
Pubblicazione: (2026)
di: Huang, Zhidian, et al.
Pubblicazione: (2026)
Rethinking Invariance in In-context Learning
di: Fang, Lizhe, et al.
Pubblicazione: (2025)
di: Fang, Lizhe, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ADELIE: Aligning Large Language Models on Information Extraction
di: Qi, Yunjia, et al.
Pubblicazione: (2024) -
Event-level Knowledge Editing
di: Peng, Hao, et al.
Pubblicazione: (2024) -
ChatLog: Carefully Evaluating the Evolution of ChatGPT Across Time
di: Tu, Shangqing, et al.
Pubblicazione: (2023) -
Evaluating Generative Language Models in Information Extraction as Subjective Question Correction
di: Fan, Yuchen, et al.
Pubblicazione: (2024) -
VidCoM: Fast Video Comprehension through Large Language Models with Multimodal Tools
di: Qi, Ji, et al.
Pubblicazione: (2023)