Guardado en:
| Autores principales: | Chen, Junjie, Su, Weihang, Chu, Zhumin, Li, Haitao, Zhou, Yujia, Yuan, Dingbo, Wang, Xudong, Zhou, Jun, Liu, Yiqun, Zhang, Min, Ma, Shaoping, Ai, Qingyao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2410.12265 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PRE: A Peer Review Based Large Language Model Evaluator
por: Chu, Zhumin, et al.
Publicado: (2024)
por: Chu, Zhumin, et al.
Publicado: (2024)
Overview of the NTCIR-18 Automatic Evaluation of LLMs (AEOLLM) Task
por: Chen, Junjie, et al.
Publicado: (2025)
por: Chen, Junjie, et al.
Publicado: (2025)
CalibraEval: Calibrating Prediction Distribution to Mitigate Selection Bias in LLMs-as-Judges
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
Augmenting Multi-Agent Communication with State Delta Trajectory
por: Tang, Yichen, et al.
Publicado: (2025)
por: Tang, Yichen, et al.
Publicado: (2025)
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
por: Tu, Yiteng, et al.
Publicado: (2025)
por: Tu, Yiteng, et al.
Publicado: (2025)
Decoupling Reasoning and Knowledge Injection for In-Context Knowledge Editing
por: Wang, Changyue, et al.
Publicado: (2025)
por: Wang, Changyue, et al.
Publicado: (2025)
Benchmarking LLM-as-a-Judge for Long-Form Output Evaluation
por: Chen, Junjie, et al.
Publicado: (2026)
por: Chen, Junjie, et al.
Publicado: (2026)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
Towards Better Understanding of User Satisfaction in Open-Domain Conversational Search
por: Chu, Zhumin, et al.
Publicado: (2022)
por: Chu, Zhumin, et al.
Publicado: (2022)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
por: Wang, Changyue, et al.
Publicado: (2025)
por: Wang, Changyue, et al.
Publicado: (2025)
LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
Beyond Experience Retrieval: Learning to Generate Utility-Optimized Structured Experience for Frozen LLMs
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
Evaluation Ethics of LLMs in Legal Domain
por: Zhang, Ruizhe, et al.
Publicado: (2024)
por: Zhang, Ruizhe, et al.
Publicado: (2024)
Generalized Pseudo-Relevance Feedback
por: Tu, Yiteng, et al.
Publicado: (2025)
por: Tu, Yiteng, et al.
Publicado: (2025)
Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
Improve Large Language Model Systems with User Logs
por: Wang, Changyue, et al.
Publicado: (2026)
por: Wang, Changyue, et al.
Publicado: (2026)
Multi-Field Tool Retrieval
por: Tang, Yichen, et al.
Publicado: (2026)
por: Tang, Yichen, et al.
Publicado: (2026)
Decoupling Knowledge and Task Subspaces for Composable Parametric Retrieval Augmented Generation
por: Su, Weihang, et al.
Publicado: (2026)
por: Su, Weihang, et al.
Publicado: (2026)
From <Answer> to <Think>: Multidimensional Supervision of Reasoning Process for LLM Optimization
por: Wang, Beining, et al.
Publicado: (2025)
por: Wang, Beining, et al.
Publicado: (2025)
Chinese Court Simulation with LLM-Based Agent System
por: Zhang, Kaiyuan, et al.
Publicado: (2025)
por: Zhang, Kaiyuan, et al.
Publicado: (2025)
LeKUBE: A Legal Knowledge Update BEnchmark
por: Wang, Changyue, et al.
Publicado: (2024)
por: Wang, Changyue, et al.
Publicado: (2024)
Equity vs. Equality: Optimizing Ranking Fairness for Tailored Provider Needs
por: Tu, Yiteng, et al.
Publicado: (2026)
por: Tu, Yiteng, et al.
Publicado: (2026)
Knowledge Editing through Chain-of-Thought
por: Wang, Changyue, et al.
Publicado: (2024)
por: Wang, Changyue, et al.
Publicado: (2024)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
por: Su, Weihang, et al.
Publicado: (2026)
por: Su, Weihang, et al.
Publicado: (2026)
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
Dynamic and Parametric Retrieval-Augmented Generation
por: Su, Weihang, et al.
Publicado: (2025)
por: Su, Weihang, et al.
Publicado: (2025)
Analytical Search
por: Tu, Yiteng, et al.
Publicado: (2026)
por: Tu, Yiteng, et al.
Publicado: (2026)
Caseformer: Pre-training for Legal Case Retrieval Based on Inter-Case Distinctions
por: Su, Weihang, et al.
Publicado: (2023)
por: Su, Weihang, et al.
Publicado: (2023)
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
por: Chen, Junjie, et al.
Publicado: (2025)
por: Chen, Junjie, et al.
Publicado: (2025)
Reinforcement Learning to Rank Using Coarse-grained Rewards
por: Tu, Yiteng, et al.
Publicado: (2022)
por: Tu, Yiteng, et al.
Publicado: (2022)
Parametric Retrieval Augmented Generation
por: Su, Weihang, et al.
Publicado: (2025)
por: Su, Weihang, et al.
Publicado: (2025)
SurGE: A Benchmark and Evaluation Framework for Scientific Survey Generation
por: Su, Weihang, et al.
Publicado: (2025)
por: Su, Weihang, et al.
Publicado: (2025)
Parametric Social Identity Injection and Diversification in Public Opinion Simulation
por: Wang, Hexi, et al.
Publicado: (2026)
por: Wang, Hexi, et al.
Publicado: (2026)
Beyond Exposure: Optimizing Ranking Fairness with Non-linear Time-Income Functions
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
Investigating Prosocial Behavior Theory in LLM Agents under Policy-Induced Inequities
por: Zhou, Yujia, et al.
Publicado: (2025)
por: Zhou, Yujia, et al.
Publicado: (2025)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
por: Zhan, Jingtao, et al.
Publicado: (2024)
por: Zhan, Jingtao, et al.
Publicado: (2024)
Simulating Dispute Mediation with LLM-Based Agents for Legal Research
por: Chen, Junjie, et al.
Publicado: (2025)
por: Chen, Junjie, et al.
Publicado: (2025)
MemoryBench: A Benchmark for Memory and Continual Learning in LLM Systems
por: Ai, Qingyao, et al.
Publicado: (2025)
por: Ai, Qingyao, et al.
Publicado: (2025)
Mitigating Entity-Level Hallucination in Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
Ejemplares similares
-
PRE: A Peer Review Based Large Language Model Evaluator
por: Chu, Zhumin, et al.
Publicado: (2024) -
Overview of the NTCIR-18 Automatic Evaluation of LLMs (AEOLLM) Task
por: Chen, Junjie, et al.
Publicado: (2025) -
CalibraEval: Calibrating Prediction Distribution to Mitigate Selection Bias in LLMs-as-Judges
por: Li, Haitao, et al.
Publicado: (2024) -
Augmenting Multi-Agent Communication with State Delta Trajectory
por: Tang, Yichen, et al.
Publicado: (2025) -
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
por: Tu, Yiteng, et al.
Publicado: (2025)