Salvato in:
| Autori principali: | Liu, Yinqi, Zhu, Yueqi, Zhang, Yongkang, Liu, Feiran, Shen, Yutong, Sun, Yufei, Wang, Xin, Liang, Renzhao, Wang, Yidong, Wang, Cunxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.09504 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
DVD: A Robust Method for Detecting Variant Contamination in Large Language Model Evaluation
di: Liang, Renzhao, et al.
Pubblicazione: (2026)
di: Liang, Renzhao, et al.
Pubblicazione: (2026)
Deep Literature Survey Automation with an Iterative Workflow
di: Zhang, Hongbo, et al.
Pubblicazione: (2025)
di: Zhang, Hongbo, et al.
Pubblicazione: (2025)
A Unified Data Augmentation Framework for Low-Resource Multi-Domain Dialogue Generation
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces
di: Yang, Shu-Xun, et al.
Pubblicazione: (2026)
di: Yang, Shu-Xun, et al.
Pubblicazione: (2026)
SHIELD: Evaluation and Defense Strategies for Copyright Compliance in LLM Text Generation
di: Liu, Xiaoze, et al.
Pubblicazione: (2024)
di: Liu, Xiaoze, et al.
Pubblicazione: (2024)
A Survey on Evaluation of Large Language Models
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
di: Chang, Yupeng, et al.
Pubblicazione: (2023)
HPSS: Heuristic Prompting Strategy Search for LLM Evaluators
di: Wen, Bosi, et al.
Pubblicazione: (2025)
di: Wen, Bosi, et al.
Pubblicazione: (2025)
Data Management For Training Large Language Models: A Survey
di: Wang, Zige, et al.
Pubblicazione: (2023)
di: Wang, Zige, et al.
Pubblicazione: (2023)
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future
di: Wang, Yidong, et al.
Pubblicazione: (2025)
di: Wang, Yidong, et al.
Pubblicazione: (2025)
Knowledge Conflicts for LLMs: A Survey
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
di: Xu, Rongwu, et al.
Pubblicazione: (2024)
Towards a Unified View of Preference Learning for Large Language Models: A Survey
di: Gao, Bofei, et al.
Pubblicazione: (2024)
di: Gao, Bofei, et al.
Pubblicazione: (2024)
UniCBE: An Uniformity-driven Comparing Based Evaluation Framework with Unified Multi-Objective Optimization
di: Yuan, Peiwen, et al.
Pubblicazione: (2025)
di: Yuan, Peiwen, et al.
Pubblicazione: (2025)
Nash CoT: Multi-Path Inference with Preference Equilibrium
di: Zhang, Ziqi, et al.
Pubblicazione: (2024)
di: Zhang, Ziqi, et al.
Pubblicazione: (2024)
Unlocking Recursive Thinking of LLMs: Alignment via Refinement
di: Zhang, Haoke, et al.
Pubblicazione: (2025)
di: Zhang, Haoke, et al.
Pubblicazione: (2025)
LeMix: Unified Scheduling for LLM Training and Inference on Multi-GPU Systems
di: Li, Yufei, et al.
Pubblicazione: (2025)
di: Li, Yufei, et al.
Pubblicazione: (2025)
ReflectRM: Boosting Generative Reward Models via Self-Reflection within a Unified Judgment Framework
di: Qin, Kai, et al.
Pubblicazione: (2026)
di: Qin, Kai, et al.
Pubblicazione: (2026)
TMD-TTS: A Unified Tibetan Multi-Dialect Text-to-Speech Framework for Ü-Tsang, Amdo and Kham Speech Dataset Generation
di: Liu, Yutong, et al.
Pubblicazione: (2025)
di: Liu, Yutong, et al.
Pubblicazione: (2025)
Reasoning on Multiple Needles In A Haystack
di: Wang, Yidong
Pubblicazione: (2025)
di: Wang, Yidong
Pubblicazione: (2025)
UniMS-RAG: A Unified Multi-source Retrieval-Augmented Generation for Personalized Dialogue Systems
di: Wang, Hongru, et al.
Pubblicazione: (2024)
di: Wang, Hongru, et al.
Pubblicazione: (2024)
MoLAN: A Unified Modality-Aware Noise Dynamic Editing Framework for Multimodal Sentiment Analysis
di: Xu, Xingle, et al.
Pubblicazione: (2025)
di: Xu, Xingle, et al.
Pubblicazione: (2025)
RAVEL: Reasoning Agents for Validating and Evaluating LLM Text Synthesis
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026)
AgentDropout: Dynamic Agent Elimination for Token-Efficient and High-Performance LLM-Based Multi-Agent Collaboration
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
IndustryCode: A Benchmark for Industry Code Generation
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
Minstrel: Structural Prompt Generation with Multi-Agents Coordination for Non-AI Experts
di: Wang, Ming, et al.
Pubblicazione: (2024)
di: Wang, Ming, et al.
Pubblicazione: (2024)
RAGLAB: A Modular and Research-Oriented Unified Framework for Retrieval-Augmented Generation
di: Zhang, Xuanwang, et al.
Pubblicazione: (2024)
di: Zhang, Xuanwang, et al.
Pubblicazione: (2024)
Loki's Dance of Illusions: A Comprehensive Survey of Hallucination in Large Language Models
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
Long$^2$RAG: Evaluating Long-Context & Long-Form Retrieval-Augmented Generation with Key Point Recall
di: Qi, Zehan, et al.
Pubblicazione: (2024)
di: Qi, Zehan, et al.
Pubblicazione: (2024)
F\textsuperscript{2}LP-AP: Fast \& Flexible Label Propagation with Adaptive Propagation Kernel
di: Shen, Yutong, et al.
Pubblicazione: (2026)
di: Shen, Yutong, et al.
Pubblicazione: (2026)
DreamReward: Text-to-3D Generation with Human Preference
di: Ye, Junliang, et al.
Pubblicazione: (2024)
di: Ye, Junliang, et al.
Pubblicazione: (2024)
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response
di: Liu, Yongkang, et al.
Pubblicazione: (2023)
di: Liu, Yongkang, et al.
Pubblicazione: (2023)
Why Attention Patterns Exist: A Unifying Temporal Perspective Analysis
di: Yang, Qingyue, et al.
Pubblicazione: (2026)
di: Yang, Qingyue, et al.
Pubblicazione: (2026)
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
Bridging Text and Molecule: A Survey on Multimodal Frameworks for Molecule
di: Xiao, Yi, et al.
Pubblicazione: (2024)
di: Xiao, Yi, et al.
Pubblicazione: (2024)
RAGChecker: A Fine-grained Framework for Diagnosing Retrieval-Augmented Generation
di: Ru, Dongyu, et al.
Pubblicazione: (2024)
di: Ru, Dongyu, et al.
Pubblicazione: (2024)
TrustUQA: A Trustful Framework for Unified Structured Data Question Answering
di: Zhang, Wen, et al.
Pubblicazione: (2024)
di: Zhang, Wen, et al.
Pubblicazione: (2024)
Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
di: Yu, Zhuohao, et al.
Pubblicazione: (2024)
TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them
di: Wang, Yidong, et al.
Pubblicazione: (2025)
di: Wang, Yidong, et al.
Pubblicazione: (2025)
Towards a Unified View of Large Language Model Post-Training
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
RLAR: An Agentic Reward System for Multi-task Reinforcement Learning on Large Language Models
di: Feng, Andrew Zhuoer, et al.
Pubblicazione: (2026) -
DVD: A Robust Method for Detecting Variant Contamination in Large Language Model Evaluation
di: Liang, Renzhao, et al.
Pubblicazione: (2026) -
Deep Literature Survey Automation with an Iterative Workflow
di: Zhang, Hongbo, et al.
Pubblicazione: (2025) -
A Unified Data Augmentation Framework for Low-Resource Multi-Domain Dialogue Generation
di: Liu, Yongkang, et al.
Pubblicazione: (2024) -
TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces
di: Yang, Shu-Xun, et al.
Pubblicazione: (2026)