Enregistré dans:
| Auteurs principaux: | Tang, Wei, Cao, Yixin, Ying, Jiahao, Wang, Bo, Zhao, Yuyue, Liao, Yong, Zhou, Pengyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.03963 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EvoWiki: Evaluating LLMs on Evolving Knowledge
par: Tang, Wei, et autres
Publié: (2024)
par: Tang, Wei, et autres
Publié: (2024)
QRMeM: Unleash the Length Limitation through Question then Reflection Memory Mechanism
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
LLMs-as-Instructors: Learning from Errors Toward Automating Model Improvement
par: Ying, Jiahao, et autres
Publié: (2024)
par: Ying, Jiahao, et autres
Publié: (2024)
It's Morphing Time: Unleashing the Potential of Multiple LLMs via Multi-objective Optimization
par: Li, Bingdong, et autres
Publié: (2024)
par: Li, Bingdong, et autres
Publié: (2024)
Unleashing the Potential of Model Bias for Generalized Category Discovery
par: An, Wenbin, et autres
Publié: (2024)
par: An, Wenbin, et autres
Publié: (2024)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
Model Utility Law: Evaluating LLMs beyond Performance through Mechanism Interpretable Metric
par: Cao, Yixin, et autres
Publié: (2025)
par: Cao, Yixin, et autres
Publié: (2025)
Intuitive or Dependent? Investigating LLMs' Behavior Style to Conflicting Prompts
par: Ying, Jiahao, et autres
Publié: (2023)
par: Ying, Jiahao, et autres
Publié: (2023)
Unleashing the Potential of Large Language Models as Prompt Optimizers: Analogical Analysis with Gradient-based Model Optimizers
par: Tang, Xinyu, et autres
Publié: (2024)
par: Tang, Xinyu, et autres
Publié: (2024)
BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation
par: Du, Dayou, et autres
Publié: (2024)
par: Du, Dayou, et autres
Publié: (2024)
Boosting Chart-to-Code Generation in MLLM via Dual Preference-Guided Refinement
par: Zhang, Zhihan, et autres
Publié: (2025)
par: Zhang, Zhihan, et autres
Publié: (2025)
Draw with Thought: Unleashing Multimodal Reasoning for Scientific Diagram Generation
par: Cui, Zhiqing, et autres
Publié: (2025)
par: Cui, Zhiqing, et autres
Publié: (2025)
XFinBench: Benchmarking LLMs in Complex Financial Problem Solving and Reasoning
par: Zhang, Zhihan, et autres
Publié: (2025)
par: Zhang, Zhihan, et autres
Publié: (2025)
Unleash LLMs Potential for Recommendation by Coordinating Twin-Tower Dynamic Semantic Token Generator
par: Yin, Jun, et autres
Publié: (2024)
par: Yin, Jun, et autres
Publié: (2024)
Beyond Benchmarks: Understanding Mixture-of-Experts Models through Internal Mechanisms
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
EffiEval: Efficient and Generalizable Model Evaluation via Capability Coverage Maximization
par: Wang, Yaoning, et autres
Publié: (2025)
par: Wang, Yaoning, et autres
Publié: (2025)
Learning to Check: Unleashing Potentials for Self-Correction in Large Language Models
par: Zhang, Che, et autres
Publié: (2024)
par: Zhang, Che, et autres
Publié: (2024)
SynGR: Unleashing the Potential of Cross-Modal Synergy for Generative Recommendation
par: Chen, Wei, et autres
Publié: (2026)
par: Chen, Wei, et autres
Publié: (2026)
Evaluating Moral Beliefs across LLMs through a Pluralistic Framework
par: Liu, Xuelin, et autres
Publié: (2024)
par: Liu, Xuelin, et autres
Publié: (2024)
Automating Dataset Updates Towards Reliable and Timely Evaluation of Large Language Models
par: Ying, Jiahao, et autres
Publié: (2024)
par: Ying, Jiahao, et autres
Publié: (2024)
Diagnosing and Remedying Knowledge Deficiencies in LLMs via Label-free Curricular Meaningful Learning
par: Xiong, Kai, et autres
Publié: (2024)
par: Xiong, Kai, et autres
Publié: (2024)
Unleashing GPT on the Metaverse: Savior or Destroyer?
par: Zhou, Pengyuan
Publié: (2023)
par: Zhou, Pengyuan
Publié: (2023)
Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
par: Ding, Peng, et autres
Publié: (2025)
par: Ding, Peng, et autres
Publié: (2025)
LongWriter: Unleashing 10,000+ Word Generation from Long Context LLMs
par: Bai, Yushi, et autres
Publié: (2024)
par: Bai, Yushi, et autres
Publié: (2024)
Kardia-R1: Unleashing LLMs to Reason toward Understanding and Empathy for Emotional Support via Rubric-as-Judge Reinforcement Learning
par: Yuan, Jiahao, et autres
Publié: (2025)
par: Yuan, Jiahao, et autres
Publié: (2025)
Beyond Fine-tuning: Unleashing the Potential of Continuous Pretraining for Clinical LLMs
par: Christophe, Clément, et autres
Publié: (2024)
par: Christophe, Clément, et autres
Publié: (2024)
Reasoning Meets Personalization: Unleashing the Potential of Large Reasoning Model for Personalized Generation
par: Luo, Sichun, et autres
Publié: (2025)
par: Luo, Sichun, et autres
Publié: (2025)
Draw ALL Your Imagine: A Holistic Benchmark and Agent Framework for Complex Instruction-based Image Generation
par: Zhou, Yucheng, et autres
Publié: (2025)
par: Zhou, Yucheng, et autres
Publié: (2025)
Unleashing the Potentials of Likelihood Composition for Multi-modal Language Models
par: Zhao, Shitian, et autres
Publié: (2024)
par: Zhao, Shitian, et autres
Publié: (2024)
Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem
par: Wang, Yubo, et autres
Publié: (2025)
par: Wang, Yubo, et autres
Publié: (2025)
Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration
par: Wang, Zhenhailong, et autres
Publié: (2023)
par: Wang, Zhenhailong, et autres
Publié: (2023)
The Potential of LLMs in Medical Education: Generating Questions and Answers for Qualification Exams
par: Zhu, Yunqi, et autres
Publié: (2024)
par: Zhu, Yunqi, et autres
Publié: (2024)
SGR: A Stepwise Reasoning Framework for LLMs with External Subgraph Generation
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
$G^2$-Reader: Dual Evolving Graphs for Multimodal Document QA
par: Du, Yaxin, et autres
Publié: (2026)
par: Du, Yaxin, et autres
Publié: (2026)
JRE-L: Journalist, Reader, and Editor LLMs in the Loop for Science Journalism for the General Audience
par: Jiang, Gongyao, et autres
Publié: (2025)
par: Jiang, Gongyao, et autres
Publié: (2025)
Divide-and-Conquer Meets Consensus: Unleashing the Power of Functions in Code Generation
par: Chen, Jingchang, et autres
Publié: (2024)
par: Chen, Jingchang, et autres
Publié: (2024)
Symbiotic-MoE: Unlocking the Synergy between Generation and Understanding
par: Liu, Xiangyue, et autres
Publié: (2026)
par: Liu, Xiangyue, et autres
Publié: (2026)
m1: Unleash the Potential of Test-Time Scaling for Medical Reasoning with Large Language Models
par: Huang, Xiaoke, et autres
Publié: (2025)
par: Huang, Xiaoke, et autres
Publié: (2025)
An Adaptive Framework for Generating Systematic Explanatory Answer in Online Q&A Platforms
par: Chen, Ziyang, et autres
Publié: (2024)
par: Chen, Ziyang, et autres
Publié: (2024)
KnowledgeGain: Evaluating and Optimizing Science News Generation for Reader Learning
par: Soós, Dominik, et autres
Publié: (2026)
par: Soós, Dominik, et autres
Publié: (2026)
Documents similaires
-
EvoWiki: Evaluating LLMs on Evolving Knowledge
par: Tang, Wei, et autres
Publié: (2024) -
QRMeM: Unleash the Length Limitation through Question then Reflection Memory Mechanism
par: Wang, Bo, et autres
Publié: (2024) -
LLMs-as-Instructors: Learning from Errors Toward Automating Model Improvement
par: Ying, Jiahao, et autres
Publié: (2024) -
It's Morphing Time: Unleashing the Potential of Multiple LLMs via Multi-objective Optimization
par: Li, Bingdong, et autres
Publié: (2024) -
Unleashing the Potential of Model Bias for Generalized Category Discovery
par: An, Wenbin, et autres
Publié: (2024)