Enregistré dans:
| Auteurs principaux: | Dai, Xinbang, Hu, Huikang, Chen, Yongrui, Li, Jiaqi, Jin, Rihui, Zhang, Yuyang, Li, Xiaoguang, Shang, Lifeng, Qi, Guilin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.10549 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Question Answering Over Spatio-Temporal Knowledge Graph
par: Dai, Xinbang, et autres
Publié: (2024)
par: Dai, Xinbang, et autres
Publié: (2024)
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
par: Dai, Xinbang, et autres
Publié: (2025)
par: Dai, Xinbang, et autres
Publié: (2025)
Pandora: A Code-Driven Large Language Model Agent for Unified Reasoning Across Diverse Structured Knowledge
par: Chen, Yongrui, et autres
Publié: (2025)
par: Chen, Yongrui, et autres
Publié: (2025)
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
par: Jin, Rihui, et autres
Publié: (2025)
par: Jin, Rihui, et autres
Publié: (2025)
HeGTa: Leveraging Heterogeneous Graph-enhanced Large Language Models for Few-shot Complex Table Understanding
par: Jin, Rihui, et autres
Publié: (2024)
par: Jin, Rihui, et autres
Publié: (2024)
Magic Mushroom: A Customizable Benchmark for Fine-grained Analysis of Retrieval Noise Erosion in RAG Systems
par: Zhang, Yuxin, et autres
Publié: (2025)
par: Zhang, Yuxin, et autres
Publié: (2025)
Pandora: Leveraging Code-driven Knowledge Transfer for Unified Structured Knowledge Reasoning
par: Chen, Yongrui, et autres
Publié: (2025)
par: Chen, Yongrui, et autres
Publié: (2025)
Large Language Models Can Better Understand Knowledge Graphs Than We Thought
par: Dai, Xinbang, et autres
Publié: (2024)
par: Dai, Xinbang, et autres
Publié: (2024)
MIKE: A New Benchmark for Fine-grained Multimodal Entity Knowledge Editing
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
Can Large Language Models Understand DL-Lite Ontologies? An Empirical Study
par: Wang, Keyu, et autres
Publié: (2024)
par: Wang, Keyu, et autres
Publié: (2024)
Single Image Unlearning: Efficient Machine Unlearning in Multimodal Large Language Models
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
par: Zuo, Yuxin, et autres
Publié: (2025)
par: Zuo, Yuxin, et autres
Publié: (2025)
DocPuzzle: A Process-Aware Benchmark for Evaluating Realistic Long-Context Reasoning Capabilities
par: Zhuang, Tianyi, et autres
Publié: (2025)
par: Zhuang, Tianyi, et autres
Publié: (2025)
Exploring the Impact of Table-to-Text Methods on Augmenting LLM-based Question Answering with Domain Hybrid Data
par: Min, Dehai, et autres
Publié: (2024)
par: Min, Dehai, et autres
Publié: (2024)
MATEval: A Multi-Agent Discussion Framework for Advancing Open-Ended Text Evaluation
par: Li, Yu, et autres
Publié: (2024)
par: Li, Yu, et autres
Publié: (2024)
Retrieval-based Disentangled Representation Learning with Natural Language Supervision
par: Zhou, Jiawei, et autres
Publié: (2022)
par: Zhou, Jiawei, et autres
Publié: (2022)
Harnessing Diverse Perspectives: A Multi-Agent Framework for Enhanced Error Detection in Knowledge Graphs
par: Li, Yu, et autres
Publié: (2025)
par: Li, Yu, et autres
Publié: (2025)
Same Signal, Opposite Meaning: Direction-Informed Adaptive Learning for LLM Agents
par: Li, Ziming, et autres
Publié: (2026)
par: Li, Ziming, et autres
Publié: (2026)
UIS-Digger: Towards Comprehensive Research Agent Systems for Real-world Unindexed Information Seeking
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
Deep-Sea A*+: An Advanced Path Planning Method Integrating Enhanced A* and Dynamic Window Approach for Autonomous Underwater Vehicles
par: Lai, Yinyi, et autres
Publié: (2024)
par: Lai, Yinyi, et autres
Publié: (2024)
Mastering Olympiad-Level Physics with Artificial Intelligence
par: Jian, Dong-Shan, et autres
Publié: (2025)
par: Jian, Dong-Shan, et autres
Publié: (2025)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
par: Zhang, Hao, et autres
Publié: (2024)
par: Zhang, Hao, et autres
Publié: (2024)
VoiceAgentEval: A Dual-Dimensional Benchmark for Expert-Level Intelligent Voice-Agent Evaluation of Xbench's Professional-Aligned Series
par: Xu, Pengyu, et autres
Publié: (2025)
par: Xu, Pengyu, et autres
Publié: (2025)
Understanding and Benchmarking Artificial Intelligence: OpenAI's o3 Is Not AGI
par: Pfister, Rolf, et autres
Publié: (2025)
par: Pfister, Rolf, et autres
Publié: (2025)
MMVU: Measuring Expert-Level Multi-Discipline Video Understanding
par: Zhao, Yilun, et autres
Publié: (2025)
par: Zhao, Yilun, et autres
Publié: (2025)
Does the Generator Mind its Contexts? An Analysis of Generative Model Faithfulness under Context Transfer
par: Hu, Xinshuo, et autres
Publié: (2024)
par: Hu, Xinshuo, et autres
Publié: (2024)
Gradually Excavating External Knowledge for Implicit Complex Question Answering
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
DiscoX: Benchmarking Discourse-Level Translation task in Expert Domains
par: Zhao, Xiying, et autres
Publié: (2025)
par: Zhao, Xiying, et autres
Publié: (2025)
StressEval: Failure-Driven Dynamic Benchmarking for Knowledge-Intensive Reasoning in Large Language Models
par: Chen, Yongrui, et autres
Publié: (2026)
par: Chen, Yongrui, et autres
Publié: (2026)
Towards Objectively Benchmarking Social Intelligence for Language Agents at Action Level
par: Wang, Chenxu, et autres
Publié: (2024)
par: Wang, Chenxu, et autres
Publié: (2024)
Embodied Intelligence: The Key to Unblocking Generalized Artificial Intelligence
par: Jiang, Jinhao, et autres
Publié: (2025)
par: Jiang, Jinhao, et autres
Publié: (2025)
Artificial Expert Intelligence through PAC-reasoning
par: Shalev-Shwartz, Shai, et autres
Publié: (2024)
par: Shalev-Shwartz, Shai, et autres
Publié: (2024)
Understanding Biology in the Age of Artificial Intelligence
par: Lawrence, Elsa, et autres
Publié: (2024)
par: Lawrence, Elsa, et autres
Publié: (2024)
DoG-Instruct: Towards Premium Instruction-Tuning Data via Text-Grounded Instruction Wrapping
par: Chen, Yongrui, et autres
Publié: (2023)
par: Chen, Yongrui, et autres
Publié: (2023)
Dialectics for Artificial Intelligence
par: Hu, Zhengmian
Publié: (2025)
par: Hu, Zhengmian
Publié: (2025)
Can LLMs Solve ASP Problems? Insights from a Benchmarking Study (Extended Version)
par: Ren, Lin, et autres
Publié: (2025)
par: Ren, Lin, et autres
Publié: (2025)
An Embedding-based Approach to Inconsistency-tolerant Reasoning with Inconsistent Ontologies
par: Wang, Keyu, et autres
Publié: (2023)
par: Wang, Keyu, et autres
Publié: (2023)
A Comprehensive Survey on Root Cause Analysis in (Micro) Services: Methodologies, Challenges, and Trends
par: Wang, Tingting, et autres
Publié: (2024)
par: Wang, Tingting, et autres
Publié: (2024)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
par: Zhao, Kaiyan, et autres
Publié: (2024)
par: Zhao, Kaiyan, et autres
Publié: (2024)
Rescaling Confidence: What Scale Design Reveals About LLM Metacognition
par: Dai, Yuyang
Publié: (2026)
par: Dai, Yuyang
Publié: (2026)
Documents similaires
-
Question Answering Over Spatio-Temporal Knowledge Graph
par: Dai, Xinbang, et autres
Publié: (2024) -
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
par: Dai, Xinbang, et autres
Publié: (2025) -
Pandora: A Code-Driven Large Language Model Agent for Unified Reasoning Across Diverse Structured Knowledge
par: Chen, Yongrui, et autres
Publié: (2025) -
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
par: Jin, Rihui, et autres
Publié: (2025) -
HeGTa: Leveraging Heterogeneous Graph-enhanced Large Language Models for Few-shot Complex Table Understanding
par: Jin, Rihui, et autres
Publié: (2024)