Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Zhuoqun, Lin, Hongyu, Lu, Yaojie, Xiang, Hao, Han, Xianpei, Sun, Le |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
par: Zheng, Xin, et autres
Publié: (2024)
par: Zheng, Xin, et autres
Publié: (2024)
URL: Universal Referential Knowledge Linking via Task-instructed Representation Compression
par: Li, Zhuoqun, et autres
Publié: (2024)
par: Li, Zhuoqun, et autres
Publié: (2024)
StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
par: Li, Zhuoqun, et autres
Publié: (2024)
par: Li, Zhuoqun, et autres
Publié: (2024)
DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking
par: Li, Zhuoqun, et autres
Publié: (2025)
par: Li, Zhuoqun, et autres
Publié: (2025)
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
par: Zheng, Jiasheng, et autres
Publié: (2024)
par: Zheng, Jiasheng, et autres
Publié: (2024)
DeepRAG: Thinking to Retrieve Step by Step for Large Language Models
par: Guan, Xinyan, et autres
Publié: (2025)
par: Guan, Xinyan, et autres
Publié: (2025)
Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
par: Tang, Qiaoyu, et autres
Publié: (2024)
par: Tang, Qiaoyu, et autres
Publié: (2024)
Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models
par: Liu, Yanjiang, et autres
Publié: (2025)
par: Liu, Yanjiang, et autres
Publié: (2025)
When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
par: Mao, Yingzhi, et autres
Publié: (2025)
par: Mao, Yingzhi, et autres
Publié: (2025)
Coupled Variational Reinforcement Learning for Language Model General Reasoning
par: Wen, Xueru, et autres
Publié: (2025)
par: Wen, Xueru, et autres
Publié: (2025)
PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
par: Xu, Ruoxi, et autres
Publié: (2025)
par: Xu, Ruoxi, et autres
Publié: (2025)
StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?
par: Wen, Xueru, et autres
Publié: (2024)
par: Wen, Xueru, et autres
Publié: (2024)
Beyond Text-Dominance: Understanding Modality Preference of Omni-modal Large Language Models
par: Yan, Xinru, et autres
Publié: (2026)
par: Yan, Xinru, et autres
Publié: (2026)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
par: Cao, Boxi, et autres
Publié: (2023)
par: Cao, Boxi, et autres
Publié: (2023)
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
par: Yuan, Qianhao, et autres
Publié: (2025)
par: Yuan, Qianhao, et autres
Publié: (2025)
Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
par: Wen, Xueru, et autres
Publié: (2025)
par: Wen, Xueru, et autres
Publié: (2025)
Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation
par: Yuan, Qianhao, et autres
Publié: (2026)
par: Yuan, Qianhao, et autres
Publié: (2026)
LiveMCPBench: Can Agents Navigate an Ocean of MCP Tools?
par: Mo, Guozhao, et autres
Publié: (2025)
par: Mo, Guozhao, et autres
Publié: (2025)
Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Distillation
par: Liu, Yanjiang, et autres
Publié: (2026)
par: Liu, Yanjiang, et autres
Publié: (2026)
Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
par: Ma, Zhengzhao, et autres
Publié: (2026)
par: Ma, Zhengzhao, et autres
Publié: (2026)
Declarative Knowledge Distillation from Large Language Models for Visual Question Answering Datasets
par: Eiter, Thomas, et autres
Publié: (2024)
par: Eiter, Thomas, et autres
Publié: (2024)
Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
par: Bian, Ning, et autres
Publié: (2024)
par: Bian, Ning, et autres
Publié: (2024)
The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward Models
par: Li, Zichao, et autres
Publié: (2025)
par: Li, Zichao, et autres
Publié: (2025)
Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces
par: Chen, Jiawei, et autres
Publié: (2026)
par: Chen, Jiawei, et autres
Publié: (2026)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
par: Zhang, Yize, et autres
Publié: (2025)
par: Zhang, Yize, et autres
Publié: (2025)
Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering
par: Guan, Xinyan, et autres
Publié: (2024)
par: Guan, Xinyan, et autres
Publié: (2024)
Towards Scalable Automated Alignment of LLMs: A Survey
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
ChatGPT is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language Models
par: Bian, Ning, et autres
Publié: (2023)
par: Bian, Ning, et autres
Publié: (2023)
Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models
par: Chen, Hao, et autres
Publié: (2026)
par: Chen, Hao, et autres
Publié: (2026)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024)
par: Xiang, Hao, et autres
Publié: (2024)
The Life Cycle of Knowledge in Big Language Models: A Survey
par: Cao, Boxi, et autres
Publié: (2023)
par: Cao, Boxi, et autres
Publié: (2023)
SAISA: Towards Multimodal Large Language Models with Both Training and Inference Efficiency
par: Yuan, Qianhao, et autres
Publié: (2025)
par: Yuan, Qianhao, et autres
Publié: (2025)
PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
par: Li, Zhuoqun, et autres
Publié: (2025)
par: Li, Zhuoqun, et autres
Publié: (2025)
Expanding the Boundaries of Vision Prior Knowledge in Multi-modal Large Language Models
par: Liang, Qiao, et autres
Publié: (2025)
par: Liang, Qiao, et autres
Publié: (2025)
DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
par: Zhu, Qiming, et autres
Publié: (2024)
par: Zhu, Qiming, et autres
Publié: (2024)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
par: Li, Wenjun, et autres
Publié: (2025)
par: Li, Wenjun, et autres
Publié: (2025)
Evaluating Latent Knowledge of Public Tabular Datasets in Large Language Models
par: Silvestri, Matteo, et autres
Publié: (2025)
par: Silvestri, Matteo, et autres
Publié: (2025)
From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
par: Cao, Jialun, et autres
Publié: (2025)
par: Cao, Jialun, et autres
Publié: (2025)
Documents similaires
-
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
par: Zheng, Xin, et autres
Publié: (2024) -
URL: Universal Referential Knowledge Linking via Task-instructed Representation Compression
par: Li, Zhuoqun, et autres
Publié: (2024) -
StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
par: Li, Zhuoqun, et autres
Publié: (2024) -
DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking
par: Li, Zhuoqun, et autres
Publié: (2025) -
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
par: Zheng, Jiasheng, et autres
Publié: (2024)