AbsInstruct: Eliciting Abstraction Ability from LLMs through Explanation Tuning with Plausibility Estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zhaowei, Fan, Wei, Zong, Qing, Zhang, Hongming, Choi, Sehyun, Fang, Tianqing, Liu, Xin, Song, Yangqiu, Wong, Ginny Y., See, Simon |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AbsPyramid: Benchmarking the Abstraction Ability of Language Models with a Unified Entailment Graph
par: Wang, Zhaowei, et autres
Publié: (2023)
par: Wang, Zhaowei, et autres
Publié: (2023)
Concept-Reversed Winograd Schema Challenge: Evaluating and Improving Robust Reasoning in Large Language Models via Abstraction
par: Han, Kaiqiao, et autres
Publié: (2024)
par: Han, Kaiqiao, et autres
Publié: (2024)
CKBP v2: Better Annotation and Reasoning for Commonsense Knowledge Base Population
par: Fang, Tianqing, et autres
Publié: (2023)
par: Fang, Tianqing, et autres
Publié: (2023)
Getting Sick After Seeing a Doctor? Diagnosing and Mitigating Knowledge Conflicts in Event Temporal Reasoning
par: Fang, Tianqing, et autres
Publié: (2023)
par: Fang, Tianqing, et autres
Publié: (2023)
ComparisonQA: Evaluating Factuality Robustness of LLMs Through Knowledge Frequency Control and Uncertainty
par: Zong, Qing, et autres
Publié: (2024)
par: Zong, Qing, et autres
Publié: (2024)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
par: Zheng, Tianshi, et autres
Publié: (2025)
par: Zheng, Tianshi, et autres
Publié: (2025)
Persona Knowledge-Aligned Prompt Tuning Method for Online Debate
par: Chan, Chunkit, et autres
Publié: (2024)
par: Chan, Chunkit, et autres
Publié: (2024)
KNOWCOMP POKEMON Team at DialAM-2024: A Two-Stage Pipeline for Detecting Relations in Dialogical Argument Mining
par: Zheng, Zihao, et autres
Publié: (2024)
par: Zheng, Zihao, et autres
Publié: (2024)
$\mathbb{R}^{2k}$ is Theoretically Large Enough for Embedding-based Top-$k$ Retrieval
par: Wang, Zihao, et autres
Publié: (2026)
par: Wang, Zihao, et autres
Publié: (2026)
ConstraintChecker: A Plugin for Large Language Models to Reason on Commonsense Knowledge Bases
par: Do, Quyet V., et autres
Publié: (2024)
par: Do, Quyet V., et autres
Publié: (2024)
NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents
par: Zheng, Tianshi, et autres
Publié: (2025)
par: Zheng, Tianshi, et autres
Publié: (2025)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
par: Wang, Zhaowei, et autres
Publié: (2024)
par: Wang, Zhaowei, et autres
Publié: (2024)
LogiDynamics: Unraveling the Dynamics of Inductive, Abductive and Deductive Logical Inferences in LLM Reasoning
par: Zheng, Tianshi, et autres
Publié: (2025)
par: Zheng, Tianshi, et autres
Publié: (2025)
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
par: Wang, Zhaowei, et autres
Publié: (2025)
par: Wang, Zhaowei, et autres
Publié: (2025)
On-the-fly Denoising for Data Augmentation in Natural Language Understanding
par: Fang, Tianqing, et autres
Publié: (2022)
par: Fang, Tianqing, et autres
Publié: (2022)
Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models
par: Li, Aaron Branson Cigres, et autres
Publié: (2026)
par: Li, Aaron Branson Cigres, et autres
Publié: (2026)
Revisiting Epistemic Markers in Confidence Estimation: Can Markers Accurately Reflect Large Language Models' Uncertainty?
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
Cross-Architecture Transfer Learning for Linear-Cost Inference Transformers
par: Choi, Sehyun
Publié: (2024)
par: Choi, Sehyun
Publié: (2024)
The Cognitive Bandwidth Bottleneck: Shifting Long-Horizon Agent from Planning with Actions to Planning with Schemas
par: Xu, Baixuan, et autres
Publié: (2025)
par: Xu, Baixuan, et autres
Publié: (2025)
MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models
par: Ren, Xiyu, et autres
Publié: (2026)
par: Ren, Xiyu, et autres
Publié: (2026)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
par: Fang, Tianqing, et autres
Publié: (2024)
par: Fang, Tianqing, et autres
Publié: (2024)
Acquiring and Modelling Abstract Commonsense Knowledge via Conceptualization
par: He, Mutian, et autres
Publié: (2022)
par: He, Mutian, et autres
Publié: (2022)
ConKE: Conceptualization-Augmented Knowledge Editing in Large Language Models for Commonsense Reasoning
par: Zhang, Liyu, et autres
Publié: (2024)
par: Zhang, Liyu, et autres
Publié: (2024)
mAbs
Publié: (2021)
Publié: (2021)
CodeGraph: Enhancing Graph Reasoning of LLMs with Code
par: Cai, Qiaolong, et autres
Publié: (2024)
par: Cai, Qiaolong, et autres
Publié: (2024)
Plausible Counterfactual Explanations of Recommendations
par: Černý, Jakub, et autres
Publié: (2025)
par: Černý, Jakub, et autres
Publié: (2025)
OrderChain: Towards General Instruct-Tuning for Stimulating the Ordinal Understanding Ability of MLLM
par: Wang, Jinhong, et autres
Publié: (2025)
par: Wang, Jinhong, et autres
Publié: (2025)
Instruct or Interact? Exploring and Eliciting LLMs' Capability in Code Snippet Adaptation Through Prompt Engineering
par: Zhang, Tanghaoran, et autres
Publié: (2024)
par: Zhang, Tanghaoran, et autres
Publié: (2024)
Code Prompting Elicits Conditional Reasoning Abilities in Text+Code LLMs
par: Puerto, Haritz, et autres
Publié: (2024)
par: Puerto, Haritz, et autres
Publié: (2024)
Logic-Scaffolding: Personalized Aspect-Instructed Recommendation Explanation Generation using LLMs
par: Rahdari, Behnam, et autres
Publié: (2023)
par: Rahdari, Behnam, et autres
Publié: (2023)
WebDevJudge: Evaluating (M)LLMs as Critiques for Web Development Quality
par: Li, Chunyang, et autres
Publié: (2025)
par: Li, Chunyang, et autres
Publié: (2025)
End-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations
par: Luo, Lirui, et autres
Publié: (2024)
par: Luo, Lirui, et autres
Publié: (2024)
MARS: Benchmarking the Metaphysical Reasoning Abilities of Language Models with a Multi-task Evaluation Dataset
par: Wang, Weiqi, et autres
Publié: (2024)
par: Wang, Weiqi, et autres
Publié: (2024)
Probabilistically Plausible Counterfactual Explanations with Normalizing Flows
par: Wielopolski, Patryk, et autres
Publié: (2024)
par: Wielopolski, Patryk, et autres
Publié: (2024)
Abs Algorithms for Linear Equations and Abspack
par: Spedicato, E., et autres
Publié: (2001)
par: Spedicato, E., et autres
Publié: (2001)
Parameter-Efficient Checkpoint Merging via Metrics-Weighted Averaging
par: Yu, Shi Jie, et autres
Publié: (2025)
par: Yu, Shi Jie, et autres
Publié: (2025)
SteerConf: Steering LLMs for Confidence Elicitation
par: Zhou, Ziang, et autres
Publié: (2025)
par: Zhou, Ziang, et autres
Publié: (2025)
Decomposing the Basic Abilities of Large Language Models: Mitigating Cross-Task Interference in Multi-Task Instruct-Tuning
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Guiding Sparse Neural Networks with Neurobiological Principles to Elicit Biologically Plausible Representations
par: Inoue, Patrick, et autres
Publié: (2026)
par: Inoue, Patrick, et autres
Publié: (2026)
Counterfactual Training: Teaching Models Plausible and Actionable Explanations
par: Altmeyer, Patrick, et autres
Publié: (2026)
par: Altmeyer, Patrick, et autres
Publié: (2026)
Documents similaires
-
AbsPyramid: Benchmarking the Abstraction Ability of Language Models with a Unified Entailment Graph
par: Wang, Zhaowei, et autres
Publié: (2023) -
Concept-Reversed Winograd Schema Challenge: Evaluating and Improving Robust Reasoning in Large Language Models via Abstraction
par: Han, Kaiqiao, et autres
Publié: (2024) -
CKBP v2: Better Annotation and Reasoning for Commonsense Knowledge Base Population
par: Fang, Tianqing, et autres
Publié: (2023) -
Getting Sick After Seeing a Doctor? Diagnosing and Mitigating Knowledge Conflicts in Event Temporal Reasoning
par: Fang, Tianqing, et autres
Publié: (2023) -
ComparisonQA: Evaluating Factuality Robustness of LLMs Through Knowledge Frequency Control and Uncertainty
par: Zong, Qing, et autres
Publié: (2024)