Towards A Unified View of Answer Calibration for Multi-Step Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Shumin, Zhang, Ningyu, Oo, Nay, Hooi, Bryan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automating Steering for Safe Multimodal Large Language Models
di: Wu, Lyucheng, et al.
Pubblicazione: (2025)
di: Wu, Lyucheng, et al.
Pubblicazione: (2025)
Information Extraction in Low-Resource Scenarios: Survey and Perspective
di: Deng, Shumin, et al.
Pubblicazione: (2022)
di: Deng, Shumin, et al.
Pubblicazione: (2022)
ChineseHarm-Bench: A Chinese Harmful Content Detection Benchmark
di: Liu, Kangwei, et al.
Pubblicazione: (2025)
di: Liu, Kangwei, et al.
Pubblicazione: (2025)
Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
di: Xu, Ziwen, et al.
Pubblicazione: (2026)
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
From Data to Behavior: Predicting Unintended Model Behaviors Before Training
di: Wang, Mengru, et al.
Pubblicazione: (2026)
di: Wang, Mengru, et al.
Pubblicazione: (2026)
LightThinker: Thinking Step-by-Step Compression
di: Zhang, Jintian, et al.
Pubblicazione: (2025)
di: Zhang, Jintian, et al.
Pubblicazione: (2025)
Editing Conceptual Knowledge for Large Language Models
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
Beyond Prompt Engineering: Robust Behavior Control in LLMs via Steering Target Atoms
di: Wang, Mengru, et al.
Pubblicazione: (2025)
di: Wang, Mengru, et al.
Pubblicazione: (2025)
Knowledge Circuits in Pretrained Transformers
di: Yao, Yunzhi, et al.
Pubblicazione: (2024)
di: Yao, Yunzhi, et al.
Pubblicazione: (2024)
QAGCN: Answering Multi-Relation Questions via Single-Step Implicit Reasoning over Knowledge Graphs
di: Wang, Ruijie, et al.
Pubblicazione: (2022)
di: Wang, Ruijie, et al.
Pubblicazione: (2022)
CaKE: Circuit-aware Editing Enables Generalizable Knowledge Learners
di: Yao, Yunzhi, et al.
Pubblicazione: (2025)
di: Yao, Yunzhi, et al.
Pubblicazione: (2025)
OneGen: Efficient One-Pass Unified Generation and Retrieval for LLMs
di: Zhang, Jintian, et al.
Pubblicazione: (2024)
di: Zhang, Jintian, et al.
Pubblicazione: (2024)
Verif.ai: Towards an Open-Source Scientific Generative Question-Answering System with Referenced and Verifiable Answers
di: Košprdić, Miloš, et al.
Pubblicazione: (2024)
di: Košprdić, Miloš, et al.
Pubblicazione: (2024)
OneEdit: A Neural-Symbolic Collaboratively Knowledge Editing System
di: Zhang, Ningyu, et al.
Pubblicazione: (2024)
di: Zhang, Ningyu, et al.
Pubblicazione: (2024)
Unified Hallucination Detection for Multimodal Large Language Models
di: Chen, Xiang, et al.
Pubblicazione: (2024)
di: Chen, Xiang, et al.
Pubblicazione: (2024)
LightThinker++: From Reasoning Compression to Memory Management
di: Zhu, Yuqi, et al.
Pubblicazione: (2026)
di: Zhu, Yuqi, et al.
Pubblicazione: (2026)
RankRAG: Unifying Context Ranking with Retrieval-Augmented Generation in LLMs
di: Yu, Yue, et al.
Pubblicazione: (2024)
di: Yu, Yue, et al.
Pubblicazione: (2024)
Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View
di: Zhang, Jintian, et al.
Pubblicazione: (2023)
di: Zhang, Jintian, et al.
Pubblicazione: (2023)
CKnowEdit: A New Chinese Knowledge Editing Dataset for Linguistics, Facts, and Logic Error Correction in LLMs
di: Fang, Jizhan, et al.
Pubblicazione: (2024)
di: Fang, Jizhan, et al.
Pubblicazione: (2024)
Multilingual Non-Factoid Question Answering with Answer Paragraph Selection
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
ReasonIR: Training Retrievers for Reasoning Tasks
di: Shao, Rulin, et al.
Pubblicazione: (2025)
di: Shao, Rulin, et al.
Pubblicazione: (2025)
InstructIE: A Bilingual Instruction-based Information Extraction Dataset
di: Gui, Honghao, et al.
Pubblicazione: (2023)
di: Gui, Honghao, et al.
Pubblicazione: (2023)
RAMQA: A Unified Framework for Retrieval-Augmented Multi-Modal Question Answering
di: Bai, Yang, et al.
Pubblicazione: (2025)
di: Bai, Yang, et al.
Pubblicazione: (2025)
SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
di: Qiao, Shuofei, et al.
Pubblicazione: (2026)
ReCode: Updating Code API Knowledge with Reinforcement Learning
di: Wu, Haoze, et al.
Pubblicazione: (2025)
di: Wu, Haoze, et al.
Pubblicazione: (2025)
Scaling Generalist Data-Analytic Agents
di: Qiao, Shuofei, et al.
Pubblicazione: (2025)
di: Qiao, Shuofei, et al.
Pubblicazione: (2025)
Retrieval-augmented Prompt Learning for Pre-trained Foundation Models
di: Chen, Xiang, et al.
Pubblicazione: (2025)
di: Chen, Xiang, et al.
Pubblicazione: (2025)
ReLearn: Unlearning via Learning for Large Language Models
di: Xu, Haoming, et al.
Pubblicazione: (2025)
di: Xu, Haoming, et al.
Pubblicazione: (2025)
SciNets: Graph-Constrained Multi-Hop Reasoning for Scientific Literature Synthesis
di: Dubey, Sauhard
Pubblicazione: (2025)
di: Dubey, Sauhard
Pubblicazione: (2025)
Graph-based Confidence Calibration for Large Language Models
di: Li, Yukun, et al.
Pubblicazione: (2024)
di: Li, Yukun, et al.
Pubblicazione: (2024)
IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus
di: Gui, Honghao, et al.
Pubblicazione: (2024)
di: Gui, Honghao, et al.
Pubblicazione: (2024)
CuriousLLM: Elevating Multi-Document Question Answering with LLM-Enhanced Knowledge Graph Reasoning
di: Yang, Zukang, et al.
Pubblicazione: (2024)
di: Yang, Zukang, et al.
Pubblicazione: (2024)
KnowPhish: Large Language Models Meet Multimodal Knowledge Graphs for Enhancing Reference-Based Phishing Detection
di: Li, Yuexin, et al.
Pubblicazione: (2024)
di: Li, Yuexin, et al.
Pubblicazione: (2024)
ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability
di: Liu, Wenhan, et al.
Pubblicazione: (2025)
di: Liu, Wenhan, et al.
Pubblicazione: (2025)
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data
di: Venus Team, et al.
Pubblicazione: (2026)
di: Venus Team, et al.
Pubblicazione: (2026)
Leveraging LLM Reasoning Enhances Personalized Recommender Systems
di: Tsai, Alicia Y., et al.
Pubblicazione: (2024)
di: Tsai, Alicia Y., et al.
Pubblicazione: (2024)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
di: Qiu, Yifu, et al.
Pubblicazione: (2025)
di: Qiu, Yifu, et al.
Pubblicazione: (2025)
CXMArena: Unified Dataset to benchmark performance in realistic CXM Scenarios
di: Garg, Raghav, et al.
Pubblicazione: (2025)
di: Garg, Raghav, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Automating Steering for Safe Multimodal Large Language Models
di: Wu, Lyucheng, et al.
Pubblicazione: (2025) -
Information Extraction in Low-Resource Scenarios: Survey and Perspective
di: Deng, Shumin, et al.
Pubblicazione: (2022) -
ChineseHarm-Bench: A Chinese Harmful Content Detection Benchmark
di: Liu, Kangwei, et al.
Pubblicazione: (2025) -
Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics
di: Xu, Ziwen, et al.
Pubblicazione: (2026) -
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)