Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Ruotong, Cao, Boxi, Lin, Hongyu, Han, Xianpei, Zheng, Jia, Wang, Sirui, Cai, Xunliang, Sun, Le |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Life Cycle of Knowledge in Big Language Models: A Survey
par: Cao, Boxi, et autres
Publié: (2023)
par: Cao, Boxi, et autres
Publié: (2023)
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
par: Zheng, Jiasheng, et autres
Publié: (2024)
par: Zheng, Jiasheng, et autres
Publié: (2024)
Learning or Self-aligning? Rethinking Instruction Fine-tuning
par: Ren, Mengjie, et autres
Publié: (2024)
par: Ren, Mengjie, et autres
Publié: (2024)
Towards Universal Dense Blocking for Entity Resolution
par: Wang, Tianshu, et autres
Publié: (2024)
par: Wang, Tianshu, et autres
Publié: (2024)
Multi-Facet Counterfactual Learning for Content Quality Evaluation
par: Zheng, Jiasheng, et autres
Publié: (2024)
par: Zheng, Jiasheng, et autres
Publié: (2024)
Combinatorial Synthesis: Scaling Code RLVR via Atomic Decomposition and Recombination
par: Zheng, Jiasheng, et autres
Publié: (2026)
par: Zheng, Jiasheng, et autres
Publié: (2026)
StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
Academically intelligent LLMs are not necessarily socially intelligent
par: Xu, Ruoxi, et autres
Publié: (2024)
par: Xu, Ruoxi, et autres
Publié: (2024)
Seg2Act: Global Context-aware Action Generation for Document Logical Structuring
par: Li, Zichao, et autres
Publié: (2024)
par: Li, Zichao, et autres
Publié: (2024)
All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
par: Wang, Dan, et autres
Publié: (2026)
par: Wang, Dan, et autres
Publié: (2026)
LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents
par: Peng, Xiaoxuan, et autres
Publié: (2026)
par: Peng, Xiaoxuan, et autres
Publié: (2026)
AI for social science and social science of AI: A Survey
par: Xu, Ruoxi, et autres
Publié: (2024)
par: Xu, Ruoxi, et autres
Publié: (2024)
Learning from Failures: Correction-Oriented Policy Optimization with Verifiable Rewards
par: Ren, Mengjie, et autres
Publié: (2026)
par: Ren, Mengjie, et autres
Publié: (2026)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
par: Cao, Boxi, et autres
Publié: (2023)
par: Cao, Boxi, et autres
Publié: (2023)
When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
par: Mao, Yingzhi, et autres
Publié: (2025)
par: Mao, Yingzhi, et autres
Publié: (2025)
Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic
par: Zheng, Xin, et autres
Publié: (2024)
par: Zheng, Xin, et autres
Publié: (2024)
LLMs Know What They Need: Leveraging a Missing Information Guided Framework to Empower Retrieval-Augmented Generation
par: Wang, Keheng, et autres
Publié: (2024)
par: Wang, Keheng, et autres
Publié: (2024)
Large Language Models Often Say One Thing and Do Another
par: Xu, Ruoxi, et autres
Publié: (2025)
par: Xu, Ruoxi, et autres
Publié: (2025)
ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models
par: Zheng, Jiasheng, et autres
Publié: (2026)
par: Zheng, Jiasheng, et autres
Publié: (2026)
Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces
par: Chen, Jiawei, et autres
Publié: (2026)
par: Chen, Jiawei, et autres
Publié: (2026)
URL: Universal Referential Knowledge Linking via Task-instructed Representation Compression
par: Li, Zhuoqun, et autres
Publié: (2024)
par: Li, Zhuoqun, et autres
Publié: (2024)
Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
par: Ma, Zhengzhao, et autres
Publié: (2026)
par: Ma, Zhengzhao, et autres
Publié: (2026)
Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
par: Xu, Ruoxi, et autres
Publié: (2025)
par: Xu, Ruoxi, et autres
Publié: (2025)
Towards Scalable Automated Alignment of LLMs: A Survey
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering
par: Guan, Xinyan, et autres
Publié: (2024)
par: Guan, Xinyan, et autres
Publié: (2024)
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
par: Zheng, Xin, et autres
Publié: (2024)
par: Zheng, Xin, et autres
Publié: (2024)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
par: Zhang, Yize, et autres
Publié: (2025)
par: Zhang, Yize, et autres
Publié: (2025)
PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
par: Bian, Ning, et autres
Publié: (2024)
par: Bian, Ning, et autres
Publié: (2024)
REInstruct: Building Instruction Data from Unlabeled Corpus
par: Chen, Shu, et autres
Publié: (2024)
par: Chen, Shu, et autres
Publié: (2024)
Open Grounded Planning: Challenges and Benchmark Construction
par: Guo, Shiguang, et autres
Publié: (2024)
par: Guo, Shiguang, et autres
Publié: (2024)
Base of RoPE Bounds Context Length
par: Men, Xin, et autres
Publié: (2024)
par: Men, Xin, et autres
Publié: (2024)
CrEst: Credibility Estimation for Contexts in LLMs via Weak Supervision
par: Adila, Dyah, et autres
Publié: (2025)
par: Adila, Dyah, et autres
Publié: (2025)
Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation
par: Yuan, Qianhao, et autres
Publié: (2026)
par: Yuan, Qianhao, et autres
Publié: (2026)
Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language Models
par: Li, Zhuoqun, et autres
Publié: (2024)
par: Li, Zhuoqun, et autres
Publié: (2024)
READoc: A Unified Benchmark for Realistic Document Structured Extraction
par: Li, Zichao, et autres
Publié: (2024)
par: Li, Zichao, et autres
Publié: (2024)
Enhancing LLMs via High-Knowledge Data Selection
par: Duan, Feiyu, et autres
Publié: (2025)
par: Duan, Feiyu, et autres
Publié: (2025)
NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables
par: Wang, Lanrui, et autres
Publié: (2025)
par: Wang, Lanrui, et autres
Publié: (2025)
Not All Languages are Equal: Insights into Multilingual Retrieval-Augmented Generation
par: Wu, Suhang, et autres
Publié: (2024)
par: Wu, Suhang, et autres
Publié: (2024)
DBCopilot: Natural Language Querying over Massive Databases via Schema Routing
par: Wang, Tianshu, et autres
Publié: (2023)
par: Wang, Tianshu, et autres
Publié: (2023)
Documents similaires
-
The Life Cycle of Knowledge in Big Language Models: A Survey
par: Cao, Boxi, et autres
Publié: (2023) -
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
par: Zheng, Jiasheng, et autres
Publié: (2024) -
Learning or Self-aligning? Rethinking Instruction Fine-tuning
par: Ren, Mengjie, et autres
Publié: (2024) -
Towards Universal Dense Blocking for Entity Resolution
par: Wang, Tianshu, et autres
Publié: (2024) -
Multi-Facet Counterfactual Learning for Content Quality Evaluation
par: Zheng, Jiasheng, et autres
Publié: (2024)