SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chuang, Yung-Sung, Cohen-Wang, Benjamin, Shen, Shannon Zejiang, Wu, Zhaofeng, Xu, Hu, Lin, Xi Victoria, Glass, James, Li, Shang-Wen, Yih, Wen-tau |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ContextCite: Attributing Model Generation to Context
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2024)
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2024)
Learning to Attribute with Attention
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2025)
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2025)
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
di: Li, Minghan, et al.
Pubblicazione: (2024)
di: Li, Minghan, et al.
Pubblicazione: (2024)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
di: Zhang, Wenzheng, et al.
Pubblicazione: (2025)
di: Zhang, Wenzheng, et al.
Pubblicazione: (2025)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
di: Chen, Mingda, et al.
Pubblicazione: (2023)
di: Chen, Mingda, et al.
Pubblicazione: (2023)
FLAME: Factuality-Aware Alignment for Large Language Models
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
Reliable, Adaptable, and Attributable Language Models with Retrieval
di: Asai, Akari, et al.
Pubblicazione: (2024)
di: Asai, Akari, et al.
Pubblicazione: (2024)
Meta CLIP 2: A Worldwide Scaling Recipe
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
Procedural Knowledge at Scale Improves Reasoning
di: Wu, Di, et al.
Pubblicazione: (2026)
di: Wu, Di, et al.
Pubblicazione: (2026)
Don't "Overthink" Passage Reranking: Is Reasoning Truly Necessary?
di: Jedidi, Nour, et al.
Pubblicazione: (2025)
di: Jedidi, Nour, et al.
Pubblicazione: (2025)
Zero-Shot Dense Retrieval with Embeddings from Relevance Feedback
di: Jedidi, Nour, et al.
Pubblicazione: (2024)
di: Jedidi, Nour, et al.
Pubblicazione: (2024)
Self-Pruned Key-Value Attention: Learning When to Write by Predicting Future Utility
di: Szilvasy, Gergely, et al.
Pubblicazione: (2026)
di: Szilvasy, Gergely, et al.
Pubblicazione: (2026)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2023)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2023)
Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2024)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2024)
Group-Level Data Selection for Efficient Pretraining
di: Yu, Zichun, et al.
Pubblicazione: (2025)
di: Yu, Zichun, et al.
Pubblicazione: (2025)
Instruction-tuned Language Models are Better Knowledge Learners
di: Jiang, Zhengbao, et al.
Pubblicazione: (2024)
di: Jiang, Zhengbao, et al.
Pubblicazione: (2024)
Mixture Experts with Test-Time Self-Supervised Aggregation for Tabular Imbalanced Regression
di: Wang, Yung-Chien, et al.
Pubblicazione: (2025)
di: Wang, Yung-Chien, et al.
Pubblicazione: (2025)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
di: He, Jacqueline, et al.
Pubblicazione: (2026)
di: He, Jacqueline, et al.
Pubblicazione: (2026)
Memory Layers at Scale
di: Berges, Vincent-Pierre, et al.
Pubblicazione: (2024)
di: Berges, Vincent-Pierre, et al.
Pubblicazione: (2024)
Think&Cite: Improving Attributed Text Generation with Self-Guided Tree Search and Progress Reward Modeling
di: Li, Junyi, et al.
Pubblicazione: (2024)
di: Li, Junyi, et al.
Pubblicazione: (2024)
Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM
di: Sukhbaatar, Sainbayar, et al.
Pubblicazione: (2024)
di: Sukhbaatar, Sainbayar, et al.
Pubblicazione: (2024)
Multilingual Safety Alignment via Self-Distillation
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
Cleansing Jewel: A Neural Spelling Correction Model Built On Google OCR-ed Tibetan Manuscripts
di: Luo, Queenie, et al.
Pubblicazione: (2023)
di: Luo, Queenie, et al.
Pubblicazione: (2023)
Large Language Model Guided Decoding for Self-Supervised Speech Recognition
di: Cohen, Eyal, et al.
Pubblicazione: (2025)
di: Cohen, Eyal, et al.
Pubblicazione: (2025)
Revisiting Self-supervised Learning of Speech Representation from a Mutual Information Perspective
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2025)
di: Huang, Yukun, et al.
Pubblicazione: (2025)
Self-Supervised Visual Preference Alignment
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
Self-Supervised Learning by Curvature Alignment
di: Ghojogh, Benyamin, et al.
Pubblicazione: (2025)
di: Ghojogh, Benyamin, et al.
Pubblicazione: (2025)
On the Alignment Between Supervised and Self-Supervised Contrastive Learning
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
A Data-Centric Approach To Generate Faithful and High Quality Patient Summaries with Large Language Models
di: Hegselmann, Stefan, et al.
Pubblicazione: (2024)
di: Hegselmann, Stefan, et al.
Pubblicazione: (2024)
SALMON: Self-Alignment with Instructable Reward Models
di: Sun, Zhiqing, et al.
Pubblicazione: (2023)
di: Sun, Zhiqing, et al.
Pubblicazione: (2023)
Curiosity-driven Red-teaming for Large Language Models
di: Hong, Zhang-Wei, et al.
Pubblicazione: (2024)
di: Hong, Zhang-Wei, et al.
Pubblicazione: (2024)
An Augmentation-Aware Theory for Self-Supervised Contrastive Learning
di: Cui, Jingyi, et al.
Pubblicazione: (2025)
di: Cui, Jingyi, et al.
Pubblicazione: (2025)
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
di: Liang, Weixin, et al.
Pubblicazione: (2024)
di: Liang, Weixin, et al.
Pubblicazione: (2024)
Self‐Pumping Janus Membranes for Calcium Delivery in Diabetic Wound Healing
di: Mei Wen, et al.
Pubblicazione: (2026)
di: Mei Wen, et al.
Pubblicazione: (2026)
Active Self-Semi-Supervised Learning for Few Labeled Samples
di: Wen, Ziting, et al.
Pubblicazione: (2022)
di: Wen, Ziting, et al.
Pubblicazione: (2022)
Every Node is Different: Dynamically Fusing Self-Supervised Tasks for Attributed Graph Clustering
di: Zhu, Pengfei, et al.
Pubblicazione: (2024)
di: Zhu, Pengfei, et al.
Pubblicazione: (2024)
Learning to Decode Collaboratively with Multiple Language Models
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
HoneyBee: Data Recipes for Vision-Language Reasoners
di: Bansal, Hritik, et al.
Pubblicazione: (2025)
di: Bansal, Hritik, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ContextCite: Attributing Model Generation to Context
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2024) -
Learning to Attribute with Attention
di: Cohen-Wang, Benjamin, et al.
Pubblicazione: (2025) -
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
di: Li, Minghan, et al.
Pubblicazione: (2024) -
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
di: Ma, Xueguang, et al.
Pubblicazione: (2025) -
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
di: Zhang, Wenzheng, et al.
Pubblicazione: (2025)