CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Hsu, I-Hung, Wang, Zifeng, Le, Long T., Miculicich, Lesly, Peng, Nanyun, Lee, Chen-Yu, Pfister, Tomas |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Development of a Reliable and Accessible Caregiving Language Model (CaLM)
por: Parmanto, Bambang, et al.
Publicado: (2024)
por: Parmanto, Bambang, et al.
Publicado: (2024)
SQL-PaLM: Improved Large Language Model Adaptation for Text-to-SQL (extended)
por: Sun, Ruoxi, et al.
Publicado: (2023)
por: Sun, Ruoxi, et al.
Publicado: (2023)
CodecLM: Aligning Language Models with Tailored Synthetic Data
por: Wang, Zifeng, et al.
Publicado: (2024)
por: Wang, Zifeng, et al.
Publicado: (2024)
VeriGuard: Enhancing LLM Agent Safety via Verified Code Generation
por: Miculicich, Lesly, et al.
Publicado: (2025)
por: Miculicich, Lesly, et al.
Publicado: (2025)
TableRAG: Million-Token Table Understanding with Language Models
por: Chen, Si-An, et al.
Publicado: (2024)
por: Chen, Si-An, et al.
Publicado: (2024)
SQL-GEN: Bridging the Dialect Gap for Text-to-SQL Via Synthetic Data And Model Merging
por: Pourreza, Mohammadreza, et al.
Publicado: (2024)
por: Pourreza, Mohammadreza, et al.
Publicado: (2024)
LiSA: Lifelong Safety Adaptation via Conservative Policy Induction
por: Kim, Minbeom, et al.
Publicado: (2026)
por: Kim, Minbeom, et al.
Publicado: (2026)
Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding
por: Wang, Zilong, et al.
Publicado: (2024)
por: Wang, Zilong, et al.
Publicado: (2024)
Model Swarms: Collaborative Search to Adapt LLM Experts via Swarm Intelligence
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
Effective Large Language Model Adaptation for Improved Grounding and Citation Generation
por: Ye, Xi, et al.
Publicado: (2023)
por: Ye, Xi, et al.
Publicado: (2023)
Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM
por: Chang, Haw-Shiuan, et al.
Publicado: (2024)
por: Chang, Haw-Shiuan, et al.
Publicado: (2024)
RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards
por: Li, Gaotang, et al.
Publicado: (2026)
por: Li, Gaotang, et al.
Publicado: (2026)
Magnet: Multi-turn Tool-use Data Synthesis and Distillation via Graph Translation
por: Yin, Fan, et al.
Publicado: (2025)
por: Yin, Fan, et al.
Publicado: (2025)
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
por: Deng, Yihe, et al.
Publicado: (2025)
por: Deng, Yihe, et al.
Publicado: (2025)
CausalArmor: Efficient Indirect Prompt Injection Guardrails via Causal Attribution
por: Kim, Minbeom, et al.
Publicado: (2026)
por: Kim, Minbeom, et al.
Publicado: (2026)
Contextual Label Projection for Cross-Lingual Structured Prediction
por: Parekh, Tanmay, et al.
Publicado: (2023)
por: Parekh, Tanmay, et al.
Publicado: (2023)
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
por: Ying, Huaiyuan, et al.
Publicado: (2024)
por: Ying, Huaiyuan, et al.
Publicado: (2024)
In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents
por: Tan, Zhen, et al.
Publicado: (2025)
por: Tan, Zhen, et al.
Publicado: (2025)
Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models
por: Le, Quang-Hung, et al.
Publicado: (2024)
por: Le, Quang-Hung, et al.
Publicado: (2024)
SNaRe: Domain-aware Data Generation for Low-Resource Event Detection
por: Parekh, Tanmay, et al.
Publicado: (2025)
por: Parekh, Tanmay, et al.
Publicado: (2025)
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
por: Yang, Kevin, et al.
Publicado: (2023)
por: Yang, Kevin, et al.
Publicado: (2023)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
por: Han, Chi, et al.
Publicado: (2023)
por: Han, Chi, et al.
Publicado: (2023)
Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents
por: He, Pengfei, et al.
Publicado: (2026)
por: He, Pengfei, et al.
Publicado: (2026)
Speculative RAG: Enhancing Retrieval Augmented Generation through Drafting
por: Wang, Zilong, et al.
Publicado: (2024)
por: Wang, Zilong, et al.
Publicado: (2024)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
por: Ouyang, Siru, et al.
Publicado: (2025)
por: Ouyang, Siru, et al.
Publicado: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024)
por: Lee, Jooyoung, et al.
Publicado: (2024)
Speculative Knowledge Distillation: Bridging the Teacher-Student Gap Through Interleaved Sampling
por: Xu, Wenda, et al.
Publicado: (2024)
por: Xu, Wenda, et al.
Publicado: (2024)
PhonologyBench: Evaluating Phonological Skills of Large Language Models
por: Suvarna, Ashima, et al.
Publicado: (2024)
por: Suvarna, Ashima, et al.
Publicado: (2024)
Argument-Aware Approach To Event Linking
por: Hsu, I-Hung, et al.
Publicado: (2024)
por: Hsu, I-Hung, et al.
Publicado: (2024)
Deep Researcher with Test-Time Diffusion
por: Han, Rujun, et al.
Publicado: (2025)
por: Han, Rujun, et al.
Publicado: (2025)
KaLM: Knowledge-aligned Autoregressive Language Modeling via Dual-view Knowledge Graph Contrastive Learning
por: Yu, Peng, et al.
Publicado: (2024)
por: Yu, Peng, et al.
Publicado: (2024)
Are Large Language Models Capable of Generating Human-Level Narratives?
por: Tian, Yufei, et al.
Publicado: (2024)
por: Tian, Yufei, et al.
Publicado: (2024)
Open-Domain Text Evaluation via Contrastive Distribution Methods
por: Lu, Sidi, et al.
Publicado: (2023)
por: Lu, Sidi, et al.
Publicado: (2023)
Small Language Models Need Strong Verifiers to Self-Correct Reasoning
por: Zhang, Yunxiang, et al.
Publicado: (2024)
por: Zhang, Yunxiang, et al.
Publicado: (2024)
Control Large Language Models via Divide and Conquer
por: Li, Bingxuan, et al.
Publicado: (2024)
por: Li, Bingxuan, et al.
Publicado: (2024)
PolicyBank: Evolving Policy Understanding for LLM Agents
por: Choi, Jihye, et al.
Publicado: (2026)
por: Choi, Jihye, et al.
Publicado: (2026)
Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
por: Gu, Jia-Chen, et al.
Publicado: (2024)
por: Gu, Jia-Chen, et al.
Publicado: (2024)
Replicating ReLM Results: Validating Large Language Models with ReLM
por: Adamson, Reece, et al.
Publicado: (2025)
por: Adamson, Reece, et al.
Publicado: (2025)
Evaluating Cultural Knowledge Processing in Large Language Models: A Cognitive Benchmarking Framework Integrating Retrieval-Augmented Generation
por: Lee, Hung-Shin, et al.
Publicado: (2025)
por: Lee, Hung-Shin, et al.
Publicado: (2025)
PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving
por: Parmar, Mihir, et al.
Publicado: (2025)
por: Parmar, Mihir, et al.
Publicado: (2025)
Ejemplares similares
-
Development of a Reliable and Accessible Caregiving Language Model (CaLM)
por: Parmanto, Bambang, et al.
Publicado: (2024) -
SQL-PaLM: Improved Large Language Model Adaptation for Text-to-SQL (extended)
por: Sun, Ruoxi, et al.
Publicado: (2023) -
CodecLM: Aligning Language Models with Tailored Synthetic Data
por: Wang, Zifeng, et al.
Publicado: (2024) -
VeriGuard: Enhancing LLM Agent Safety via Verified Code Generation
por: Miculicich, Lesly, et al.
Publicado: (2025) -
TableRAG: Million-Token Table Understanding with Language Models
por: Chen, Si-An, et al.
Publicado: (2024)