Salvato in:
| Autori principali: | Cao, Mingyu, Correia, Alvaro H. C., Louizos, Christos, Liu, Shiwei, Yin, Lu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.10953 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Guarding the Meaning: Self-Supervised Training for Semantic Robustness in Guard Models
di: Pinneri, Cristina, et al.
Pubblicazione: (2025)
di: Pinneri, Cristina, et al.
Pubblicazione: (2025)
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
di: Li, Pengxiang, et al.
Pubblicazione: (2026)
di: Li, Pengxiang, et al.
Pubblicazione: (2026)
Diffusion Language Models Know the Answer Before Decoding
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Accelerating Large Language Model Reasoning via Speculative Search
di: Wang, Zhihai, et al.
Pubblicazione: (2025)
di: Wang, Zhihai, et al.
Pubblicazione: (2025)
Diffusion Language Model Inference with Monte Carlo Tree Search
di: Huang, Zheng, et al.
Pubblicazione: (2025)
di: Huang, Zheng, et al.
Pubblicazione: (2025)
Analyzing and Improving Chain-of-Thought Monitorability Through Information Theory
di: Anwar, Usman, et al.
Pubblicazione: (2026)
di: Anwar, Usman, et al.
Pubblicazione: (2026)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
di: Zhou, Zhanhui, et al.
Pubblicazione: (2024)
di: Zhou, Zhanhui, et al.
Pubblicazione: (2024)
Affective and Dynamic Beam Search for Story Generation
di: Huang, Tenghao, et al.
Pubblicazione: (2023)
di: Huang, Tenghao, et al.
Pubblicazione: (2023)
PropRAG: Guiding Retrieval with Beam Search over Proposition Paths
di: Wang, Jingjin, et al.
Pubblicazione: (2025)
di: Wang, Jingjin, et al.
Pubblicazione: (2025)
Stream of Search (SoS): Learning to Search in Language
di: Gandhi, Kanishk, et al.
Pubblicazione: (2024)
di: Gandhi, Kanishk, et al.
Pubblicazione: (2024)
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
di: Shelar, Onkar, et al.
Pubblicazione: (2025)
di: Shelar, Onkar, et al.
Pubblicazione: (2025)
Continual Learning with Embedding Layer Surgery and Task-wise Beam Search using Whisper
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
Tree Search for Language Model Agents
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
di: Li, Pengxiang, et al.
Pubblicazione: (2024)
di: Li, Pengxiang, et al.
Pubblicazione: (2024)
ICR: Iterative Clarification and Rewriting for Conversational Search
di: Cao, Zhiyu, et al.
Pubblicazione: (2025)
di: Cao, Zhiyu, et al.
Pubblicazione: (2025)
Re-Search for The Truth: Multi-round Retrieval-augmented Large Language Models are Strong Fake News Detectors
di: Li, Guanghua, et al.
Pubblicazione: (2024)
di: Li, Guanghua, et al.
Pubblicazione: (2024)
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2025)
di: Yu, Fei, et al.
Pubblicazione: (2025)
SEM: Reinforcement Learning for Search-Efficient Large Language Models
di: Sha, Zeyang, et al.
Pubblicazione: (2025)
di: Sha, Zeyang, et al.
Pubblicazione: (2025)
CoSearchAgent: A Lightweight Collaborative Search Agent with Large Language Models
di: Gong, Peiyuan, et al.
Pubblicazione: (2024)
di: Gong, Peiyuan, et al.
Pubblicazione: (2024)
Hypothesis Search: Inductive Reasoning with Language Models
di: Wang, Ruocheng, et al.
Pubblicazione: (2023)
di: Wang, Ruocheng, et al.
Pubblicazione: (2023)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
di: Chang, Aofei, et al.
Pubblicazione: (2024)
di: Chang, Aofei, et al.
Pubblicazione: (2024)
The Role of Model Confidence on Bias Effects in Measured Uncertainties for Vision-Language Models
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
BPP-Search: Enhancing Tree of Thought Reasoning for Mathematical Modeling Problem Solving
di: Wang, Teng, et al.
Pubblicazione: (2024)
di: Wang, Teng, et al.
Pubblicazione: (2024)
DeepSearch: Overcome the Bottleneck of Reinforcement Learning with Verifiable Rewards via Monte Carlo Tree Search
di: Wu, Fang, et al.
Pubblicazione: (2025)
di: Wu, Fang, et al.
Pubblicazione: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
di: Li, Shuozhe, et al.
Pubblicazione: (2026)
Model-Document Protocol for AI Search
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
LRAS: Advanced Legal Reasoning with Agentic Search
di: Zhou, Yujin, et al.
Pubblicazione: (2026)
di: Zhou, Yujin, et al.
Pubblicazione: (2026)
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
Learning to Better Search with Language Models via Guided Reinforced Self-Training
di: Moon, Seungyong, et al.
Pubblicazione: (2024)
di: Moon, Seungyong, et al.
Pubblicazione: (2024)
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
di: Wang, Kangyu, et al.
Pubblicazione: (2025)
di: Wang, Kangyu, et al.
Pubblicazione: (2025)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
Creative Beam Search: LLM-as-a-Judge For Improving Response Generation
di: Franceschelli, Giorgio, et al.
Pubblicazione: (2024)
di: Franceschelli, Giorgio, et al.
Pubblicazione: (2024)
The Confidence Shortcut: A Reasoning Failure Mode of Masked Diffusion Models
di: Kim, Dueun, et al.
Pubblicazione: (2026)
di: Kim, Dueun, et al.
Pubblicazione: (2026)
Stable Diffusion-based Data Augmentation for Federated Learning with Non-IID Data
di: Morafah, Mahdi, et al.
Pubblicazione: (2024)
di: Morafah, Mahdi, et al.
Pubblicazione: (2024)
Closing the Confidence-Faithfulness Gap in Large Language Models
di: Miao, Miranda Muqing, et al.
Pubblicazione: (2026)
di: Miao, Miranda Muqing, et al.
Pubblicazione: (2026)
When Quantization Affects Confidence of Large Language Models?
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
di: Proskurina, Irina, et al.
Pubblicazione: (2024)
Dep-Search: Learning Dependency-Aware Reasoning Traces with Persistent Memory
di: Liu, Yanming, et al.
Pubblicazione: (2026)
di: Liu, Yanming, et al.
Pubblicazione: (2026)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
di: He, Bowei, et al.
Pubblicazione: (2026)
di: He, Bowei, et al.
Pubblicazione: (2026)
Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering
di: Guan, Xinyan, et al.
Pubblicazione: (2024)
di: Guan, Xinyan, et al.
Pubblicazione: (2024)
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
di: Cao, Zhiyu, et al.
Pubblicazione: (2026)
di: Cao, Zhiyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Guarding the Meaning: Self-Supervised Training for Semantic Robustness in Guard Models
di: Pinneri, Cristina, et al.
Pubblicazione: (2025) -
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
di: Li, Pengxiang, et al.
Pubblicazione: (2026) -
Diffusion Language Models Know the Answer Before Decoding
di: Li, Pengxiang, et al.
Pubblicazione: (2025) -
Accelerating Large Language Model Reasoning via Speculative Search
di: Wang, Zhihai, et al.
Pubblicazione: (2025) -
Diffusion Language Model Inference with Monte Carlo Tree Search
di: Huang, Zheng, et al.
Pubblicazione: (2025)