Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Chang, Kaiyan, Shi, Yonghao, Wang, Chenglong, Zhou, Hang, Hu, Chi, Liu, Xiaoqian, Luo, Yingfeng, Ge, Yuan, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024)
por: Chang, Kaiyan, et al.
Publicado: (2024)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
por: Chang, Kaiyan, et al.
Publicado: (2026)
por: Chang, Kaiyan, et al.
Publicado: (2026)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
por: Luo, Yingfeng, et al.
Publicado: (2026)
por: Luo, Yingfeng, et al.
Publicado: (2026)
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
When Scaling Fails: Mitigating Audio Perception Decay of LALMs via Multi-Step Perception-Aware Reasoning
por: Mao, Ruixiang, et al.
Publicado: (2026)
por: Mao, Ruixiang, et al.
Publicado: (2026)
RankPrompt: Step-by-Step Comparisons Make Language Models Better Reasoners
por: Hu, Chi, et al.
Publicado: (2024)
por: Hu, Chi, et al.
Publicado: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
Recent Advances in End-to-End Simultaneous Speech Translation
por: Liu, Xiaoqian, et al.
Publicado: (2024)
por: Liu, Xiaoqian, et al.
Publicado: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
SUBQRAG: Sub-Question Driven Dynamic Graph RAG
por: Li, Jiaoyang, et al.
Publicado: (2025)
por: Li, Jiaoyang, et al.
Publicado: (2025)
Teaching Language Models to Self-Improve by Learning from Language Feedback
por: Hu, Chi, et al.
Publicado: (2024)
por: Hu, Chi, et al.
Publicado: (2024)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
por: Zhong, Li, et al.
Publicado: (2024)
por: Zhong, Li, et al.
Publicado: (2024)
FLEXI: Benchmarking Full-duplex Human-LLM Speech Interaction
por: Ge, Yuan, et al.
Publicado: (2025)
por: Ge, Yuan, et al.
Publicado: (2025)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
por: Shan, Weiqiao, et al.
Publicado: (2024)
por: Shan, Weiqiao, et al.
Publicado: (2024)
A Modular-based Strategy for Mitigating Gradient Conflicts in Simultaneous Speech Translation
por: Liu, Xiaoqian, et al.
Publicado: (2024)
por: Liu, Xiaoqian, et al.
Publicado: (2024)
Video-T1: Test-Time Scaling for Video Generation
por: Liu, Fangfu, et al.
Publicado: (2025)
por: Liu, Fangfu, et al.
Publicado: (2025)
Critique to Verify: Accurate and Honest Test-Time Scaling with RL-Trained Verifiers
por: Yang, Zhicheng, et al.
Publicado: (2025)
por: Yang, Zhicheng, et al.
Publicado: (2025)
Parallel Test-Time Scaling with Multi-Sequence Verifiers
por: Kim, Yegon, et al.
Publicado: (2026)
por: Kim, Yegon, et al.
Publicado: (2026)
Scal3R: Scalable Test-Time Training for Large-Scale 3D Reconstruction
por: Xie, Tao, et al.
Publicado: (2026)
por: Xie, Tao, et al.
Publicado: (2026)
Attention2Probability: Attention-Driven Terminology Probability Estimation for Robust Speech-to-Text System
por: Du, Yanfan, et al.
Publicado: (2025)
por: Du, Yanfan, et al.
Publicado: (2025)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
por: Wang, Jianjin, et al.
Publicado: (2025)
por: Wang, Jianjin, et al.
Publicado: (2025)
On the Emotion Understanding of Synthesized Speech
por: Ge, Yuan, et al.
Publicado: (2026)
por: Ge, Yuan, et al.
Publicado: (2026)
TextualVerifier: Verify TextGrad Step-by-Step
por: Situmorang, Eugenius Mario, et al.
Publicado: (2025)
por: Situmorang, Eugenius Mario, et al.
Publicado: (2025)
dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models
por: Xin, Yi, et al.
Publicado: (2025)
por: Xin, Yi, et al.
Publicado: (2025)
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders
por: Shan, Weiqiao, et al.
Publicado: (2025)
por: Shan, Weiqiao, et al.
Publicado: (2025)
Evaluating the Role of Verifiers in Test-Time Scaling for Legal Reasoning Tasks
por: Romano, Davide, et al.
Publicado: (2025)
por: Romano, Davide, et al.
Publicado: (2025)
Verifier Threshold: An Efficient Test-Time Scaling Approach for Image Generation
por: Sundaresha, Vignesh, et al.
Publicado: (2025)
por: Sundaresha, Vignesh, et al.
Publicado: (2025)
Multi-Agent Verification: Scaling Test-Time Compute with Multiple Verifiers
por: Lifshitz, Shalev, et al.
Publicado: (2025)
por: Lifshitz, Shalev, et al.
Publicado: (2025)
VeriScale: Adversarial Test-Suite Scaling for Verifiable Code Generation
por: Bai, Yifan, et al.
Publicado: (2026)
por: Bai, Yifan, et al.
Publicado: (2026)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
por: Lin, Weizhe, et al.
Publicado: (2025)
por: Lin, Weizhe, et al.
Publicado: (2025)
Generating Symbolic World Models via Test-time Scaling of Large Language Models
por: Yu, Zhouliang, et al.
Publicado: (2025)
por: Yu, Zhouliang, et al.
Publicado: (2025)
Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps
por: Ma, Nanye, et al.
Publicado: (2025)
por: Ma, Nanye, et al.
Publicado: (2025)
NDP: Next Distribution Prediction as a More Broad Target
por: Ruan, Junhao, et al.
Publicado: (2024)
por: Ruan, Junhao, et al.
Publicado: (2024)
SageLM: A Multi-aspect and Explainable Large Language Model for Speech Judgement
por: Ge, Yuan, et al.
Publicado: (2025)
por: Ge, Yuan, et al.
Publicado: (2025)
StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control
por: Zhao, Haishu, et al.
Publicado: (2026)
por: Zhao, Haishu, et al.
Publicado: (2026)
Ejemplares similares
-
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024) -
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
por: Chang, Kaiyan, et al.
Publicado: (2026) -
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
por: Luo, Yingfeng, et al.
Publicado: (2026) -
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024) -
When Scaling Fails: Mitigating Audio Perception Decay of LALMs via Multi-Step Perception-Aware Reasoning
por: Mao, Ruixiang, et al.
Publicado: (2026)