Test-Time Scaling with Reflective Generative Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zixiao, Wang, Yuxin, Wang, Xiaorui, Xing, Mengting, Gao, Jie, Xu, Jianjun, Liu, Guangcan, Jin, Chenhui, Wang, Zhuo, Zhang, Shengzhuo, Xie, Hongtao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GRIP: A Graph-Based Reasoning Instruction Producer
por: Wang, Jiankang, et al.
Publicado: (2024)
por: Wang, Jiankang, et al.
Publicado: (2024)
Self-Supervised Pre-training with Symmetric Superimposition Modeling for Scene Text Recognition
por: Gao, Zuan, et al.
Publicado: (2024)
por: Gao, Zuan, et al.
Publicado: (2024)
FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents
por: Zhu, Chiwei, et al.
Publicado: (2026)
por: Zhu, Chiwei, et al.
Publicado: (2026)
Self-Reflective Generation at Test Time
por: Mu, Jian, et al.
Publicado: (2025)
por: Mu, Jian, et al.
Publicado: (2025)
A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces
por: Du, Mingxuan, et al.
Publicado: (2026)
por: Du, Mingxuan, et al.
Publicado: (2026)
From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time Scaling
por: Chen, Zhengyu, et al.
Publicado: (2025)
por: Chen, Zhengyu, et al.
Publicado: (2025)
Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking
por: Chen, Yihan, et al.
Publicado: (2025)
por: Chen, Yihan, et al.
Publicado: (2025)
Optimal Aggregation of LLM and PRM Signals for Efficient Test-Time Scaling
por: Kuang, Peng, et al.
Publicado: (2025)
por: Kuang, Peng, et al.
Publicado: (2025)
Advancing Block Diffusion Language Models for Test-Time Scaling
por: Lu, Yi, et al.
Publicado: (2026)
por: Lu, Yi, et al.
Publicado: (2026)
Parallel Test-Time Scaling for Latent Reasoning Models
por: You, Runyang, et al.
Publicado: (2025)
por: You, Runyang, et al.
Publicado: (2025)
Chronos: Learning Temporal Dynamics of Reasoning Chains for Test-Time Scaling
por: Zhang, Kai, et al.
Publicado: (2026)
por: Zhang, Kai, et al.
Publicado: (2026)
ARTIS: Agentic Risk-Aware Test-Time Scaling via Iterative Simulation
por: Zeng, Xingshan, et al.
Publicado: (2026)
por: Zeng, Xingshan, et al.
Publicado: (2026)
Review-LLM: Harnessing Large Language Models for Personalized Review Generation
por: Peng, Qiyao, et al.
Publicado: (2024)
por: Peng, Qiyao, et al.
Publicado: (2024)
Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning
por: Wang, Zezhong, et al.
Publicado: (2025)
por: Wang, Zezhong, et al.
Publicado: (2025)
MetaScale: Test-Time Scaling with Evolving Meta-Thoughts
por: Liu, Qin, et al.
Publicado: (2025)
por: Liu, Qin, et al.
Publicado: (2025)
Chain of Methodologies: Scaling Test Time Computation without Training
por: Liu, Cong, et al.
Publicado: (2025)
por: Liu, Cong, et al.
Publicado: (2025)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
por: Wang, Jian, et al.
Publicado: (2025)
por: Wang, Jian, et al.
Publicado: (2025)
Seer Self-Consistency: Advance Budget Estimation for Adaptive Test-Time Scaling
por: Ji, Shiyu, et al.
Publicado: (2025)
por: Ji, Shiyu, et al.
Publicado: (2025)
Leveraging Generative Models for Real-Time Query-Driven Text Summarization in Large-Scale Web Search
por: Xiong, Zeyu, et al.
Publicado: (2025)
por: Xiong, Zeyu, et al.
Publicado: (2025)
Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning
por: Wang, Jianing, et al.
Publicado: (2025)
por: Wang, Jianing, et al.
Publicado: (2025)
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
por: Qu, Yadong, et al.
Publicado: (2024)
por: Qu, Yadong, et al.
Publicado: (2024)
Generating Equivalent Representations of Code By A Self-Reflection Approach
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
por: Liu, Xiaoze, et al.
Publicado: (2024)
por: Liu, Xiaoze, et al.
Publicado: (2024)
GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
por: Zhao, Jian, et al.
Publicado: (2025)
por: Zhao, Jian, et al.
Publicado: (2025)
UniScale: Adaptive Unified Inference Scaling via Online Joint Optimization of Model Routing and Test-Time Scaling
por: Huang, Kaiyu, et al.
Publicado: (2026)
por: Huang, Kaiyu, et al.
Publicado: (2026)
IGD: Instructional Graphic Design with Multimodal Layer Generation
por: Qu, Yadong, et al.
Publicado: (2025)
por: Qu, Yadong, et al.
Publicado: (2025)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
por: Bi, Zhenni, et al.
Publicado: (2024)
por: Bi, Zhenni, et al.
Publicado: (2024)
LLM$\times$MapReduce-V2: Entropy-Driven Convolutional Test-Time Scaling for Generating Long-Form Articles from Extremely Long Resources
por: Wang, Haoyu, et al.
Publicado: (2025)
por: Wang, Haoyu, et al.
Publicado: (2025)
From Real to Synthetic: Synthesizing Millions of Diversified and Complicated User Instructions with Attributed Grounding
por: Zhu, Chiwei, et al.
Publicado: (2025)
por: Zhu, Chiwei, et al.
Publicado: (2025)
Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing
por: Jiang, Han, et al.
Publicado: (2024)
por: Jiang, Han, et al.
Publicado: (2024)
Bridging the Gap for Test-Time Multimodal Sentiment Analysis
por: Guo, Zirun, et al.
Publicado: (2024)
por: Guo, Zirun, et al.
Publicado: (2024)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
por: Chang, Kaiyan, et al.
Publicado: (2025)
por: Chang, Kaiyan, et al.
Publicado: (2025)
Agentar-Scale-SQL: Advancing Text-to-SQL through Orchestrated Test-Time Scaling
por: Wang, Pengfei, et al.
Publicado: (2025)
por: Wang, Pengfei, et al.
Publicado: (2025)
HEART: Emotionally-Driven Test-Time Scaling of Language Models
por: Pinto, Gabriela, et al.
Publicado: (2025)
por: Pinto, Gabriela, et al.
Publicado: (2025)
Benchmark Test-Time Scaling of General LLM Agents
por: Li, Xiaochuan, et al.
Publicado: (2026)
por: Li, Xiaochuan, et al.
Publicado: (2026)
T$^2$: An Adaptive Test-Time Scaling Strategy for Contextual Question Answering
por: Zhao, Zhengyi, et al.
Publicado: (2025)
por: Zhao, Zhengyi, et al.
Publicado: (2025)
Evaluating Judges as Evaluators: The JETTS Benchmark of LLM-as-Judges as Test-Time Scaling Evaluators
por: Zhou, Yilun, et al.
Publicado: (2025)
por: Zhou, Yilun, et al.
Publicado: (2025)
Adaptive Rectification Sampling for Test-Time Compute Scaling
por: Tan, Zhendong, et al.
Publicado: (2025)
por: Tan, Zhendong, et al.
Publicado: (2025)
Decoding Memories: An Efficient Pipeline for Self-Consistency Hallucination Detection
por: Gao, Weizhi, et al.
Publicado: (2025)
por: Gao, Weizhi, et al.
Publicado: (2025)
Faster and Better LLMs via Latency-Aware Test-Time Scaling
por: Wang, Zili, et al.
Publicado: (2025)
por: Wang, Zili, et al.
Publicado: (2025)
Ejemplares similares
-
GRIP: A Graph-Based Reasoning Instruction Producer
por: Wang, Jiankang, et al.
Publicado: (2024) -
Self-Supervised Pre-training with Symmetric Superimposition Modeling for Scene Text Recognition
por: Gao, Zuan, et al.
Publicado: (2024) -
FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents
por: Zhu, Chiwei, et al.
Publicado: (2026) -
Self-Reflective Generation at Test Time
por: Mu, Jian, et al.
Publicado: (2025) -
A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces
por: Du, Mingxuan, et al.
Publicado: (2026)