On the Effect of Sampling Diversity in Scaling LLM Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Tianchun, Liu, Zichuan, Chen, Yuanzhou, Light, Jonathan, Liu, Weiyang, Chen, Haifeng, Zhang, Xiang, Cheng, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Humanizing the Machine: Proxy Attacks to Mislead LLM Detectors
di: Wang, Tianchun, et al.
Pubblicazione: (2024)
di: Wang, Tianchun, et al.
Pubblicazione: (2024)
DISC: Dynamic Decomposition Improves LLM Inference Scaling
di: Light, Jonathan, et al.
Pubblicazione: (2025)
di: Light, Jonathan, et al.
Pubblicazione: (2025)
Diversified Scaling Inference in Time Series Foundation Models
di: Hua, Ruijin, et al.
Pubblicazione: (2026)
di: Hua, Ruijin, et al.
Pubblicazione: (2026)
Sample-efficient LLM Optimization with Reset Replay
di: Liu, Zichuan, et al.
Pubblicazione: (2025)
di: Liu, Zichuan, et al.
Pubblicazione: (2025)
Towards Robust Fidelity for Evaluating Explainability of Graph Neural Networks
di: Zheng, Xu, et al.
Pubblicazione: (2023)
di: Zheng, Xu, et al.
Pubblicazione: (2023)
Human Texts Are Outliers: Detecting LLM-generated Texts via Out-of-distribution Detection
di: Zeng, Cong, et al.
Pubblicazione: (2025)
di: Zeng, Cong, et al.
Pubblicazione: (2025)
Parametric Augmentation for Time Series Contrastive Learning
di: Zheng, Xu, et al.
Pubblicazione: (2024)
di: Zheng, Xu, et al.
Pubblicazione: (2024)
SolverLLM: Leveraging Test-Time Scaling for Optimization Problem via LLM-Guided Search
di: Li, Dong, et al.
Pubblicazione: (2025)
di: Li, Dong, et al.
Pubblicazione: (2025)
TDRM: Smooth Reward Models with Temporal Difference for LLM RL and Inference
di: Zhang, Dan, et al.
Pubblicazione: (2025)
di: Zhang, Dan, et al.
Pubblicazione: (2025)
Dataset Distillation for Offline Reinforcement Learning
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
DOS: Diverse Outlier Sampling for Out-of-Distribution Detection
di: Jiang, Wenyu, et al.
Pubblicazione: (2023)
di: Jiang, Wenyu, et al.
Pubblicazione: (2023)
Explaining Time Series via Contrastive and Locally Sparse Perturbations
di: Liu, Zichuan, et al.
Pubblicazione: (2024)
di: Liu, Zichuan, et al.
Pubblicazione: (2024)
LMCache: An Efficient KV Cache Layer for Enterprise-Scale LLM Inference
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
di: Qiu, Zeju, et al.
Pubblicazione: (2026)
di: Qiu, Zeju, et al.
Pubblicazione: (2026)
TimeX++: Learning Time-Series Explanations with Information Bottleneck
di: Liu, Zichuan, et al.
Pubblicazione: (2024)
di: Liu, Zichuan, et al.
Pubblicazione: (2024)
Efficient Traffic Forecasting on Large-Scale Road Network by Regularized Adaptive Graph Convolution
di: Wu, Kaiqi, et al.
Pubblicazione: (2025)
di: Wu, Kaiqi, et al.
Pubblicazione: (2025)
DALD: Improving Logits-based Detector without Logits from Black-box LLMs
di: Zeng, Cong, et al.
Pubblicazione: (2024)
di: Zeng, Cong, et al.
Pubblicazione: (2024)
D3: Diversity, Difficulty, and Dependability-Aware Data Selection for Sample-Efficient LLM Instruction Tuning
di: Zhang, Jia, et al.
Pubblicazione: (2025)
di: Zhang, Jia, et al.
Pubblicazione: (2025)
Flipping Against All Odds: Reducing LLM Coin Flip Bias via Verbalized Rejection Sampling
di: Xiao, Tim Z., et al.
Pubblicazione: (2025)
di: Xiao, Tim Z., et al.
Pubblicazione: (2025)
Interpretable Imitation Learning with Dynamic Causal Relations
di: Zhao, Tianxiang, et al.
Pubblicazione: (2023)
di: Zhao, Tianxiang, et al.
Pubblicazione: (2023)
GraphSparseNet: a Novel Method for Large Scale Traffic Flow Prediction
di: Kong, Weiyang, et al.
Pubblicazione: (2025)
di: Kong, Weiyang, et al.
Pubblicazione: (2025)
MetaColloc: Optimization-Free PDE Solving via Meta-Learned Basis Functions
di: Yang, Zichuan
Pubblicazione: (2026)
di: Yang, Zichuan
Pubblicazione: (2026)
Efficient Diversity-Preserving Diffusion Alignment via Gradient-Informed GFlowNets
di: Liu, Zhen, et al.
Pubblicazione: (2024)
di: Liu, Zhen, et al.
Pubblicazione: (2024)
TimeXL: Explainable Multi-modal Time Series Prediction with LLM-in-the-Loop
di: Jiang, Yushan, et al.
Pubblicazione: (2025)
di: Jiang, Yushan, et al.
Pubblicazione: (2025)
ABQ-LLM: Arbitrary-Bit Quantized Inference Acceleration for Large Language Models
di: Zeng, Chao, et al.
Pubblicazione: (2024)
di: Zeng, Chao, et al.
Pubblicazione: (2024)
RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference
di: Chen, Yaoqi, et al.
Pubblicazione: (2025)
di: Chen, Yaoqi, et al.
Pubblicazione: (2025)
MIXRTs: Toward Interpretable Multi-Agent Reinforcement Learning via Mixing Recurrent Soft Decision Trees
di: Liu, Zichuan, et al.
Pubblicazione: (2022)
di: Liu, Zichuan, et al.
Pubblicazione: (2022)
LLM-Extracted Covariates for Clinical Causal Inference: Rethinking Integration Strategies
di: Liu, Lei, et al.
Pubblicazione: (2026)
di: Liu, Lei, et al.
Pubblicazione: (2026)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
The Lifecycle Principle: Stabilizing Dynamic Neural Networks with State Memory
di: Yang, Zichuan
Pubblicazione: (2025)
di: Yang, Zichuan
Pubblicazione: (2025)
What Matters in LLM-generated Data: Diversity and Its Effect on Model Fine-Tuning
di: Zhu, Yuchang, et al.
Pubblicazione: (2025)
di: Zhu, Yuchang, et al.
Pubblicazione: (2025)
PAC Learnability under Explanation-Preserving Graph Perturbations
di: Zheng, Xu, et al.
Pubblicazione: (2024)
di: Zheng, Xu, et al.
Pubblicazione: (2024)
Optimal Pricing for Data-Augmented AutoML Marketplaces
di: Han, Minbiao, et al.
Pubblicazione: (2023)
di: Han, Minbiao, et al.
Pubblicazione: (2023)
CORGI: GNNs with Convolutional Residual Global Interactions for Lagrangian Simulation
di: Ji, Ethan, et al.
Pubblicazione: (2025)
di: Ji, Ethan, et al.
Pubblicazione: (2025)
R-Diverse: Mitigating Diversity Illusion in Self-Play LLM Training
di: Li, Gengsheng, et al.
Pubblicazione: (2026)
di: Li, Gengsheng, et al.
Pubblicazione: (2026)
OptScale: Probabilistic Optimality for Inference-time Scaling
di: Wang, Youkang, et al.
Pubblicazione: (2025)
di: Wang, Youkang, et al.
Pubblicazione: (2025)
DynScaling: Efficient Verifier-free Inference Scaling via Dynamic and Integrated Sampling
di: Wang, Fei, et al.
Pubblicazione: (2025)
di: Wang, Fei, et al.
Pubblicazione: (2025)
Causality-Encoded Diffusion Models for Interventional Sampling and Edge Inference
di: Chen, Li, et al.
Pubblicazione: (2026)
di: Chen, Li, et al.
Pubblicazione: (2026)
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
Where's the liability in the Generative Era? Recovery-based Black-Box Detection of AI-Generated Content
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
di: Bai, Haoyue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Humanizing the Machine: Proxy Attacks to Mislead LLM Detectors
di: Wang, Tianchun, et al.
Pubblicazione: (2024) -
DISC: Dynamic Decomposition Improves LLM Inference Scaling
di: Light, Jonathan, et al.
Pubblicazione: (2025) -
Diversified Scaling Inference in Time Series Foundation Models
di: Hua, Ruijin, et al.
Pubblicazione: (2026) -
Sample-efficient LLM Optimization with Reset Replay
di: Liu, Zichuan, et al.
Pubblicazione: (2025) -
Towards Robust Fidelity for Evaluating Explainability of Graph Neural Networks
di: Zheng, Xu, et al.
Pubblicazione: (2023)