Enregistré dans:
| Auteurs principaux: | Wang, Xinglin, Shi, Jiayi, Feng, Shaoxiong, Yuan, Peiwen, Li, Yiwei, Zhang, Yueqi, Tan, Chuyi, Zhang, Ji, Pan, Boyuan, Hu, Yao, Li, Kan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.21684 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Every Rollout Counts: Optimal Resource Allocation for Efficient Test-Time Scaling
par: Wang, Xinglin, et autres
Publié: (2025)
par: Wang, Xinglin, et autres
Publié: (2025)
LLM-Powered Benchmark Factory: Reliable, Generic, and Efficient
par: Yuan, Peiwen, et autres
Publié: (2025)
par: Yuan, Peiwen, et autres
Publié: (2025)
Beyond One-Size-Fits-All: Tailored Benchmarks for Efficient Evaluation
par: Yuan, Peiwen, et autres
Publié: (2025)
par: Yuan, Peiwen, et autres
Publié: (2025)
Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning
par: Wang, Xinglin, et autres
Publié: (2024)
par: Wang, Xinglin, et autres
Publié: (2024)
UniCBE: An Uniformity-driven Comparing Based Evaluation Framework with Unified Multi-Objective Optimization
par: Yuan, Peiwen, et autres
Publié: (2025)
par: Yuan, Peiwen, et autres
Publié: (2025)
Silencer: From Discovery to Mitigation of Self-Bias in LLM-as-Benchmark-Generator
par: Yuan, Peiwen, et autres
Publié: (2025)
par: Yuan, Peiwen, et autres
Publié: (2025)
Mind the Quote: Enabling Quotation-Aware Dialogue in LLMs via Plug-and-Play Modules
par: Zhang, Yueqi, et autres
Publié: (2025)
par: Zhang, Yueqi, et autres
Publié: (2025)
From Sub-Ability Diagnosis to Human-Aligned Generation: Bridging the Gap for Text Length Control via MARKERGEN
par: Yuan, Peiwen, et autres
Publié: (2025)
par: Yuan, Peiwen, et autres
Publié: (2025)
Revisiting Self-Consistency from Dynamic Distributional Alignment Perspective on Answer Aggregation
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
Diagnosing and Mitigating System Bias in Self-Rewarding RL
par: Tan, Chuyi, et autres
Publié: (2025)
par: Tan, Chuyi, et autres
Publié: (2025)
PatternKV: Flattening KV Representation Expands Quantization Headroom
par: Zhang, Ji, et autres
Publié: (2025)
par: Zhang, Ji, et autres
Publié: (2025)
Speculative Decoding for Multi-Sample Inference
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
InsBank: Evolving Instruction Subset for Ongoing Alignment
par: Shi, Jiayi, et autres
Publié: (2025)
par: Shi, Jiayi, et autres
Publié: (2025)
Focused Large Language Models are Stable Many-Shot Learners
par: Yuan, Peiwen, et autres
Publié: (2024)
par: Yuan, Peiwen, et autres
Publié: (2024)
On Time, Within Budget: Constraint-Driven Online Resource Allocation for Agentic Workflows
par: Wang, Xinglin, et autres
Publié: (2026)
par: Wang, Xinglin, et autres
Publié: (2026)
Learning More from Less: Unlocking Internal Representations for Benchmark Compression
par: Zhang, Yueqi, et autres
Publié: (2026)
par: Zhang, Yueqi, et autres
Publié: (2026)
Instruction Embedding: Latent Representations of Instructions Towards Task Identification
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
BatchEval: Towards Human-like Text Evaluation
par: Yuan, Peiwen, et autres
Publié: (2023)
par: Yuan, Peiwen, et autres
Publié: (2023)
CogLM: Tracking Cognitive Development of Large Language Models
par: Wang, Xinglin, et autres
Publié: (2024)
par: Wang, Xinglin, et autres
Publié: (2024)
Poor-Supervised Evaluation for SuperLLM via Mutual Consistency
par: Yuan, Peiwen, et autres
Publié: (2024)
par: Yuan, Peiwen, et autres
Publié: (2024)
Integrate the Essence and Eliminate the Dross: Fine-Grained Self-Consistency for Free-Form Language Generation
par: Wang, Xinglin, et autres
Publié: (2024)
par: Wang, Xinglin, et autres
Publié: (2024)
Escape Sky-high Cost: Early-stopping Self-Consistency for Multi-step Reasoning
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
Generative Dense Retrieval: Memory Can Be a Burden
par: Yuan, Peiwen, et autres
Publié: (2024)
par: Yuan, Peiwen, et autres
Publié: (2024)
Test-Time Scaling of Reasoning Models for Machine Translation
par: Li, Zihao, et autres
Publié: (2025)
par: Li, Zihao, et autres
Publié: (2025)
Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE
par: Zeng, Anxiang, et autres
Publié: (2025)
par: Zeng, Anxiang, et autres
Publié: (2025)
Closed‐Loop Recyclable Vitrimer Plastics from PET Waste: A Design for Circularity
par: Mary K. Danielson, et autres
Publié: (2025)
par: Mary K. Danielson, et autres
Publié: (2025)
Alcoholysis of Silicone Rubber Waste: A Method for Efficiently Recycling Silicone Rubber Waste and Preparing Multifunctional Rubber Additive
par: Chongtao Zhang, et autres
Publié: (2025)
par: Chongtao Zhang, et autres
Publié: (2025)
Stitch and Tell: A Structured Multimodal Data Augmentation Method for Spatial Understanding
par: Yin, Hang, et autres
Publié: (2025)
par: Yin, Hang, et autres
Publié: (2025)
Music Education With GenAI : Exploring the Mediating Roles of Enjoyment Between Smart Service Interactional Experience and Behavioural Intention
par: Peiwen Li
Publié: (2025)
par: Peiwen Li
Publié: (2025)
Dynamic Stochastic Decoding Strategy for Open-Domain Dialogue Generation
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
Front Cover: Closed‐Loop Recyclable Vitrimer Plastics from PET Waste: A Design for Circularity (ChemSusChem 18/2025)
par: Mary K. Danielson, et autres
Publié: (2025)
par: Mary K. Danielson, et autres
Publié: (2025)
Efficient Plastic Waste Recycling Using Polymer
par: Vidushi Nain, et autres
Publié: (2024)
par: Vidushi Nain, et autres
Publié: (2024)
Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation
par: Liu, Sihan, et autres
Publié: (2023)
par: Liu, Sihan, et autres
Publié: (2023)
LArctan-SKAN: Simple and Efficient Single-Parameterized Kolmogorov-Arnold Networks using Learnable Trigonometric Function
par: Chen, Zhijie, et autres
Publié: (2024)
par: Chen, Zhijie, et autres
Publié: (2024)
Architectural Scaling Surpass Basis Complexity? Efficient KANs with Single-Parameter Design
par: Chen, Zhijie, et autres
Publié: (2024)
par: Chen, Zhijie, et autres
Publié: (2024)
Organic Waste Recycling
par: Polprasert, Chongrak
Publié: (2017)
par: Polprasert, Chongrak
Publié: (2017)
Fractional quantum anomalous Hall and anyon density-wave halo in a minimal interacting lattice model of twisted bilayer MoTe$_2$
par: Tuo, Chuyi, et autres
Publié: (2025)
par: Tuo, Chuyi, et autres
Publié: (2025)
Video-T1: Test-Time Scaling for Video Generation
par: Liu, Fangfu, et autres
Publié: (2025)
par: Liu, Fangfu, et autres
Publié: (2025)
Synergistic Effects of Electricity and Light for Efficient Iron‐Catalyzed Recycling of Polystyrene Waste
par: Maxime Hourtoule, et autres
Publié: (2026)
par: Maxime Hourtoule, et autres
Publié: (2026)
CuSearch: Curriculum Rollout Sampling via Search Depth for Agentic RAG
par: Shen, Jianghan, et autres
Publié: (2026)
par: Shen, Jianghan, et autres
Publié: (2026)
Documents similaires
-
Every Rollout Counts: Optimal Resource Allocation for Efficient Test-Time Scaling
par: Wang, Xinglin, et autres
Publié: (2025) -
LLM-Powered Benchmark Factory: Reliable, Generic, and Efficient
par: Yuan, Peiwen, et autres
Publié: (2025) -
Beyond One-Size-Fits-All: Tailored Benchmarks for Efficient Evaluation
par: Yuan, Peiwen, et autres
Publié: (2025) -
Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning
par: Wang, Xinglin, et autres
Publié: (2024) -
UniCBE: An Uniformity-driven Comparing Based Evaluation Framework with Unified Multi-Objective Optimization
par: Yuan, Peiwen, et autres
Publié: (2025)