Models Under SCOPE: Scalable and Controllable Routing via Pre-hoc Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Qi, Zhang, Shuhao, Zhou, Ruizhe, Zhang, Ruiyi, Qin, Peijia, Xie, Pengtao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Send a SCOUT First: Pre-hoc Reasoning for Adaptive Detector Allocation in Prompt-Injection Defense
di: Zhang, Shuhao, et al.
Pubblicazione: (2026)
di: Zhang, Shuhao, et al.
Pubblicazione: (2026)
DAJ: Data-Reweighted LLM Judge for Test-Time Scaling in Code Generation
di: Qin, Peijia, et al.
Pubblicazione: (2026)
di: Qin, Peijia, et al.
Pubblicazione: (2026)
DreamPRM-Code: Function-as-Step Process Reward Model with Label Correction for LLM Coding
di: Zhang, Ruiyi, et al.
Pubblicazione: (2025)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2025)
BiDoRA: Bi-level Optimization-Based Weight-Decomposed Low-Rank Adaptation
di: Qin, Peijia, et al.
Pubblicazione: (2024)
di: Qin, Peijia, et al.
Pubblicazione: (2024)
FunPRM: Function-as-Step Process Reward Model with Meta Reward Correction for Code Generation
di: Zhang, Ruiyi, et al.
Pubblicazione: (2026)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2026)
LLMs Know When They Know, but Do Not Act on It: A Metacognitive Harness for Test-time Scaling
di: Cao, Qi, et al.
Pubblicazione: (2026)
di: Cao, Qi, et al.
Pubblicazione: (2026)
ATLAS: Agentic Test-time Learning-to-Allocate Scaling
di: Qin, Peijia, et al.
Pubblicazione: (2026)
di: Qin, Peijia, et al.
Pubblicazione: (2026)
DreamPRM: Domain-Reweighted Process Reward Model for Multimodal Reasoning
di: Cao, Qi, et al.
Pubblicazione: (2025)
di: Cao, Qi, et al.
Pubblicazione: (2025)
BiLoRA: A Bi-level Optimization Framework for Overfitting-Resilient Low-Rank Adaptation of Large Pre-trained Models
di: Qiang, Rushi, et al.
Pubblicazione: (2024)
di: Qiang, Rushi, et al.
Pubblicazione: (2024)
AIBuildAI: An AI Agent for Automatically Building AI Models
di: Zhang, Ruiyi, et al.
Pubblicazione: (2026)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2026)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
di: Xue, Eric, et al.
Pubblicazione: (2025)
di: Xue, Eric, et al.
Pubblicazione: (2025)
TapWeight: Reweighting Pretraining Objectives for Task-Adaptive Pretraining
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
DreamPRM-1.5: Unlocking the Potential of Each Instance for Multimodal Process Reward Model Training
di: Cao, Qi, et al.
Pubblicazione: (2025)
di: Cao, Qi, et al.
Pubblicazione: (2025)
BioTool: A Comprehensive Tool-Calling Dataset for Enhancing Biomedical Capabilities of Large Language Models
di: Gao, Xin, et al.
Pubblicazione: (2026)
di: Gao, Xin, et al.
Pubblicazione: (2026)
AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
Can Prompts Rewind Time for LLMs? Evaluating the Effectiveness of Prompted Knowledge Cutoffs
di: Gao, Xin, et al.
Pubblicazione: (2025)
di: Gao, Xin, et al.
Pubblicazione: (2025)
A Foundational Multi-Modal Model for Few-Shot Learning
di: Dang, Pengtao, et al.
Pubblicazione: (2025)
di: Dang, Pengtao, et al.
Pubblicazione: (2025)
Scalable Complexity Control Facilitates Reasoning Ability of LLMs
di: Hang, Liangkai, et al.
Pubblicazione: (2025)
di: Hang, Liangkai, et al.
Pubblicazione: (2025)
SRTFD: Scalable Real-Time Fault Diagnosis through Online Continual Learning
di: Zhao, Dandan, et al.
Pubblicazione: (2024)
di: Zhao, Dandan, et al.
Pubblicazione: (2024)
PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling
di: Zhong, Ruizhe, et al.
Pubblicazione: (2024)
di: Zhong, Ruizhe, et al.
Pubblicazione: (2024)
SCOPE-FE: Structured Control of Operator and Pairwise Exploration for Feature Engineering
di: Park, Minhee, et al.
Pubblicazione: (2026)
di: Park, Minhee, et al.
Pubblicazione: (2026)
Neural Operators for Predictor Feedback Control of Nonlinear Delay Systems
di: Bhan, Luke, et al.
Pubblicazione: (2024)
di: Bhan, Luke, et al.
Pubblicazione: (2024)
Beyond Classical Attention: Quantum Attention for Scalable Computation
di: Guo, Xuyang, et al.
Pubblicazione: (2023)
di: Guo, Xuyang, et al.
Pubblicazione: (2023)
SCOPE-RL: Stable and Quantitative Control of Policy Entropy in RL Post-Training
di: Wang, Chen, et al.
Pubblicazione: (2025)
di: Wang, Chen, et al.
Pubblicazione: (2025)
Adaptive Overclocking: Dynamic Control of Thinking Path Length via Real-Time Reasoning Signals
di: Jiang, Shuhao, et al.
Pubblicazione: (2025)
di: Jiang, Shuhao, et al.
Pubblicazione: (2025)
AM-SAM: Automated Prompting and Mask Calibration for Segment Anything Model
di: Li, Yuchen, et al.
Pubblicazione: (2024)
di: Li, Yuchen, et al.
Pubblicazione: (2024)
Downstream Task Guided Masking Learning in Masked Autoencoders Using Multi-Level Optimization
di: Guo, Han, et al.
Pubblicazione: (2024)
di: Guo, Han, et al.
Pubblicazione: (2024)
Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning
di: Shi, Ruizhe, et al.
Pubblicazione: (2023)
di: Shi, Ruizhe, et al.
Pubblicazione: (2023)
Efficient Generative Prediction for EHR Foundation Models: The SCOPE and REACH Estimators
di: Solo, Luke, et al.
Pubblicazione: (2026)
di: Solo, Luke, et al.
Pubblicazione: (2026)
Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization
di: Feng, Fu, et al.
Pubblicazione: (2026)
di: Feng, Fu, et al.
Pubblicazione: (2026)
Model-free Estimation of Latent Structure via Multiscale Nonparametric Maximum Likelihood
di: Aragam, Bryon, et al.
Pubblicazione: (2024)
di: Aragam, Bryon, et al.
Pubblicazione: (2024)
SPRINT: Scalable Policy Pre-Training via Language Instruction Relabeling
di: Zhang, Jesse, et al.
Pubblicazione: (2023)
di: Zhang, Jesse, et al.
Pubblicazione: (2023)
SCOPE: Structured Prototype-Guided Adaptation for EEG Foundation Models with Limited Labels
di: Ma, Jingying, et al.
Pubblicazione: (2026)
di: Ma, Jingying, et al.
Pubblicazione: (2026)
Certificated Actor-Critic: Hierarchical Reinforcement Learning with Control Barrier Functions for Safe Navigation
di: Xie, Junjun, et al.
Pubblicazione: (2025)
di: Xie, Junjun, et al.
Pubblicazione: (2025)
Improving Time Series Forecasting via Instance-aware Post-hoc Revision
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
FGTR: Fine-Grained Multi-Table Retrieval via Hierarchical LLM Reasoning
di: Sun, Chaojie, et al.
Pubblicazione: (2026)
di: Sun, Chaojie, et al.
Pubblicazione: (2026)
SCOPE: Sequential Causal Optimization of Process Interventions
di: De Moor, Jakob, et al.
Pubblicazione: (2025)
di: De Moor, Jakob, et al.
Pubblicazione: (2025)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Efficient Privacy-Preserving KAN Inference Using Homomorphic Encryption
di: Lai, Zhizheng, et al.
Pubblicazione: (2024)
di: Lai, Zhizheng, et al.
Pubblicazione: (2024)
Near-Oracle KV Selection via Pre-hoc Sparsity for Long-Context Inference
di: Gao, Yifei, et al.
Pubblicazione: (2026)
di: Gao, Yifei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Send a SCOUT First: Pre-hoc Reasoning for Adaptive Detector Allocation in Prompt-Injection Defense
di: Zhang, Shuhao, et al.
Pubblicazione: (2026) -
DAJ: Data-Reweighted LLM Judge for Test-Time Scaling in Code Generation
di: Qin, Peijia, et al.
Pubblicazione: (2026) -
DreamPRM-Code: Function-as-Step Process Reward Model with Label Correction for LLM Coding
di: Zhang, Ruiyi, et al.
Pubblicazione: (2025) -
BiDoRA: Bi-level Optimization-Based Weight-Decomposed Low-Rank Adaptation
di: Qin, Peijia, et al.
Pubblicazione: (2024) -
FunPRM: Function-as-Step Process Reward Model with Meta Reward Correction for Code Generation
di: Zhang, Ruiyi, et al.
Pubblicazione: (2026)