Get RICH or Die Scaling: Profitably Trading Inference Compute for Robustness
Fuente:
arXiv
Salvato in:
| Autori principali: | McDonald, Tavish, Lei, Bo, Fort, Stanislav, Kailkhura, Bhavya, Bartoldson, Brian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adversarial Robustness Limits via Scaling-Law and Human-Alignment Studies
di: Bartoldson, Brian R., et al.
Pubblicazione: (2024)
di: Bartoldson, Brian R., et al.
Pubblicazione: (2024)
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
AegisLLM: Scaling Agentic Systems for Self-Reflective Defense in LLM Security
di: Cai, Zikui, et al.
Pubblicazione: (2025)
di: Cai, Zikui, et al.
Pubblicazione: (2025)
Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts
di: Zheng, Haizhong, et al.
Pubblicazione: (2025)
di: Zheng, Haizhong, et al.
Pubblicazione: (2025)
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)
Double Visual Defense: Adversarial Pre-training and Instruction Tuning for Improving Vision-Language Model Robustness
di: Wang, Zeyu, et al.
Pubblicazione: (2025)
di: Wang, Zeyu, et al.
Pubblicazione: (2025)
Certifiably-Robust Federated Adversarial Learning via Randomized Smoothing
di: Chen, Cheng, et al.
Pubblicazione: (2021)
di: Chen, Cheng, et al.
Pubblicazione: (2021)
Improving Robustness In Sparse Autoencoders via Masked Regularization
di: Narayanaswamy, Vivek, et al.
Pubblicazione: (2026)
di: Narayanaswamy, Vivek, et al.
Pubblicazione: (2026)
Trajectory Balance with Asynchrony: Decoupling Exploration and Learning for Fast, Scalable LLM Post-Training
di: Bartoldson, Brian, et al.
Pubblicazione: (2025)
di: Bartoldson, Brian, et al.
Pubblicazione: (2025)
A Note on Implementation Errors in Recent Adaptive Attacks Against Multi-Resolution Self-Ensembles
di: Fort, Stanislav
Pubblicazione: (2025)
di: Fort, Stanislav
Pubblicazione: (2025)
LongCoT: Benchmarking Long-Horizon Chain-of-Thought Reasoning
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
Transformers Can Do Arithmetic with the Right Embeddings
di: McLeish, Sean, et al.
Pubblicazione: (2024)
di: McLeish, Sean, et al.
Pubblicazione: (2024)
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
di: McLeish, Sean, et al.
Pubblicazione: (2025)
di: McLeish, Sean, et al.
Pubblicazione: (2025)
FedCluster: Boosting the Convergence of Federated Learning via Cluster-Cycling
di: Chen, Cheng, et al.
Pubblicazione: (2020)
di: Chen, Cheng, et al.
Pubblicazione: (2020)
Training Dynamics of Transformers to Recognize Word Co-occurrence via Gradient Flow Analysis
di: Yang, Hongru, et al.
Pubblicazione: (2024)
di: Yang, Hongru, et al.
Pubblicazione: (2024)
Mixture of Robust Experts (MoRE):A Robust Denoising Method towards multiple perturbations
di: Cheng, Hao, et al.
Pubblicazione: (2021)
di: Cheng, Hao, et al.
Pubblicazione: (2021)
Recursive Self-Aggregation Unlocks Deep Thinking in Large Language Models
di: Venkatraman, Siddarth, et al.
Pubblicazione: (2025)
di: Venkatraman, Siddarth, et al.
Pubblicazione: (2025)
Ensemble everything everywhere: Multi-scale aggregation for adversarial robustness
di: Fort, Stanislav, et al.
Pubblicazione: (2024)
di: Fort, Stanislav, et al.
Pubblicazione: (2024)
End-to-End Mesh Optimization of a Hybrid Deep Learning Black-Box PDE Solver
di: Ma, Shaocong, et al.
Pubblicazione: (2024)
di: Ma, Shaocong, et al.
Pubblicazione: (2024)
Trading Inference-Time Compute for Adversarial Robustness
di: Zaremba, Wojciech, et al.
Pubblicazione: (2025)
di: Zaremba, Wojciech, et al.
Pubblicazione: (2025)
Forecasting Fails: Unveiling Evasion Attacks in Weather Prediction Models
di: Arif, Huzaifa, et al.
Pubblicazione: (2025)
di: Arif, Huzaifa, et al.
Pubblicazione: (2025)
A Comedy of Estimators: On KL Regularization in RL Training of LLMs
di: Shah, Vedant, et al.
Pubblicazione: (2025)
di: Shah, Vedant, et al.
Pubblicazione: (2025)
Constrained Discrete Diffusion
di: Cardei, Michael, et al.
Pubblicazione: (2025)
di: Cardei, Michael, et al.
Pubblicazione: (2025)
ProtAlign: Contrastive learning paradigm for Sequence and structure alignment
di: Ranganath, Aditya, et al.
Pubblicazione: (2026)
di: Ranganath, Aditya, et al.
Pubblicazione: (2026)
LLM Unlearning Reveals a Stronger-Than-Expected Coreset Effect in Current Benchmarks
di: Pal, Soumyadeep, et al.
Pubblicazione: (2025)
di: Pal, Soumyadeep, et al.
Pubblicazione: (2025)
DeepZero: Scaling up Zeroth-Order Optimization for Deep Model Training
di: Chen, Aochuan, et al.
Pubblicazione: (2023)
di: Chen, Aochuan, et al.
Pubblicazione: (2023)
Solving adversarial examples requires solving exponential misalignment
di: Salvatore, Alessandro, et al.
Pubblicazione: (2026)
di: Salvatore, Alessandro, et al.
Pubblicazione: (2026)
UProp: Investigating the Uncertainty Propagation of LLMs in Multi-Step Agentic Decision-Making
di: Duan, Jinhao, et al.
Pubblicazione: (2025)
di: Duan, Jinhao, et al.
Pubblicazione: (2025)
Low-rank finetuning for LLMs: A fairness perspective
di: Das, Saswat, et al.
Pubblicazione: (2024)
di: Das, Saswat, et al.
Pubblicazione: (2024)
Near Optimal Decision Trees in a SPLIT Second
di: Babbar, Varun, et al.
Pubblicazione: (2025)
di: Babbar, Varun, et al.
Pubblicazione: (2025)
Interpretable Generalized Additive Models for Datasets with Missing Values
di: McTavish, Hayden, et al.
Pubblicazione: (2024)
di: McTavish, Hayden, et al.
Pubblicazione: (2024)
floq: Training Critics via Flow-Matching for Scaling Compute in Value-Based RL
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2025)
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2025)
A Bayesian Approach to Robust Inverse Reinforcement Learning
di: Wei, Ran, et al.
Pubblicazione: (2023)
di: Wei, Ran, et al.
Pubblicazione: (2023)
Deep Latent Force Models: ODE-based Process Convolutions for Bayesian Deep Learning
di: Baldwin-McDonald, Thomas, et al.
Pubblicazione: (2023)
di: Baldwin-McDonald, Thomas, et al.
Pubblicazione: (2023)
StockBench: Can LLM Agents Trade Stocks Profitably In Real-world Markets?
di: Chen, Yanxu, et al.
Pubblicazione: (2025)
di: Chen, Yanxu, et al.
Pubblicazione: (2025)
Log-Concave Coupling for Sampling Neural Net Posteriors
di: McDonald, Curtis, et al.
Pubblicazione: (2024)
di: McDonald, Curtis, et al.
Pubblicazione: (2024)
Robot Arm Control via Cognitive Map Learners
di: McDonald, Nathan, et al.
Pubblicazione: (2026)
di: McDonald, Nathan, et al.
Pubblicazione: (2026)
Active Learning Enables Extrapolation in Molecular Generative Models
di: Antoniuk, Evan R., et al.
Pubblicazione: (2025)
di: Antoniuk, Evan R., et al.
Pubblicazione: (2025)
Leveraging Hierarchical Feature Sharing for Efficient Dataset Condensation
di: Zheng, Haizhong, et al.
Pubblicazione: (2023)
di: Zheng, Haizhong, et al.
Pubblicazione: (2023)
GRNFormer: A Biologically-Guided Framework for Integrating Gene Regulatory Networks into RNA Foundation Models
di: Qiu, Mufan, et al.
Pubblicazione: (2025)
di: Qiu, Mufan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adversarial Robustness Limits via Scaling-Law and Human-Alignment Studies
di: Bartoldson, Brian R., et al.
Pubblicazione: (2024) -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
di: Geiping, Jonas, et al.
Pubblicazione: (2025) -
AegisLLM: Scaling Agentic Systems for Self-Reflective Defense in LLM Security
di: Cai, Zikui, et al.
Pubblicazione: (2025) -
Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts
di: Zheng, Haizhong, et al.
Pubblicazione: (2025) -
Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion
di: Christopher, Jacob K, et al.
Pubblicazione: (2024)