NanoFlux: Adversarial Dual-LLM Evaluation and Distillation For Multi-Domain Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Anantha, Raviteja, Hor, Soheil, Antoniu, Teodor Nicola, Price, Layne C. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BoostLoRA: Growing Effective Rank by Boosting Adapters
par: Anantha, Raviteja, et autres
Publié: (2026)
par: Anantha, Raviteja, et autres
Publié: (2026)
CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device
par: Fu, Yicheng, et autres
Publié: (2024)
par: Fu, Yicheng, et autres
Publié: (2024)
Adaptive Inference: Theoretical Limits and Unexplored Opportunities
par: Hor, Soheil, et autres
Publié: (2024)
par: Hor, Soheil, et autres
Publié: (2024)
UI-JEPA: Towards Active Perception of User Intent through Onscreen User Activity
par: Fu, Yicheng, et autres
Publié: (2024)
par: Fu, Yicheng, et autres
Publié: (2024)
Adversarial Dual On-Policy Distillation from Expressive Teacher
par: Wan, Zhenglin, et autres
Publié: (2026)
par: Wan, Zhenglin, et autres
Publié: (2026)
DSBD: Dual-Aligned Structural Basis Distillation for Graph Domain Adaptation
par: Wang, Yingxu, et autres
Publié: (2026)
par: Wang, Yingxu, et autres
Publié: (2026)
EnergyLens: Predictive Energy-Aware Exploration for Multi-GPU LLM Inference Optimization
par: Song, Zhiye, et autres
Publié: (2026)
par: Song, Zhiye, et autres
Publié: (2026)
Bandits in Flux: Adversarial Constraints in Dynamic Environments
par: Salem, Tareq Si
Publié: (2026)
par: Salem, Tareq Si
Publié: (2026)
ARGUS: Adaptive Rotation-Invariant Geometric Unsupervised System
par: Sharma, Anantha
Publié: (2026)
par: Sharma, Anantha
Publié: (2026)
PhaseNet++: Phase-Aware Frequency-Domain Anomaly Detection for Industrial Control Systems via Phase Coherence Graphs
par: Bommireddy, Raviteja, et autres
Publié: (2026)
par: Bommireddy, Raviteja, et autres
Publié: (2026)
No Single Metric Tells the Whole Story: A Multi-Dimensional Evaluation Framework for Uncertainty Attributions
par: Schiller, Emily, et autres
Publié: (2026)
par: Schiller, Emily, et autres
Publié: (2026)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
par: Yang, Ling, et autres
Publié: (2025)
par: Yang, Ling, et autres
Publié: (2025)
Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning
par: Liu, Qihao, et autres
Publié: (2025)
par: Liu, Qihao, et autres
Publié: (2025)
Reinforcement-aware Knowledge Distillation for LLM Reasoning
par: Zhang, Zhaoyang, et autres
Publié: (2026)
par: Zhang, Zhaoyang, et autres
Publié: (2026)
Certifying LLM Safety against Adversarial Prompting
par: Kumar, Aounon, et autres
Publié: (2023)
par: Kumar, Aounon, et autres
Publié: (2023)
Harmonizing Multi-Objective LLM Unlearning via Unified Domain Representation and Bidirectional Logit Distillation
par: Zhong, Yisheng, et autres
Publié: (2026)
par: Zhong, Yisheng, et autres
Publié: (2026)
DARD: Dice Adversarial Robustness Distillation against Adversarial Attacks
par: Zou, Jing, et autres
Publié: (2025)
par: Zou, Jing, et autres
Publié: (2025)
LEDRO: LLM-Enhanced Design Space Reduction and Optimization for Analog Circuits
par: Kochar, Dimple Vijay, et autres
Publié: (2024)
par: Kochar, Dimple Vijay, et autres
Publié: (2024)
Agentic-R1: Distilled Dual-Strategy Reasoning
par: Du, Weihua, et autres
Publié: (2025)
par: Du, Weihua, et autres
Publié: (2025)
Multi-Marginal Flow Matching with Adversarially Learnt Interpolants
par: Kviman, Oskar, et autres
Publié: (2025)
par: Kviman, Oskar, et autres
Publié: (2025)
Spectral Guarantees for Adversarial Streaming PCA
par: Price, Eric, et autres
Publié: (2024)
par: Price, Eric, et autres
Publié: (2024)
Dual-Phase LLM Reasoning: Self-Evolved Mathematical Frameworks
par: Liu, ShaoZhen, et autres
Publié: (2026)
par: Liu, ShaoZhen, et autres
Publié: (2026)
Adv-KD: Adversarial Knowledge Distillation for Faster Diffusion Sampling
par: Mekonnen, Kidist Amde, et autres
Publié: (2024)
par: Mekonnen, Kidist Amde, et autres
Publié: (2024)
Stochastic Adversarial Networks for Multi-Domain Text Classification
par: Wang, Xu, et autres
Publié: (2024)
par: Wang, Xu, et autres
Publié: (2024)
A Comprehensive Evaluation of LLM Reasoning: From Single-Model to Multi-Agent Paradigms
par: Li, Yapeng, et autres
Publié: (2026)
par: Li, Yapeng, et autres
Publié: (2026)
Self-playing Adversarial Language Game Enhances LLM Reasoning
par: Cheng, Pengyu, et autres
Publié: (2024)
par: Cheng, Pengyu, et autres
Publié: (2024)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
par: Zhao, Ziqi, et autres
Publié: (2026)
par: Zhao, Ziqi, et autres
Publié: (2026)
Multi-task Heterogeneous Graph Learning on Electronic Health Records
par: Chan, Tsai Hor, et autres
Publié: (2024)
par: Chan, Tsai Hor, et autres
Publié: (2024)
RePanda: Pandas-powered Tabular Verification and Reasoning
par: Chegini, Atoosa Malemir, et autres
Publié: (2025)
par: Chegini, Atoosa Malemir, et autres
Publié: (2025)
Scalable LLM Reasoning Acceleration with Low-rank Distillation
par: Dong, Harry, et autres
Publié: (2025)
par: Dong, Harry, et autres
Publié: (2025)
Off-the-Shelf LLMs as Process Scorers: Training-Free Alternative to PRMs for Mathematical Reasoning
par: Chegini, Atoosa, et autres
Publié: (2026)
par: Chegini, Atoosa, et autres
Publié: (2026)
DFDG: Data-Free Dual-Generator Adversarial Distillation for One-Shot Federated Learning
par: Luo, Kangyang, et autres
Publié: (2024)
par: Luo, Kangyang, et autres
Publié: (2024)
Semantic Anchors in In-Context Learning: Why Small LLMs Cannot Flip Their Labels
par: Kumar, Anantha Padmanaban Krishna
Publié: (2025)
par: Kumar, Anantha Padmanaban Krishna
Publié: (2025)
Deep learning model for ECG reconstruction reveals the information content of ECG leads
par: Gradowski, Tomasz, et autres
Publié: (2025)
par: Gradowski, Tomasz, et autres
Publié: (2025)
Foundational Automatic Evaluators: Scaling Multi-Task Generative Evaluator Training for Reasoning-Centric Domains
par: Xu, Austin, et autres
Publié: (2025)
par: Xu, Austin, et autres
Publié: (2025)
Interpretable Time Series Models for Wastewater Modeling in Combined Sewer Overflows
par: Chiaburu, Teodor, et autres
Publié: (2024)
par: Chiaburu, Teodor, et autres
Publié: (2024)
Restoring the Sweet Spot: Pass-Rate Weighted Self-Distillation for LLM Reasoning
par: Liu, Zehao, et autres
Publié: (2026)
par: Liu, Zehao, et autres
Publié: (2026)
Efficient LLM Context Distillation
par: Upadhayaya, Rajesh, et autres
Publié: (2024)
par: Upadhayaya, Rajesh, et autres
Publié: (2024)
Evaluating Time Series Models for Urban Wastewater Management: Predictive Performance, Model Complexity and Resilience
par: Singh, Vipin, et autres
Publié: (2025)
par: Singh, Vipin, et autres
Publié: (2025)
Beyond Correctness: Learning Robust Reasoning via Transfer
par: Lee, Hyunseok, et autres
Publié: (2026)
par: Lee, Hyunseok, et autres
Publié: (2026)
Documents similaires
-
BoostLoRA: Growing Effective Rank by Boosting Adapters
par: Anantha, Raviteja, et autres
Publié: (2026) -
CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device
par: Fu, Yicheng, et autres
Publié: (2024) -
Adaptive Inference: Theoretical Limits and Unexplored Opportunities
par: Hor, Soheil, et autres
Publié: (2024) -
UI-JEPA: Towards Active Perception of User Intent through Onscreen User Activity
par: Fu, Yicheng, et autres
Publié: (2024) -
Adversarial Dual On-Policy Distillation from Expressive Teacher
par: Wan, Zhenglin, et autres
Publié: (2026)