Enregistré dans:
| Auteurs principaux: | Hosseini, Ryien, Simini, Filippo, Vishwanath, Venkatram, Willett, Rebecca, Hoffmann, Henry |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.01720 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sketch-Augmented Features Improve Learning Long-Range Dependencies in Graph Neural Networks
par: Hosseini, Ryien, et autres
Publié: (2025)
par: Hosseini, Ryien, et autres
Publié: (2025)
A Deep Probabilistic Framework for Continuous Time Dynamic Graph Generation
par: Hosseini, Ryien, et autres
Publié: (2024)
par: Hosseini, Ryien, et autres
Publié: (2024)
Observation, Not Prediction: Conversation-Level Disaggregated Scheduling for Agentic Serving
par: Ding, Jianru, et autres
Publié: (2026)
par: Ding, Jianru, et autres
Publié: (2026)
LExI: Layer-Adaptive Active Experts for Efficient MoE Model Inference
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
Extending $μ$P: Spectral Conditions for Feature Learning Across Optimizers
par: Gupta, Akshita, et autres
Publié: (2026)
par: Gupta, Akshita, et autres
Publié: (2026)
Swimba: Switch Mamba Model Scales State Space Models
par: Du, Zhixu, et autres
Publié: (2026)
par: Du, Zhixu, et autres
Publié: (2026)
Scalable and Consistent Graph Neural Networks for Distributed Mesh-based Data-driven Modeling
par: Barwey, Shivam, et autres
Publié: (2024)
par: Barwey, Shivam, et autres
Publié: (2024)
ReLU Neural Networks with Linear Layers are Biased Towards Single- and Multi-Index Models
par: Parkinson, Suzanna, et autres
Publié: (2023)
par: Parkinson, Suzanna, et autres
Publié: (2023)
PreLoRA: Hybrid Pre-training of Vision Transformers with Full Training and Low-Rank Adapters
par: Thapa, Krishu K, et autres
Publié: (2025)
par: Thapa, Krishu K, et autres
Publié: (2025)
BaKlaVa -- Budgeted Allocation of KV cache for Long-context Inference
par: Gulhan, Ahmed Burak, et autres
Publié: (2025)
par: Gulhan, Ahmed Burak, et autres
Publié: (2025)
PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
Mesh-based Super-Resolution of Fluid Flows with Multiscale Graph Neural Networks
par: Barwey, Shivam, et autres
Publié: (2024)
par: Barwey, Shivam, et autres
Publié: (2024)
MoE-Inference-Bench: Performance Evaluation of Mixture of Expert Large Language and Vision Models
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
How do simple rotations affect the implicit bias of Adam?
par: DePavia, Adela, et autres
Publié: (2025)
par: DePavia, Adela, et autres
Publié: (2025)
Embed and Emulate: Contrastive representations for simulation-based inference
par: Jiang, Ruoxi, et autres
Publié: (2024)
par: Jiang, Ruoxi, et autres
Publié: (2024)
LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2024)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2024)
Integrating Uncertainty Awareness into Conformalized Quantile Regression
par: Rossellini, Raphael, et autres
Publié: (2023)
par: Rossellini, Raphael, et autres
Publié: (2023)
Stabilizing black-box model selection with the inflated argmax
par: Adrian, Melissa, et autres
Publié: (2024)
par: Adrian, Melissa, et autres
Publié: (2024)
Data Assimilation with Machine Learning Surrogate Models: A Case Study with FourCastNet
par: Adrian, Melissa, et autres
Publié: (2024)
par: Adrian, Melissa, et autres
Publié: (2024)
Auto-differentiable data assimilation: Co-learning of states, dynamics, and filtering algorithms
par: Adrian, Melissa, et autres
Publié: (2026)
par: Adrian, Melissa, et autres
Publié: (2026)
Building a stable classifier with the inflated argmax
par: Soloff, Jake A., et autres
Publié: (2024)
par: Soloff, Jake A., et autres
Publié: (2024)
Bagging Provides Assumption-free Stability
par: Soloff, Jake A., et autres
Publié: (2023)
par: Soloff, Jake A., et autres
Publié: (2023)
Depth Separation in Norm-Bounded Infinite-Width Neural Networks
par: Parkinson, Suzanna, et autres
Publié: (2024)
par: Parkinson, Suzanna, et autres
Publié: (2024)
Learning Paths for Dynamic Measure Transport: A Control Perspective
par: Maurais, Aimee, et autres
Publié: (2025)
par: Maurais, Aimee, et autres
Publié: (2025)
Training neural operators to preserve invariant measures of chaotic attractors
par: Jiang, Ruoxi, et autres
Publié: (2023)
par: Jiang, Ruoxi, et autres
Publié: (2023)
Beyond Ensemble Averages: Leveraging Climate Model Ensembles for Subseasonal Forecasting
par: Orlova, Elena, et autres
Publié: (2022)
par: Orlova, Elena, et autres
Publié: (2022)
A Model-Guided Neural Network Method for the Inverse Scattering Problem
par: Tsang, Olivia, et autres
Publié: (2025)
par: Tsang, Olivia, et autres
Publié: (2025)
Solving Inverse Problems with Deep Linear Neural Networks: Global Convergence Guarantees for Gradient Descent with Weight Decay
par: Laus, Hannah, et autres
Publié: (2025)
par: Laus, Hannah, et autres
Publié: (2025)
Accelerating PDE Surrogates via RL-Guided Mesh Optimization
par: Meng, Yang, et autres
Publié: (2026)
par: Meng, Yang, et autres
Publié: (2026)
Assumption-free stability for ranking problems
par: Liang, Ruiting, et autres
Publié: (2025)
par: Liang, Ruiting, et autres
Publié: (2025)
Mean-Field Langevin Dynamics for Signed Measures via a Bilevel Approach
par: Wang, Guillaume, et autres
Publié: (2024)
par: Wang, Guillaume, et autres
Publié: (2024)
Deep Stochastic Mechanics
par: Orlova, Elena, et autres
Publié: (2023)
par: Orlova, Elena, et autres
Publié: (2023)
Can a calibration metric be both testable and actionable?
par: Rossellini, Raphael, et autres
Publié: (2025)
par: Rossellini, Raphael, et autres
Publié: (2025)
Minimax Rates for Hyperbolic Hierarchical Learning
par: Rawal, Divit, et autres
Publié: (2026)
par: Rawal, Divit, et autres
Publié: (2026)
A Generalized Tikhonov Layer for Interpretable-by-design Graph Neural Networks
par: Tremblay, Nicolas, et autres
Publié: (2026)
par: Tremblay, Nicolas, et autres
Publié: (2026)
Discount Model Search for Quality Diversity Optimization in High-Dimensional Measure Spaces
par: Tjanaka, Bryon, et autres
Publié: (2026)
par: Tjanaka, Bryon, et autres
Publié: (2026)
Statistical Guarantees in Synthetic Data through Conformal Adversarial Generation
par: Vishwakarma, Rahul, et autres
Publié: (2025)
par: Vishwakarma, Rahul, et autres
Publié: (2025)
Hierarchical Implicit Neural Emulators
par: Jiang, Ruoxi, et autres
Publié: (2025)
par: Jiang, Ruoxi, et autres
Publié: (2025)
Comparing Methods for Bias Mitigation in Graph Neural Networks
par: Hoffmann, Barbara, et autres
Publié: (2025)
par: Hoffmann, Barbara, et autres
Publié: (2025)
Certified Guidance for Planning with Deep Generative Models
par: Giacomarra, Francesco, et autres
Publié: (2025)
par: Giacomarra, Francesco, et autres
Publié: (2025)
Documents similaires
-
Sketch-Augmented Features Improve Learning Long-Range Dependencies in Graph Neural Networks
par: Hosseini, Ryien, et autres
Publié: (2025) -
A Deep Probabilistic Framework for Continuous Time Dynamic Graph Generation
par: Hosseini, Ryien, et autres
Publié: (2024) -
Observation, Not Prediction: Conversation-Level Disaggregated Scheduling for Agentic Serving
par: Ding, Jianru, et autres
Publié: (2026) -
LExI: Layer-Adaptive Active Experts for Efficient MoE Model Inference
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025) -
Extending $μ$P: Spectral Conditions for Feature Learning Across Optimizers
par: Gupta, Akshita, et autres
Publié: (2026)