Resource-efficient Inference with Foundation Model Programs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nie, Lunyiu, Ding, Zhimin, Yu, Kevin, Cheung, Marco, Jermaine, Chris, Chaudhuri, Swarat |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Online Cascade Learning for Efficient Inference over Streams
par: Nie, Lunyiu, et autres
Publié: (2024)
par: Nie, Lunyiu, et autres
Publié: (2024)
Prompt Tuning Strikes Back: Customizing Foundation Models with Low-Rank Prompt Adaptation
par: Jain, Abhinav, et autres
Publié: (2024)
par: Jain, Abhinav, et autres
Publié: (2024)
When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding
par: Yang, Xu, et autres
Publié: (2026)
par: Yang, Xu, et autres
Publié: (2026)
Synthesize, Partition, then Adapt: Eliciting Diverse Samples from Foundation Models
par: Wen, Yeming, et autres
Publié: (2024)
par: Wen, Yeming, et autres
Publié: (2024)
Batched Low-Rank Adaptation of Foundation Models
par: Wen, Yeming, et autres
Publié: (2023)
par: Wen, Yeming, et autres
Publié: (2023)
Efficient Tree-Structured Deep Research with Adaptive Resource Allocation
par: Nie, Lunyiu, et autres
Publié: (2025)
par: Nie, Lunyiu, et autres
Publié: (2025)
Automata Learning from Preference and Equivalence Queries
par: Hsiung, Eric, et autres
Publié: (2023)
par: Hsiung, Eric, et autres
Publié: (2023)
A Probabilistic Framework for Modular Continual Learning
par: Valkov, Lazar, et autres
Publié: (2023)
par: Valkov, Lazar, et autres
Publié: (2023)
Neurosymbolic Grounding for Compositional World Models
par: Sehgal, Atharva, et autres
Publié: (2023)
par: Sehgal, Atharva, et autres
Publié: (2023)
Learning Quantitative Automata Modulo Theories
par: Hsiung, Eric, et autres
Publié: (2024)
par: Hsiung, Eric, et autres
Publié: (2024)
Auditing Information Disclosure During LLM-Scale Gradient Descent Using Gradient Uniqueness
par: Abdelghafar, Sleem, et autres
Publié: (2025)
par: Abdelghafar, Sleem, et autres
Publié: (2025)
RAG-Modulo: Solving Sequential Tasks using Experience, Critics, and Language Models
par: Jain, Abhinav, et autres
Publié: (2024)
par: Jain, Abhinav, et autres
Publié: (2024)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
par: Thakur, Amitayush, et autres
Publié: (2025)
par: Thakur, Amitayush, et autres
Publié: (2025)
DOPPLER: Dual-Policy Learning for Device Assignment in Asynchronous Dataflow Graphs
par: Yao, Xinyu, et autres
Publié: (2025)
par: Yao, Xinyu, et autres
Publié: (2025)
SIMCOPILOT: Evaluating Large Language Models for Copilot-Style Code Generation
par: Jiang, Mingchao, et autres
Publié: (2025)
par: Jiang, Mingchao, et autres
Publié: (2025)
SWE-Arena: An Interactive Platform for Evaluating Foundation Models in Software Engineering
par: Zhao, Zhimin
Publié: (2025)
par: Zhao, Zhimin
Publié: (2025)
TrojFM: Resource-efficient Backdoor Attacks against Very Large Foundation Models
par: Nie, Yuzhou., et autres
Publié: (2024)
par: Nie, Yuzhou., et autres
Publié: (2024)
Lean Finder: Semantic Search for Mathlib That Understands User Intents
par: Lu, Jialin, et autres
Publié: (2025)
par: Lu, Jialin, et autres
Publié: (2025)
Are More Tokens Rational? Inference-Time Scaling in Language Models as Adaptive Resource Rationality
par: Hu, Zhimin, et autres
Publié: (2026)
par: Hu, Zhimin, et autres
Publié: (2026)
Optimistic Task Inference for Behavior Foundation Models
par: Rupf, Thomas, et autres
Publié: (2025)
par: Rupf, Thomas, et autres
Publié: (2025)
Canopy: Property-Driven Learning for Congestion Control
par: Yang, Chenxi, et autres
Publié: (2024)
par: Yang, Chenxi, et autres
Publié: (2024)
An In-Context Learning Agent for Formal Theorem-Proving
par: Thakur, Amitayush, et autres
Publié: (2023)
par: Thakur, Amitayush, et autres
Publié: (2023)
Grounding Data Science Code Generation with Input-Output Specifications
par: Wen, Yeming, et autres
Publié: (2024)
par: Wen, Yeming, et autres
Publié: (2024)
Man-Made Heuristics Are Dead. Long Live Code Generators!
par: Dwivedula, Rohit, et autres
Publié: (2025)
par: Dwivedula, Rohit, et autres
Publié: (2025)
Symbolic Regression with a Learned Concept Library
par: Grayeli, Arya, et autres
Publié: (2024)
par: Grayeli, Arya, et autres
Publié: (2024)
Self-Evolving Visual Concept Library using Vision-Language Critics
par: Sehgal, Atharva, et autres
Publié: (2025)
par: Sehgal, Atharva, et autres
Publié: (2025)
A Survey of Resource-efficient LLM and Multimodal Foundation Models
par: Xu, Mengwei, et autres
Publié: (2024)
par: Xu, Mengwei, et autres
Publié: (2024)
Better Membership Inference Privacy Measurement through Discrepancy
par: Wu, Ruihan, et autres
Publié: (2024)
par: Wu, Ruihan, et autres
Publié: (2024)
Formal Mathematical Reasoning: A New Frontier in AI
par: Yang, Kaiyu, et autres
Publié: (2024)
par: Yang, Kaiyu, et autres
Publié: (2024)
Best Arm Identification with Resource Constraints
par: Li, Zitian, et autres
Publié: (2024)
par: Li, Zitian, et autres
Publié: (2024)
Foundation Inference Models for Ordinary Differential Equations
par: Mauel, Maximilian, et autres
Publié: (2026)
par: Mauel, Maximilian, et autres
Publié: (2026)
Foundation Inference Models for Markov Jump Processes
par: Berghaus, David, et autres
Publié: (2024)
par: Berghaus, David, et autres
Publié: (2024)
PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition
par: Tsoukalas, George, et autres
Publié: (2024)
par: Tsoukalas, George, et autres
Publié: (2024)
GraphProp: Training the Graph Foundation Models using Graph Properties
par: Sun, Ziheng, et autres
Publié: (2025)
par: Sun, Ziheng, et autres
Publié: (2025)
Learning with a Budget: Identifying the Best Arm with Resource Constraints
par: Li, Zitian, et autres
Publié: (2026)
par: Li, Zitian, et autres
Publié: (2026)
Towards Foundation Inference Models that Learn ODEs In-Context
par: Mauel, Maximilian, et autres
Publié: (2025)
par: Mauel, Maximilian, et autres
Publié: (2025)
Towards Foundation Models for Mixed Integer Linear Programming
par: Li, Sirui, et autres
Publié: (2024)
par: Li, Sirui, et autres
Publié: (2024)
In-Context Learning of Temporal Point Processes with Foundation Inference Models
par: Berghaus, David, et autres
Publié: (2025)
par: Berghaus, David, et autres
Publié: (2025)
In-Context Learning of Stochastic Differential Equations with Foundation Inference Models
par: Seifner, Patrick, et autres
Publié: (2025)
par: Seifner, Patrick, et autres
Publié: (2025)
UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-adaptive Federated Fine-tuning of Foundation Models
par: Tran, Van-Tuan, et autres
Publié: (2026)
par: Tran, Van-Tuan, et autres
Publié: (2026)
Documents similaires
-
Online Cascade Learning for Efficient Inference over Streams
par: Nie, Lunyiu, et autres
Publié: (2024) -
Prompt Tuning Strikes Back: Customizing Foundation Models with Low-Rank Prompt Adaptation
par: Jain, Abhinav, et autres
Publié: (2024) -
When Parallelism Pays Off: Cohesion-Aware Task Partitioning for Multi-Agent Coding
par: Yang, Xu, et autres
Publié: (2026) -
Synthesize, Partition, then Adapt: Eliciting Diverse Samples from Foundation Models
par: Wen, Yeming, et autres
Publié: (2024) -
Batched Low-Rank Adaptation of Foundation Models
par: Wen, Yeming, et autres
Publié: (2023)