Latent Action Reparameterization for Efficient Agent Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Wenhao, Zeng, Qingwen, Chen, Qiyue, Guo, Zijie, Sun, Yu, Yang, Cheng, Ouyang, Siru, Gesi, Jiri, Wu, Fang, Zhang, Jiayi, Chen, Huaming, Liu, Bang, Tang, Xiangru, Wu, Chenglin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
M-$LLM^3$REC: A Motivation-Aware User-Item Interaction Framework for Enhancing Recommendation Accuracy with LLMs
par: Chen, Lining, et autres
Publié: (2025)
par: Chen, Lining, et autres
Publié: (2025)
Beyond Self-learned Attention: Mitigating Attention Bias in Transformer-based Models Using Attention Guidance
par: Gesi, Jiri, et autres
Publié: (2024)
par: Gesi, Jiri, et autres
Publié: (2024)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
par: Tang, Xiangru, et autres
Publié: (2025)
par: Tang, Xiangru, et autres
Publié: (2025)
InfoPO: Information-Driven Policy Optimization for User-Centric Agents
par: Kong, Fanqi, et autres
Publié: (2026)
par: Kong, Fanqi, et autres
Publié: (2026)
Foe for Fraud: Transferable Adversarial Attacks in Credit Card Fraud Detection
par: Fok, Jan Lum, et autres
Publié: (2025)
par: Fok, Jan Lum, et autres
Publié: (2025)
NSW-EPNews: A News-Augmented Benchmark for Electricity Price Forecasting with LLMs
par: Bi, Zhaoge, et autres
Publié: (2025)
par: Bi, Zhaoge, et autres
Publié: (2025)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
par: Zhang, Jiayi, et autres
Publié: (2025)
par: Zhang, Jiayi, et autres
Publié: (2025)
Multi-Agent-as-Judge: Aligning LLM-Agent-Based Automated Evaluation with Multi-Dimensional Human Evaluation
par: Chen, Jiaju, et autres
Publié: (2025)
par: Chen, Jiaju, et autres
Publié: (2025)
Agent-ScanKit: Unraveling Memory and Reasoning of Multimodal Agents via Sensitivity Perturbations
par: Cheng, Pengzhou, et autres
Publié: (2025)
par: Cheng, Pengzhou, et autres
Publié: (2025)
Importance Weighted Variational Inference without the Reparameterization Trick
par: Daudel, Kamélia, et autres
Publié: (2026)
par: Daudel, Kamélia, et autres
Publié: (2026)
ReCode: Unify Plan and Action for Universal Granularity Control
par: Yu, Zhaoyang, et autres
Publié: (2025)
par: Yu, Zhaoyang, et autres
Publié: (2025)
LocAgent: Graph-Guided LLM Agents for Code Localization
par: Chen, Zhaoling, et autres
Publié: (2025)
par: Chen, Zhaoling, et autres
Publié: (2025)
Human-aligned AI Model Cards with Weighted Hierarchy Architecture
par: Yang, Pengyue, et autres
Publié: (2025)
par: Yang, Pengyue, et autres
Publié: (2025)
AutoWebWorld: Synthesizing Infinite Verifiable Web Environments via Finite State Machines
par: Wu, Yifan, et autres
Publié: (2026)
par: Wu, Yifan, et autres
Publié: (2026)
KANDU-Net:A Dual-Channel U-Net with KAN for Medical Image Segmentation
par: Fang, Chenglin, et autres
Publié: (2024)
par: Fang, Chenglin, et autres
Publié: (2024)
Improving Context Fidelity via Native Retrieval-Augmented Reasoning
par: Wang, Suyuchen, et autres
Publié: (2025)
par: Wang, Suyuchen, et autres
Publié: (2025)
TinyIO: Lightweight Reparameterized Inertial Odometry
par: Zhang, Shanshan, et autres
Publié: (2025)
par: Zhang, Shanshan, et autres
Publié: (2025)
Scalable Environments Drive Generalizable Agents
par: Zhang, Jiayi, et autres
Publié: (2026)
par: Zhang, Jiayi, et autres
Publié: (2026)
Towards Robustness Analysis of E-Commerce Ranking System
par: Wang, Ningfei, et autres
Publié: (2024)
par: Wang, Ningfei, et autres
Publié: (2024)
Performative Prediction with Bandit Feedback: Learning through Reparameterization
par: Chen, Yatong, et autres
Publié: (2023)
par: Chen, Yatong, et autres
Publié: (2023)
ChemAgent: Self-updating Library in Large Language Models Improves Chemical Reasoning
par: Tang, Xiangru, et autres
Publié: (2025)
par: Tang, Xiangru, et autres
Publié: (2025)
DiLA: Disentangled Latent Action World Models
par: Zhang, Tianqiu, et autres
Publié: (2026)
par: Zhang, Tianqiu, et autres
Publié: (2026)
Decocted Experience Improves Test-Time Inference in LLM Agents
par: Shen, Maohao, et autres
Publié: (2026)
par: Shen, Maohao, et autres
Publié: (2026)
AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration
par: Ruan, Jianhao, et autres
Publié: (2026)
par: Ruan, Jianhao, et autres
Publié: (2026)
LLM Agent Meets Agentic AI: Can LLM Agents Simulate Customers to Evaluate Agentic-AI-based Shopping Assistants?
par: Sun, Lu, et autres
Publié: (2025)
par: Sun, Lu, et autres
Publié: (2025)
Jupiter: Fast and Resource-Efficient Collaborative Inference of Generative LLMs on Edge Devices
par: Ye, Shengyuan, et autres
Publié: (2025)
par: Ye, Shengyuan, et autres
Publié: (2025)
Latent Bridge: Feature Delta Prediction for Efficient Dual-System Vision-Language-Action Model Inference
par: Liu, Yudong, et autres
Publié: (2026)
par: Liu, Yudong, et autres
Publié: (2026)
Post-Training Quantization for Vision Mamba with k-Scaled Quantization and Reparameterization
par: Shi, Bo-Yun, et autres
Publié: (2025)
par: Shi, Bo-Yun, et autres
Publié: (2025)
Co-Evolution of Policy and Internal Reward for Language Agents
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
De-Linearizing Agent Traces: Bayesian Inference of Latent Partial Orders for Efficient Execution
par: Li, Dongqing, et autres
Publié: (2026)
par: Li, Dongqing, et autres
Publié: (2026)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
par: Jin, Haolin, et autres
Publié: (2024)
par: Jin, Haolin, et autres
Publié: (2024)
Stein's Lemma for the Reparameterization Trick with Exponential Family Mixtures
par: Lin, Wu, et autres
Publié: (2019)
par: Lin, Wu, et autres
Publié: (2019)
Engineering Carbon Credits Towards A Responsible FinTech Era: The Practices, Implications, and Future
par: Zeng, Qingwen, et autres
Publié: (2024)
par: Zeng, Qingwen, et autres
Publié: (2024)
Neural BRDF Importance Sampling by Reparameterization
par: Wu, Liwen, et autres
Publié: (2025)
par: Wu, Liwen, et autres
Publié: (2025)
Does the Order of Fine-tuning Matter and Why?
par: Chen, Qihong, et autres
Publié: (2024)
par: Chen, Qihong, et autres
Publié: (2024)
RepNeXt: A Fast Multi-Scale CNN using Structural Reparameterization
par: Zhao, Mingshu, et autres
Publié: (2024)
par: Zhao, Mingshu, et autres
Publié: (2024)
StepOPSD: Step-Aware Online Preference Distillation for Agent Reinforcement Learning
par: Zhang, Yanfei, et autres
Publié: (2026)
par: Zhang, Yanfei, et autres
Publié: (2026)
Self-Supervised Prompt Optimization
par: Xiang, Jinyu, et autres
Publié: (2025)
par: Xiang, Jinyu, et autres
Publié: (2025)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
par: Ouyang, Siru, et autres
Publié: (2025)
par: Ouyang, Siru, et autres
Publié: (2025)
Deciphering Neural Reparameterized Full-Waveform Inversion with Neural Sensitivity Kernel and Wave Tangent Kernel
par: Chen, Ruihua, et autres
Publié: (2026)
par: Chen, Ruihua, et autres
Publié: (2026)
Documents similaires
-
M-$LLM^3$REC: A Motivation-Aware User-Item Interaction Framework for Enhancing Recommendation Accuracy with LLMs
par: Chen, Lining, et autres
Publié: (2025) -
Beyond Self-learned Attention: Mitigating Attention Bias in Transformer-based Models Using Attention Guidance
par: Gesi, Jiri, et autres
Publié: (2024) -
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
par: Tang, Xiangru, et autres
Publié: (2025) -
InfoPO: Information-Driven Policy Optimization for User-Centric Agents
par: Kong, Fanqi, et autres
Publié: (2026) -
Foe for Fraud: Transferable Adversarial Attacks in Credit Card Fraud Detection
par: Fok, Jan Lum, et autres
Publié: (2025)