Adaptive Action Chunking via Multi-Chunk Q Value Estimation
Fuente:
arXiv
Salvato in:
| Autori principali: | Shin, Yongjae, Chae, Jongseong, Kim, Seongmin, Park, Jongeui, Sung, Youngchul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
Decoupled Q-Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
Chunk-Guided Q-Learning
di: Song, Gwanwoo, et al.
Pubblicazione: (2026)
di: Song, Gwanwoo, et al.
Pubblicazione: (2026)
Scalable Offline Model-Based RL with Action Chunks
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
Reinforcement Learning with Action Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
di: Park, Giseung, et al.
Pubblicazione: (2024)
di: Park, Giseung, et al.
Pubblicazione: (2024)
Understanding Multimodal Failure in Action-Chunking Behavioral Cloning
di: Mazza, Lorenzo, et al.
Pubblicazione: (2026)
di: Mazza, Lorenzo, et al.
Pubblicazione: (2026)
Real-Time Execution of Action Chunking Flow Policies
di: Black, Kevin, et al.
Pubblicazione: (2025)
di: Black, Kevin, et al.
Pubblicazione: (2025)
Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
Chunking Strategies for Multimodal AI Systems
di: R, Shashanka B, et al.
Pubblicazione: (2025)
di: R, Shashanka B, et al.
Pubblicazione: (2025)
Discovering Chunks in Neural Embeddings for Interpretability
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
Training Long-Context LLMs Efficiently via Chunk-wise Optimization
di: Li, Wenhao, et al.
Pubblicazione: (2025)
di: Li, Wenhao, et al.
Pubblicazione: (2025)
ExACT: An End-to-End Autonomous Excavator System Using Action Chunking With Transformers
di: Chen, Liangliang, et al.
Pubblicazione: (2024)
di: Chen, Liangliang, et al.
Pubblicazione: (2024)
Temporal Chunking Enhances Recognition of Implicit Sequential Patterns
di: Dey, Jayanta, et al.
Pubblicazione: (2025)
di: Dey, Jayanta, et al.
Pubblicazione: (2025)
SmartChunk Retrieval: Query-Aware Chunk Compression with Planning for Efficient Document RAG
di: Zhang, Xuechen, et al.
Pubblicazione: (2025)
di: Zhang, Xuechen, et al.
Pubblicazione: (2025)
Concept-Guided Interpretability via Neural Chunking
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
Soft-NBCE: Entropy-Weighted Chunk Fusion for Long-Context
di: Ji, Shihao, et al.
Pubblicazione: (2026)
di: Ji, Shihao, et al.
Pubblicazione: (2026)
DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking
di: Haridas, Akash, et al.
Pubblicazione: (2026)
di: Haridas, Akash, et al.
Pubblicazione: (2026)
The Chronicles of RAG: The Retriever, the Chunk and the Generator
di: Finardi, Paulo, et al.
Pubblicazione: (2024)
di: Finardi, Paulo, et al.
Pubblicazione: (2024)
Cognitive Chunking for Soft Prompts: Accelerating Compressor Learning via Block-wise Causal Masking
di: Liu, Guojie, et al.
Pubblicazione: (2026)
di: Liu, Guojie, et al.
Pubblicazione: (2026)
MeLeMaD: Adaptive Malware Detection via Chunk-wise Feature Selection and Meta-Learning
di: K, Ajvad Haneef, et al.
Pubblicazione: (2025)
di: K, Ajvad Haneef, et al.
Pubblicazione: (2025)
Mix-of-Granularity: Optimize the Chunking Granularity for Retrieval-Augmented Generation
di: Zhong, Zijie, et al.
Pubblicazione: (2024)
di: Zhong, Zijie, et al.
Pubblicazione: (2024)
VLM in a flash: I/O-Efficient Sparsification of Vision-Language Model via Neuron Chunking
di: Yang, Kichang, et al.
Pubblicazione: (2025)
di: Yang, Kichang, et al.
Pubblicazione: (2025)
Online Pre-Training for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
LoopUS: Recasting Pretrained LLMs into Looped Latent Refinement Models
di: Park, Taekhyun, et al.
Pubblicazione: (2026)
di: Park, Taekhyun, et al.
Pubblicazione: (2026)
WAY: Estimation of Vessel Destination in Worldwide AIS Trajectory
di: Kim, Jin Sob, et al.
Pubblicazione: (2025)
di: Kim, Jin Sob, et al.
Pubblicazione: (2025)
Adaptive Chunking: Optimizing Chunking-Method Selection for RAG
di: Júnior, Paulo Roberto de Moura, et al.
Pubblicazione: (2026)
di: Júnior, Paulo Roberto de Moura, et al.
Pubblicazione: (2026)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
Vision-Guided Chunking Is All You Need: Enhancing RAG with Multimodal Document Understanding
di: Tripathi, Vishesh, et al.
Pubblicazione: (2025)
di: Tripathi, Vishesh, et al.
Pubblicazione: (2025)
Graph Signal Processing Meets Mamba2: Adaptive Filter Bank via Delta Modulation
di: Shin, Yehjin, et al.
Pubblicazione: (2026)
di: Shin, Yehjin, et al.
Pubblicazione: (2026)
CAFE-GB: Scalable and Stable Feature Selection for Malware Detection via Chunk-wise Aggregated Gradient Boosting
di: K, Ajvad Haneef, et al.
Pubblicazione: (2026)
di: K, Ajvad Haneef, et al.
Pubblicazione: (2026)
Distributionally Robust Classification for Multi-source Unsupervised Domain Adaptation
di: Kim, Seonghwi, et al.
Pubblicazione: (2026)
di: Kim, Seonghwi, et al.
Pubblicazione: (2026)
LycheeCluster: Efficient Long-Context Inference with Structure-Aware Chunking and Hierarchical KV Indexing
di: Li, Dongfang, et al.
Pubblicazione: (2026)
di: Li, Dongfang, et al.
Pubblicazione: (2026)
JustDense: Just using Dense instead of Sequence Mixer for Time Series analysis
di: Park, TaekHyun, et al.
Pubblicazione: (2025)
di: Park, TaekHyun, et al.
Pubblicazione: (2025)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
di: Park, Giseung, et al.
Pubblicazione: (2025)
di: Park, Giseung, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026) -
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026) -
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025) -
Decoupled Q-Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025) -
Chunk-Guided Q-Learning
di: Song, Gwanwoo, et al.
Pubblicazione: (2026)