Latent Action Learning Requires Supervision in the Presence of Distractors
Fuente:
arXiv
Salvato in:
| Autori principali: | Nikulin, Alexander, Zisman, Ilya, Tarasov, Denis, Lyubaykin, Nikita, Polubarov, Andrei, Kiselev, Igor, Kurenkov, Vladislav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Object-Centric Latent Action Learning
di: Klepach, Albina, et al.
Pubblicazione: (2025)
di: Klepach, Albina, et al.
Pubblicazione: (2025)
Vision-Language Models Unlock Task-Centric Latent Actions
di: Nikulin, Alexander, et al.
Pubblicazione: (2026)
di: Nikulin, Alexander, et al.
Pubblicazione: (2026)
NinA: Normalizing Flows in Action. Training VLA Models with Normalizing Flows
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
Vintix: Action Model via In-Context Reinforcement Learning
di: Polubarov, Andrey, et al.
Pubblicazione: (2025)
di: Polubarov, Andrey, et al.
Pubblicazione: (2025)
Yes, Q-learning Helps Offline In-Context RL
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
N-Gram Induction Heads for In-Context RL: Improving Stability and Reducing Data Needs
di: Zisman, Ilya, et al.
Pubblicazione: (2024)
di: Zisman, Ilya, et al.
Pubblicazione: (2024)
cadrille: Multi-modal CAD Reconstruction with Reinforcement Learning
di: Kolodiazhnyi, Maksim, et al.
Pubblicazione: (2025)
di: Kolodiazhnyi, Maksim, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning for Variable Action Spaces
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
XLand-100B: A Large-Scale Multi-Task Dataset for In-Context Reinforcement Learning
di: Nikulin, Alexander, et al.
Pubblicazione: (2024)
di: Nikulin, Alexander, et al.
Pubblicazione: (2024)
Vintix II: Decision Pre-Trained Transformer is a Scalable In-Context Reinforcement Learner
di: Polubarov, Andrei, et al.
Pubblicazione: (2026)
di: Polubarov, Andrei, et al.
Pubblicazione: (2026)
Segment to Focus: Guiding Latent Action Models in the Presence of Distractors
di: Fechner, Marcus, et al.
Pubblicazione: (2026)
di: Fechner, Marcus, et al.
Pubblicazione: (2026)
ABRA: Agent Benchmark for Radiology Applications
di: Maksudov, Bulat, et al.
Pubblicazione: (2026)
di: Maksudov, Bulat, et al.
Pubblicazione: (2026)
Emergence of In-Context Reinforcement Learning from Noise Distillation
di: Zisman, Ilya, et al.
Pubblicazione: (2023)
di: Zisman, Ilya, et al.
Pubblicazione: (2023)
Zero-Shot Adaptation of Behavioral Foundation Models to Unseen Dynamics
di: Bobrin, Maksim, et al.
Pubblicazione: (2025)
di: Bobrin, Maksim, et al.
Pubblicazione: (2025)
XLand-MiniGrid: Scalable Meta-Reinforcement Learning Environments in JAX
di: Nikulin, Alexander, et al.
Pubblicazione: (2023)
di: Nikulin, Alexander, et al.
Pubblicazione: (2023)
Learning Latent Action World Models In The Wild
di: Garrido, Quentin, et al.
Pubblicazione: (2026)
di: Garrido, Quentin, et al.
Pubblicazione: (2026)
Learning Additively Compositional Latent Actions for Embodied AI
di: Wei, Hangxing, et al.
Pubblicazione: (2026)
di: Wei, Hangxing, et al.
Pubblicazione: (2026)
Robust 3D Gaussian Splatting for Novel View Synthesis in Presence of Distractors
di: Ungermann, Paul, et al.
Pubblicazione: (2024)
di: Ungermann, Paul, et al.
Pubblicazione: (2024)
From Observation to Action: Latent Action-based Primitive Segmentation for VLA Pre-training in Industrial Settings
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
Learning to Correction: Explainable Feedback Generation for Visual Commonsense Reasoning Distractor
di: Chen, Jiali, et al.
Pubblicazione: (2024)
di: Chen, Jiali, et al.
Pubblicazione: (2024)
Towards Latent Masked Image Modeling for Self-Supervised Visual Representation Learning
di: Wei, Yibing, et al.
Pubblicazione: (2024)
di: Wei, Yibing, et al.
Pubblicazione: (2024)
Weakly Supervised Segmentation as Semantic-Based Regularization
di: Colamonaco, Stefano, et al.
Pubblicazione: (2026)
di: Colamonaco, Stefano, et al.
Pubblicazione: (2026)
Latent Action Control for Reasoning-Guided Unified Image Generation
di: Zhai, Fuxiang, et al.
Pubblicazione: (2026)
di: Zhai, Fuxiang, et al.
Pubblicazione: (2026)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
di: Tang, Zuojin, et al.
Pubblicazione: (2026)
di: Tang, Zuojin, et al.
Pubblicazione: (2026)
DiLA: Disentangled Latent Action World Models
di: Zhang, Tianqiu, et al.
Pubblicazione: (2026)
di: Zhang, Tianqiu, et al.
Pubblicazione: (2026)
DF3DV-1K: A Large-Scale Dataset and Benchmark for Distractor-Free Novel View Synthesis
di: Lu, Cheng-You, et al.
Pubblicazione: (2026)
di: Lu, Cheng-You, et al.
Pubblicazione: (2026)
Action-Agnostic Point-Level Supervision for Temporal Action Detection
di: Yoshida, Shuhei M., et al.
Pubblicazione: (2024)
di: Yoshida, Shuhei M., et al.
Pubblicazione: (2024)
ActionParty: Multi-Subject Action Binding in Generative Video Games
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
AdaWorld: Learning Adaptable World Models with Latent Actions
di: Gao, Shenyuan, et al.
Pubblicazione: (2025)
di: Gao, Shenyuan, et al.
Pubblicazione: (2025)
RealStats: A Rigorous Real-Only Statistical Framework for Fake Image Detection
di: Zisman, Haim, et al.
Pubblicazione: (2026)
di: Zisman, Haim, et al.
Pubblicazione: (2026)
Understanding the Effects of Distractors on Reasoning Vision-Language Models
di: Bae, Jiyun, et al.
Pubblicazione: (2025)
di: Bae, Jiyun, et al.
Pubblicazione: (2025)
VITAL: Visual-Semantic Dual Supervision for Enhanced and Interpretable Latent Reasoning in Medical MLLMs
di: Li, Qiaoru, et al.
Pubblicazione: (2026)
di: Li, Qiaoru, et al.
Pubblicazione: (2026)
LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model
di: Mei, Xiaodong, et al.
Pubblicazione: (2026)
di: Mei, Xiaodong, et al.
Pubblicazione: (2026)
Reimagination with Test-time Observation Interventions: Distractor-Robust World Model Predictions for Visual Model Predictive Control
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
Bridge the Gap: From Weak to Full Supervision for Temporal Action Localization with PseudoFormer
di: Liu, Ziyi, et al.
Pubblicazione: (2025)
di: Liu, Ziyi, et al.
Pubblicazione: (2025)
Scale-wise Distillation of Diffusion Models
di: Starodubcev, Nikita, et al.
Pubblicazione: (2025)
di: Starodubcev, Nikita, et al.
Pubblicazione: (2025)
MVMR: A New Framework for Evaluating Faithfulness of Video Moment Retrieval against Multiple Distractors
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
Joint Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self Supervised Learning
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
Brain Latent Progression: Individual-based Spatiotemporal Disease Progression on 3D Brain MRIs via Latent Diffusion
di: Puglisi, Lemuel, et al.
Pubblicazione: (2025)
di: Puglisi, Lemuel, et al.
Pubblicazione: (2025)
Semi-Supervised Audio-Visual Video Action Recognition with Audio Source Localization Guided Mixup
di: Kang, Seokun, et al.
Pubblicazione: (2025)
di: Kang, Seokun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Object-Centric Latent Action Learning
di: Klepach, Albina, et al.
Pubblicazione: (2025) -
Vision-Language Models Unlock Task-Centric Latent Actions
di: Nikulin, Alexander, et al.
Pubblicazione: (2026) -
NinA: Normalizing Flows in Action. Training VLA Models with Normalizing Flows
di: Tarasov, Denis, et al.
Pubblicazione: (2025) -
Vintix: Action Model via In-Context Reinforcement Learning
di: Polubarov, Andrey, et al.
Pubblicazione: (2025) -
Yes, Q-learning Helps Offline In-Context RL
di: Tarasov, Denis, et al.
Pubblicazione: (2025)