Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sam, Jeffrin, Khang, Nguyen, Mahmoud, Yara, Cabrera, Miguel Altamirano, Tsetserukou, Dzmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion
par: Zhura, Iana, et autres
Publié: (2026)
par: Zhura, Iana, et autres
Publié: (2026)
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
Artificial Intelligence in the Life Sciences
Publié: (2021)
Publié: (2021)
SafeHumanoid: VLM-RAG-driven Control of Upper Body Impedance for Humanoid Robot
par: Mahmoud, Yara, et autres
Publié: (2025)
par: Mahmoud, Yara, et autres
Publié: (2025)
Robust Sensor Fusion for Autonomous Navigation in Dynamically Changing Environments
par: Liam O'Connor
Publié: (2026)
par: Liam O'Connor
Publié: (2026)
A Proximal Gradient Framework for Optimization Under Uncertainty with Applications to Sparse Data Representation
par: Jordan Smith
Publié: (2026)
par: Jordan Smith
Publié: (2026)
Addressing Exploration Challenges in Sparse Reward Reinforcement Learning Environments via Intrinsic Curiosity Modules and Reward Shaping
par: Elena Rossi
Publié: (2026)
par: Elena Rossi
Publié: (2026)
Scalable and Efficient Distributed Training of Deep Learning Models via Hybrid Parallelism
par: Yuki Tanaka
Publié: (2026)
par: Yuki Tanaka
Publié: (2026)
Leveraging Graph Neural Networks for Enhanced Node Representation Learning in Sparse Interaction Networks
par: Sasha Petrova
Publié: (2026)
par: Sasha Petrova
Publié: (2026)
Proximal Gradient Methods for Non-Convex Optimization with Applications to Robust Computer Vision
par: Jamie Chen
Publié: (2026)
par: Jamie Chen
Publié: (2026)
Adaptive Regularization for Robust Optimization Under Data Distribution Shift
par: Yuki Tanaka
Publié: (2026)
par: Yuki Tanaka
Publié: (2026)
Context-Aware Feature Aggregation for Robust Object Detection in Dynamic Scenes
par: Jamie Chen
Publié: (2026)
par: Jamie Chen
Publié: (2026)
HumanoidVLM: Vision-Language-Guided Impedance Control for Contact-Rich Humanoid Manipulation
par: Mahmoud, Yara, et autres
Publié: (2026)
par: Mahmoud, Yara, et autres
Publié: (2026)
Intelligent Computing
Publié: (2023)
Publié: (2023)
Journal of Soft Computing in Civil Engineering
Publié: (2018)
Publié: (2018)
The Future of Consumption
Publié: (2023)
Publié: (2023)
DroneVLA: VLA based Aerial Manipulation
par: Mehboob, Fawad, et autres
Publié: (2026)
par: Mehboob, Fawad, et autres
Publié: (2026)
Legal Issues in the Digital Age
Publié: (2025)
Publié: (2025)
COMPUTER VISION TECHNIQUES FOR TRAFFIC SIGN DETECTION IN ADAS APPLICATIONS
par: Taras Volodymyrovych, Kravchenko
Publié: (2025)
par: Taras Volodymyrovych, Kravchenko
Publié: (2025)
Why Has Artificial Intelligence Failed? And How Can it Succeed?
par: John F. Sowa
Publié: (2014)
par: John F. Sowa
Publié: (2014)
Computational intelligence to study the importance of characteristics in flood-irrigated rice
par: Antônio Carlos da Silva
Publié: (2023)
par: Antônio Carlos da Silva
Publié: (2023)
Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization
par: Yang, Jonathan, et autres
Publié: (2025)
par: Yang, Jonathan, et autres
Publié: (2025)
APPLICATION OF IOT (INTERNET OF THINGS) TECHNOLOGIES FOR TECHNOLOGICAL MACHINES
par: Jo'raxanov Yusufjon
Publié: (2025)
par: Jo'raxanov Yusufjon
Publié: (2025)
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
AI Applications in Enhancing Patient Adherence to Medication Regimens
par: Prasad, Dr. Harika
Publié: (2025)
par: Prasad, Dr. Harika
Publié: (2025)
Donkey Kong's Legacy. About microprocessors as model organisms and the behavioral politics of video games in AI
par: Johannes Bruder
Publié: (2021)
par: Johannes Bruder
Publié: (2021)
Sisyphus wird nicht zur Ruhe kommen: ethische Herausforderungen der Künstlichen Intelligenz
par: Volker Thiel
Publié: (2019)
par: Volker Thiel
Publié: (2019)
CAAI Artificial Intelligence Research
Publié: (2024)
Publié: (2024)
Journal of Advanced Computational Intelligence and Intelligent Informatics
Publié: (2022)
Publié: (2022)
LLM-Glasses: GenAI-driven Glasses with Haptic Feedback for Navigation of Visually Impaired People
par: Tokmurziyev, Issatay, et autres
Publié: (2025)
par: Tokmurziyev, Issatay, et autres
Publié: (2025)
CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping
par: An, Zijian, et autres
Publié: (2025)
par: An, Zijian, et autres
Publié: (2025)
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
IET Cyber-systems and Robotics
Publié: (2020)
Publié: (2020)
SeqVLA: Sequential Task Execution for Long-Horizon Manipulation with Completion-Aware Vision-Language-Action Model
par: Yang, Ran, et autres
Publié: (2025)
par: Yang, Ran, et autres
Publié: (2025)
Intelética
Publié: (2025)
Publié: (2025)
TIBBIY TASVIRLARNI TAHLIL QILISHDA MASHINAVIY O'RGANISH VA SUN'IY INTELLEKTNING ROLI
par: R.Y.Mamajanov, et autres
Publié: (2026)
par: R.Y.Mamajanov, et autres
Publié: (2026)
Design and Implementation of an Intelligent System for Controlling a Robotic Hospital Bed for Patient Care Assistance
par: Eduardo Vázquez-Santacruz
Publié: (2015)
par: Eduardo Vázquez-Santacruz
Publié: (2015)
Classification methods for handwritten digit recognition: A survey
par: Ira M. Tuba
Publié: (2023)
par: Ira M. Tuba
Publié: (2023)
MaP-AVR: A Meta-Action Planner for Agents Leveraging Vision Language Models and Retrieval-Augmented Generation
par: Guo, Zhenglong, et autres
Publié: (2025)
par: Guo, Zhenglong, et autres
Publié: (2025)
Documents similaires
-
DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion
par: Zhura, Iana, et autres
Publié: (2026) -
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025) -
GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation
par: Fernando, Marcelino Julio, et autres
Publié: (2026) -
Artificial Intelligence in the Life Sciences
Publié: (2021) -
SafeHumanoid: VLM-RAG-driven Control of Upper Body Impedance for Humanoid Robot
par: Mahmoud, Yara, et autres
Publié: (2025)