VLASCD: A Visual Language Action Model for Simultaneous Chatting and Decision Making
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Zuojin, Hu, Bin, Zhao, Chenyang, Ma, De, Pan, Gang, Liu, Bin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
One Token Per Frame: Reconsidering Visual Bandwidth in World Models for VLA Policy
by: Tang, Zuojin, et al.
Published: (2026)
by: Tang, Zuojin, et al.
Published: (2026)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
by: Tang, Zuojin, et al.
Published: (2026)
by: Tang, Zuojin, et al.
Published: (2026)
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
by: Zhou, Zihao, et al.
Published: (2023)
by: Zhou, Zihao, et al.
Published: (2023)
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
by: Zhang, Zhuohui, et al.
Published: (2026)
by: Zhang, Zhuohui, et al.
Published: (2026)
Mean-Flow based One-Step Vision-Language-Action
by: Chen, Yang, et al.
Published: (2026)
by: Chen, Yang, et al.
Published: (2026)
LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization
by: Zhao, Yang, et al.
Published: (2026)
by: Zhao, Yang, et al.
Published: (2026)
Hume: Introducing System-2 Thinking in Visual-Language-Action Model
by: Song, Haoming, et al.
Published: (2025)
by: Song, Haoming, et al.
Published: (2025)
Beyond Accuracy: How AI Metacognitive Sensitivity improves AI-assisted Decision Making
by: Li, ZhaoBin, et al.
Published: (2025)
by: Li, ZhaoBin, et al.
Published: (2025)
Efficient and Generalized end-to-end Autonomous Driving System with Latent Deep Reinforcement Learning and Demonstrations
by: Tang, Zuojin, et al.
Published: (2024)
by: Tang, Zuojin, et al.
Published: (2024)
Enabling Intelligent Interactions between an Agent and an LLM: A Reinforcement Learning Approach
by: Hu, Bin, et al.
Published: (2023)
by: Hu, Bin, et al.
Published: (2023)
SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model
by: Qu, Delin, et al.
Published: (2025)
by: Qu, Delin, et al.
Published: (2025)
Weakly Supervised Point Clouds Transformer for 3D Object Detection
by: Tang, Zuojin, et al.
Published: (2023)
by: Tang, Zuojin, et al.
Published: (2023)
Controlling Large Language Model-based Agents for Large-Scale Decision-Making: An Actor-Critic Approach
by: Zhang, Bin, et al.
Published: (2023)
by: Zhang, Bin, et al.
Published: (2023)
Probing Causality Manipulation of Large Language Models
by: Zhang, Chenyang, et al.
Published: (2024)
by: Zhang, Chenyang, et al.
Published: (2024)
CONDESION-BENCH: Conditional Decision-Making of Large Language Models in Compositional Action Space
by: Hwang, Yeonjun, et al.
Published: (2026)
by: Hwang, Yeonjun, et al.
Published: (2026)
Can AI Make Energy Retrofit Decisions? An Evaluation of Large Language Models
by: Shu, Lei, et al.
Published: (2025)
by: Shu, Lei, et al.
Published: (2025)
PriorZero: Bridging Language Priors and World Models for Decision Making
by: Xiong, Junyu, et al.
Published: (2026)
by: Xiong, Junyu, et al.
Published: (2026)
RAD: Retrieval-Augmented Decision-Making of Meta-Actions with Vision-Language Models in Autonomous Driving
by: Wang, Yujin, et al.
Published: (2025)
by: Wang, Yujin, et al.
Published: (2025)
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
by: Xu, Zonghuan, et al.
Published: (2025)
by: Xu, Zonghuan, et al.
Published: (2025)
Asking Before Acting: Gather Information in Embodied Decision Making with Language Models
by: Chen, Xiaoyu, et al.
Published: (2023)
by: Chen, Xiaoyu, et al.
Published: (2023)
On the Modeling Capabilities of Large Language Models for Sequential Decision Making
by: Klissarov, Martin, et al.
Published: (2024)
by: Klissarov, Martin, et al.
Published: (2024)
Enhancing Action and Ingredient Modeling for Semantically Grounded Recipe Generation
by: Liu, Guoshan, et al.
Published: (2026)
by: Liu, Guoshan, et al.
Published: (2026)
On Emotion-Sensitive Decision Making of Small Language Model Agents
by: Lin, Jiaju, et al.
Published: (2026)
by: Lin, Jiaju, et al.
Published: (2026)
Beyond World-Frame Action Heads: Motion-Centric Action Frames for Vision-Language-Action Models
by: Yang, Huoren, et al.
Published: (2026)
by: Yang, Huoren, et al.
Published: (2026)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
by: Yang, Jiarui, et al.
Published: (2025)
by: Yang, Jiarui, et al.
Published: (2025)
Towards Objectively Benchmarking Social Intelligence for Language Agents at Action Level
by: Wang, Chenxu, et al.
Published: (2024)
by: Wang, Chenxu, et al.
Published: (2024)
Geometry of Decision Making in Language Models
by: Joshi, Abhinav, et al.
Published: (2025)
by: Joshi, Abhinav, et al.
Published: (2025)
PiCo: Jailbreaking Multimodal Large Language Models via Pictorial Code Contextualization
by: Liu, Aofan, et al.
Published: (2025)
by: Liu, Aofan, et al.
Published: (2025)
COHERENT: Collaboration of Heterogeneous Multi-Robot System with Large Language Models
by: Liu, Kehui, et al.
Published: (2024)
by: Liu, Kehui, et al.
Published: (2024)
MazeEval: A Benchmark for Testing Sequential Decision-Making in Language Models
by: Einarsson, Hafsteinn
Published: (2025)
by: Einarsson, Hafsteinn
Published: (2025)
Building Decision Making Models Through Language Model Regime
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
Bias in Decision-Making for AI's Ethical Dilemmas: A Comparative Study of ChatGPT and Claude
by: Xu, Wentao, et al.
Published: (2025)
by: Xu, Wentao, et al.
Published: (2025)
A Crowdsourced Study of ChatBot Influence in Value-Driven Decision Making Scenarios
by: Wise, Anthony, et al.
Published: (2025)
by: Wise, Anthony, et al.
Published: (2025)
Multimodal Chain-of-Thought Reasoning via ChatGPT to Protect Children from Age-Inappropriate Apps
by: Hu, Chuanbo, et al.
Published: (2024)
by: Hu, Chuanbo, et al.
Published: (2024)
Chemist Eye: A Visual Language Model-Powered System for Safety Monitoring and Robot Decision-Making in Self-Driving Laboratories
by: Munguia-Galeano, Francisco, et al.
Published: (2025)
by: Munguia-Galeano, Francisco, et al.
Published: (2025)
Responsible Multilingual Large Language Models: A Survey of Development, Applications, and Societal Impact
by: Liu, Junhua, et al.
Published: (2024)
by: Liu, Junhua, et al.
Published: (2024)
On The Statistical Complexity of Offline Decision-Making
by: Nguyen-Tang, Thanh, et al.
Published: (2025)
by: Nguyen-Tang, Thanh, et al.
Published: (2025)
Stephanie2: Thinking, Waiting, and Making Decisions Like Humans in Step-by-Step AI Social Chat
by: Yang, Hao, et al.
Published: (2026)
by: Yang, Hao, et al.
Published: (2026)
Driving with Regulation: Trustworthy and Interpretable Decision-Making for Autonomous Driving with Retrieval-Augmented Reasoning
by: Cai, Tianhui, et al.
Published: (2024)
by: Cai, Tianhui, et al.
Published: (2024)
SMAC-R1: The Emergence of Intelligence in Decision-Making Tasks
by: Deng, Yue, et al.
Published: (2024)
by: Deng, Yue, et al.
Published: (2024)
Similar Items
-
One Token Per Frame: Reconsidering Visual Bandwidth in World Models for VLA Policy
by: Tang, Zuojin, et al.
Published: (2026) -
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
by: Tang, Zuojin, et al.
Published: (2026) -
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
by: Zhou, Zihao, et al.
Published: (2023) -
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
by: Zhang, Zhuohui, et al.
Published: (2026) -
Mean-Flow based One-Step Vision-Language-Action
by: Chen, Yang, et al.
Published: (2026)