CANVAS: Commonsense-Aware Navigation System for Intuitive Human-Robot Interaction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choi, Suhwan, Cho, Yongjun, Kim, Minchan, Jung, Jaeyoon, Joe, Myunchul, Park, Yubeen, Kim, Minseo, Kim, Sungwoong, Lee, Sungjae, Park, Hwiseong, Chung, Jiwan, Yu, Youngjae |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI
par: Choi, Suhwan, et autres
Publié: (2025)
par: Choi, Suhwan, et autres
Publié: (2025)
CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents
par: Seong, Haebin, et autres
Publié: (2025)
par: Seong, Haebin, et autres
Publié: (2025)
VisEscape: A Benchmark for Evaluating Exploration-driven Decision-making in Virtual Escape Rooms
par: Lim, Seungwon, et autres
Publié: (2025)
par: Lim, Seungwon, et autres
Publié: (2025)
Selective Vision is the Challenge for Visual Reasoning: A Benchmark for Visual Argument Understanding
par: Chung, Jiwan, et autres
Publié: (2024)
par: Chung, Jiwan, et autres
Publié: (2024)
EgoSpeak: Learning When to Speak for Egocentric Conversational Agents in the Wild
par: Kim, Junhyeok, et autres
Publié: (2025)
par: Kim, Junhyeok, et autres
Publié: (2025)
vla-eval: A Unified Evaluation Harness for Vision-Language-Action Models
par: Choi, Suhwan, et autres
Publié: (2026)
par: Choi, Suhwan, et autres
Publié: (2026)
Subtle Risks, Critical Failures: A Framework for Diagnosing Physical Safety of LLMs for Embodied Decision Making
par: Son, Yejin, et autres
Publié: (2025)
par: Son, Yejin, et autres
Publié: (2025)
SEA: Evaluating Sketch Abstraction Efficiency via Element-level Commonsense Visual Question Answering
par: Park, Jiho, et autres
Publié: (2026)
par: Park, Jiho, et autres
Publié: (2026)
GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance
par: Kim, Junhyeok, et autres
Publié: (2025)
par: Kim, Junhyeok, et autres
Publié: (2025)
ESREAL: Exploiting Semantic Reconstruction to Mitigate Hallucinations in Vision-Language Models
par: Kim, Minchan, et autres
Publié: (2024)
par: Kim, Minchan, et autres
Publié: (2024)
Revisiting Residual Connections: Orthogonal Updates for Stable and Efficient Deep Networks
par: Oh, Giyeong, et autres
Publié: (2025)
par: Oh, Giyeong, et autres
Publié: (2025)
PPMI: Privacy-Preserving LLM Interaction with Socratic Chain-of-Thought Reasoning and Homomorphically Encrypted Vector Databases
par: Bae, Yubeen, et autres
Publié: (2025)
par: Bae, Yubeen, et autres
Publié: (2025)
Teaching Metric Distance to Discrete Autoregressive Language Models
par: Chung, Jiwan, et autres
Publié: (2025)
par: Chung, Jiwan, et autres
Publié: (2025)
CALL: Context-Aware Low-Latency Retrieval in Disk-Based Vector Databases
par: Jeong, Yeonwoo, et autres
Publié: (2025)
par: Jeong, Yeonwoo, et autres
Publié: (2025)
Comparison Reveals Commonality: Customized Image Generation through Contrastive Inversion
par: Kim, Minseo, et autres
Publié: (2025)
par: Kim, Minseo, et autres
Publié: (2025)
ConceptPrism: Concept Disentanglement in Personalized Diffusion Models via Residual Token Optimization
par: Kim, Minseo, et autres
Publié: (2026)
par: Kim, Minseo, et autres
Publié: (2026)
A11YN: aligning LLMs for accessible web UI code generation
par: Yoon, Janghan, et autres
Publié: (2025)
par: Yoon, Janghan, et autres
Publié: (2025)
BiC-MPPI: Goal-Pursuing, Sampling-Based Bidirectional Rollout Clustering Path Integral for Trajectory Optimization
par: Jung, Minchan, et autres
Publié: (2024)
par: Jung, Minchan, et autres
Publié: (2024)
Floquet Chern Insulators and Radiation-Induced Zero Resistance in Irradiated Graphene
par: Kim, Youngjae, et autres
Publié: (2025)
par: Kim, Youngjae, et autres
Publié: (2025)
v1: Learning to Point Visual Tokens for Multimodal Grounded Reasoning
par: Chung, Jiwan, et autres
Publié: (2025)
par: Chung, Jiwan, et autres
Publié: (2025)
Learning to Transfer Human Hand Skills for Robot Manipulations
par: Park, Sungjae, et autres
Publié: (2025)
par: Park, Sungjae, et autres
Publié: (2025)
StableSketcher: Enhancing Diffusion Model for Pixel-based Sketch Generation via Visual Question Answering Feedback
par: Park, Jiho, et autres
Publié: (2025)
par: Park, Jiho, et autres
Publié: (2025)
Explain with Visual Keypoints Like a Real Mentor! A Benchmark for Multimodal Solution Explanation
par: Park, Jaewoo, et autres
Publié: (2025)
par: Park, Jaewoo, et autres
Publié: (2025)
Background-Aware Defect Generation for Robust Industrial Anomaly Detection
par: Cho, Youngjae, et autres
Publié: (2024)
par: Cho, Youngjae, et autres
Publié: (2024)
KOFFVQA: An Objectively Evaluated Free-form VQA Benchmark for Large Vision-Language Models in the Korean Language
par: Kim, Yoonshik, et autres
Publié: (2025)
par: Kim, Yoonshik, et autres
Publié: (2025)
X-ray studies of PSR J1838$-$0655 and its wind nebula associated with HESS J1837$-$069 and 1LHAASO J1837$-$0654u
par: Park, Minseo, et autres
Publié: (2025)
par: Park, Minseo, et autres
Publié: (2025)
Can TabPFN Compete with GNNs for Node Classification via Graph Tabularization?
par: Choi, Jeongwhan, et autres
Publié: (2025)
par: Choi, Jeongwhan, et autres
Publié: (2025)
Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance
par: Kwon, Minchan, et autres
Publié: (2026)
par: Kwon, Minchan, et autres
Publié: (2026)
Memorize Early, Then Query: Inlier-Memorization-Guided Active Outlier Detection
par: Kang, Minseo, et autres
Publié: (2026)
par: Kang, Minseo, et autres
Publié: (2026)
Hybrid Federated Learning for Noise-Robust Training
par: Kim, Yongjun, et autres
Publié: (2026)
par: Kim, Yongjun, et autres
Publié: (2026)
Rethinking State Tracking in Recurrent Models Through Error Control Dynamics
par: Chung, Jiwan, et autres
Publié: (2026)
par: Chung, Jiwan, et autres
Publié: (2026)
Adaptive Graph Rewiring to Mitigate Over-Squashing in Mesh-Based GNNs for Fluid Dynamics Simulations
par: Seo, Sangwoo, et autres
Publié: (2025)
par: Seo, Sangwoo, et autres
Publié: (2025)
CompoDistill: Attention Distillation for Compositional Reasoning in Multimodal LLMs
par: Kim, Jiwan, et autres
Publié: (2025)
par: Kim, Jiwan, et autres
Publié: (2025)
SEAL: Entangled White-box Watermarks on Low-Rank Adaptation
par: Oh, Giyeong, et autres
Publié: (2025)
par: Oh, Giyeong, et autres
Publié: (2025)
Exploring Fine-Tuning of Large Audio Language Models for Spoken Language Understanding under Limited Speech Data
par: Choi, Youngwon, et autres
Publié: (2025)
par: Choi, Youngwon, et autres
Publié: (2025)
SLIP & ETHICS: Graduated Intervention for AI Emotional Companions
par: Kim, Minseo
Publié: (2026)
par: Kim, Minseo
Publié: (2026)
Disentangling and Generating Modalities for Recommendation in Missing Modality Scenarios
par: Kim, Jiwan, et autres
Publié: (2025)
par: Kim, Jiwan, et autres
Publié: (2025)
Global Geometry Is Not Enough for Vision Representations
par: Chung, Jiwan, et autres
Publié: (2026)
par: Chung, Jiwan, et autres
Publié: (2026)
Beyond Task-Oriented and Chitchat Dialogues: Proactive and Transition-Aware Conversational Agents
par: Yoon, Yejin, et autres
Publié: (2025)
par: Yoon, Yejin, et autres
Publié: (2025)
High thermal conductivity dominated by thermal phonons with mean free paths exceeding hundred nanometer in three-dimensional covalent organic framework derivatives: a molecular dynamics study
par: Kim, Sungjae, et autres
Publié: (2025)
par: Kim, Sungjae, et autres
Publié: (2025)
Documents similaires
-
D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI
par: Choi, Suhwan, et autres
Publié: (2025) -
CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents
par: Seong, Haebin, et autres
Publié: (2025) -
VisEscape: A Benchmark for Evaluating Exploration-driven Decision-making in Virtual Escape Rooms
par: Lim, Seungwon, et autres
Publié: (2025) -
Selective Vision is the Challenge for Visual Reasoning: A Benchmark for Visual Argument Understanding
par: Chung, Jiwan, et autres
Publié: (2024) -
EgoSpeak: Learning When to Speak for Egocentric Conversational Agents in the Wild
par: Kim, Junhyeok, et autres
Publié: (2025)