Bringing Robots Home: The Rise of AI Robots in Consumer Electronics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Haiwei, Liu, Yang, Chu, Ted, Saddik, Abdulmotaleb El |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tile-Weighted Rate-Distortion Optimized Packet Scheduling for 360$^\circ$ VR Video Streaming
par: Wang, Haopeng, et autres
Publié: (2024)
par: Wang, Haopeng, et autres
Publié: (2024)
Empirical Studies of Large Scale Environment Scanning by Consumer Electronics
par: Wang, Mengyuan, et autres
Publié: (2025)
par: Wang, Mengyuan, et autres
Publié: (2025)
Leveraging LLMs to Create a Haptic Devices' Recommendation System
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
Immersive Multimedia Communication: State-of-the-Art on eXtended Reality Streaming
par: Wang, Haopeng, et autres
Publié: (2025)
par: Wang, Haopeng, et autres
Publié: (2025)
Experimental Studies of Metaverse Streaming
par: Wang, Haopeng, et autres
Publié: (2024)
par: Wang, Haopeng, et autres
Publié: (2024)
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
par: Long, Zijian, et autres
Publié: (2025)
par: Long, Zijian, et autres
Publié: (2025)
MADRL-Based Rate Adaptation for 360° Video Streaming with Multi-Viewpoint Prediction
par: Wang, Haopeng, et autres
Publié: (2024)
par: Wang, Haopeng, et autres
Publié: (2024)
How to Cache Important Contents for Multi-modal Service in Dynamic Networks: A DRL-based Caching Scheme
par: Zhang, Zhe, et autres
Publié: (2024)
par: Zhang, Zhe, et autres
Publié: (2024)
RoboTron-Mani: All-in-One Multimodal Large Model for Robotic Manipulation
par: Yan, Feng, et autres
Publié: (2024)
par: Yan, Feng, et autres
Publié: (2024)
A Multimedia Framework for Continuum Robots: Systematic, Computational, and Control Perspectives
par: Hsieh, Po-Yu, et autres
Publié: (2024)
par: Hsieh, Po-Yu, et autres
Publié: (2024)
CineWild: Balancing Art and Robotics for Ethical Wildlife Documentary Filmmaking
par: Pueyo, Pablo, et autres
Publié: (2025)
par: Pueyo, Pablo, et autres
Publié: (2025)
Learning Primitive Embodied World Models: Towards Scalable Robotic Learning
par: Sun, Qiao, et autres
Publié: (2025)
par: Sun, Qiao, et autres
Publié: (2025)
AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation
par: Yu, Wenda, et autres
Publié: (2026)
par: Yu, Wenda, et autres
Publié: (2026)
MotiBo: The Impact of Interactive Digital Storytelling Robots on Student Motivation through Self-Determination Theory
par: Fung, Ka Yan, et autres
Publié: (2026)
par: Fung, Ka Yan, et autres
Publié: (2026)
Large Language Models (LLMs): Deployment, Tokenomics and Sustainability
par: Dong, Haiwei, et autres
Publié: (2024)
par: Dong, Haiwei, et autres
Publié: (2024)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
par: Xu, Siyuan, et autres
Publié: (2026)
par: Xu, Siyuan, et autres
Publié: (2026)
SIG-Chat: Spatial Intent-Guided Conversational Gesture Generation Involving How, When and Where
par: Huang, Yiheng, et autres
Publié: (2025)
par: Huang, Yiheng, et autres
Publié: (2025)
The Potential of Olfactory Stimuli in Stress Reduction through Virtual Reality
par: Valdivieso, Yasmin Elsaddik, et autres
Publié: (2025)
par: Valdivieso, Yasmin Elsaddik, et autres
Publié: (2025)
XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments
par: Qian, Kangan, et autres
Publié: (2026)
par: Qian, Kangan, et autres
Publié: (2026)
WildFusion: Multimodal Implicit 3D Reconstructions in the Wild
par: Liu, Yanbaihui, et autres
Publié: (2024)
par: Liu, Yanbaihui, et autres
Publié: (2024)
BLM$_1$: A Boundless Large Model for Cross-Space, Cross-Task, and Cross-Embodiment Learning
par: Tan, Wentao, et autres
Publié: (2025)
par: Tan, Wentao, et autres
Publié: (2025)
GroMo: Plant Growth Modeling with Multiview Images
par: Bhatt, Ruchi, et autres
Publié: (2025)
par: Bhatt, Ruchi, et autres
Publié: (2025)
Flight Patterns for Swarms of Drones
par: Zhu, Shuqin, et autres
Publié: (2024)
par: Zhu, Shuqin, et autres
Publié: (2024)
Listen, Look, Drive: Coupling Audio Instructions for User-aware VLA-based Autonomous Driving
par: Guo, Ziang, et autres
Publié: (2026)
par: Guo, Ziang, et autres
Publié: (2026)
SonicSense: Object Perception from In-Hand Acoustic Vibration
par: Liu, Jiaxun, et autres
Publié: (2024)
par: Liu, Jiaxun, et autres
Publié: (2024)
Gemini Robotics: Bringing AI into the Physical World
par: Gemini Robotics Team, et autres
Publié: (2025)
par: Gemini Robotics Team, et autres
Publié: (2025)
Evaluating Magic Leap 2 Tool Tracking for AR Sensor Guidance in Industrial Inspections
par: Masuhr, Christian, et autres
Publié: (2025)
par: Masuhr, Christian, et autres
Publié: (2025)
HR-INR: Continuous Space-Time Video Super-Resolution via Event Camera
par: Lu, Yunfan, et autres
Publié: (2024)
par: Lu, Yunfan, et autres
Publié: (2024)
WaterVG: Waterway Visual Grounding based on Text-Guided Vision and mmWave Radar
par: Guan, Runwei, et autres
Publié: (2024)
par: Guan, Runwei, et autres
Publié: (2024)
EVA: An Embodied World Model for Future Video Anticipation
par: Chi, Xiaowei, et autres
Publié: (2024)
par: Chi, Xiaowei, et autres
Publié: (2024)
WoW: Towards a World omniscient World model Through Embodied Interaction
par: Chi, Xiaowei, et autres
Publié: (2025)
par: Chi, Xiaowei, et autres
Publié: (2025)
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
U2UData+: A Scalable Swarm UAVs Autonomous Flight Dataset for Embodied Long-horizon Tasks
par: Feng, Tongtong, et autres
Publié: (2025)
par: Feng, Tongtong, et autres
Publié: (2025)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
par: Min, Chen, et autres
Publié: (2023)
par: Min, Chen, et autres
Publié: (2023)
Integrating Multi-Modal Sensors: A Review of Fusion Techniques for Intelligent Vehicles
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation for Vision-and-Language Navigation
par: Wang, Sen, et autres
Publié: (2025)
par: Wang, Sen, et autres
Publié: (2025)
2D or 3D: Who Governs Salience in VLA Models? -- Tri-Stage Token Pruning Framework with Modality Salience Awareness
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
3D Wi-Fi Signal Measurement in Realistic Digital Twin Testbed Environments Using Ray Tracing
par: Wang, Mengyuan, et autres
Publié: (2026)
par: Wang, Mengyuan, et autres
Publié: (2026)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
par: Qu, Bowen, et autres
Publié: (2024)
par: Qu, Bowen, et autres
Publié: (2024)
MetaDecorator: Generating Immersive Virtual Tours through Multimodality
par: Xie, Shuang, et autres
Publié: (2025)
par: Xie, Shuang, et autres
Publié: (2025)
Documents similaires
-
Tile-Weighted Rate-Distortion Optimized Packet Scheduling for 360$^\circ$ VR Video Streaming
par: Wang, Haopeng, et autres
Publié: (2024) -
Empirical Studies of Large Scale Environment Scanning by Consumer Electronics
par: Wang, Mengyuan, et autres
Publié: (2025) -
Leveraging LLMs to Create a Haptic Devices' Recommendation System
par: Liu, Yang, et autres
Publié: (2025) -
Immersive Multimedia Communication: State-of-the-Art on eXtended Reality Streaming
par: Wang, Haopeng, et autres
Publié: (2025) -
Experimental Studies of Metaverse Streaming
par: Wang, Haopeng, et autres
Publié: (2024)