RAM-NAS: Resource-aware Multiobjective Neural Architecture Search Method for Robot Vision Tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Mao, Shouren, Qin, Minghao, Dong, Wei, Liu, Huajian, Gao, Yongzhuo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Device-Conditioned Neural Architecture Search for Efficient Robotic Manipulation
por: Wu, Yiming, et al.
Publicado: (2026)
por: Wu, Yiming, et al.
Publicado: (2026)
RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation
por: Kuang, Yuxuan, et al.
Publicado: (2024)
por: Kuang, Yuxuan, et al.
Publicado: (2024)
FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation
por: Wang, Sen, et al.
Publicado: (2025)
por: Wang, Sen, et al.
Publicado: (2025)
PNAS-MOT: Multi-Modal Object Tracking with Pareto Neural Architecture Search
por: Peng, Chensheng, et al.
Publicado: (2024)
por: Peng, Chensheng, et al.
Publicado: (2024)
A Novel Wide-Area Multiobject Detection System with High-Probability Region Searching
por: Long, Xianlei, et al.
Publicado: (2024)
por: Long, Xianlei, et al.
Publicado: (2024)
Reliability-aware Execution Gating for Near-field and Off-axis Vision-guided Robotic Alignment
por: Hu, Ning, et al.
Publicado: (2026)
por: Hu, Ning, et al.
Publicado: (2026)
RoboLLM: Robotic Vision Tasks Grounded on Multimodal Large Language Models
por: Long, Zijun, et al.
Publicado: (2023)
por: Long, Zijun, et al.
Publicado: (2023)
ClearDepth: Enhanced Stereo Perception of Transparent Objects for Robotic Manipulation
por: Bai, Kaixin, et al.
Publicado: (2024)
por: Bai, Kaixin, et al.
Publicado: (2024)
EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models
por: Bai, Yu, et al.
Publicado: (2026)
por: Bai, Yu, et al.
Publicado: (2026)
RoboMatrix: A Skill-centric Hierarchical Framework for Scalable Robot Task Planning and Execution in Open-World
por: Mao, Weixin, et al.
Publicado: (2024)
por: Mao, Weixin, et al.
Publicado: (2024)
Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision
por: Han, Xiaofeng, et al.
Publicado: (2025)
por: Han, Xiaofeng, et al.
Publicado: (2025)
Task-Aware Scanning Parameter Configuration for Robotic Inspection Using Vision Language Embeddings and Hyperdimensional Computing
por: Chen, Zhiling, et al.
Publicado: (2026)
por: Chen, Zhiling, et al.
Publicado: (2026)
Bootstrap Dynamic-Aware 3D Visual Representation for Scalable Robot Learning
por: Liang, Qiwei, et al.
Publicado: (2025)
por: Liang, Qiwei, et al.
Publicado: (2025)
Robo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning
por: Li, Jianxiong, et al.
Publicado: (2024)
por: Li, Jianxiong, et al.
Publicado: (2024)
Benchmarking Vision, Language, & Action Models on Robotic Learning Tasks
por: Guruprasad, Pranav, et al.
Publicado: (2024)
por: Guruprasad, Pranav, et al.
Publicado: (2024)
GMT: Goal-Conditioned Multimodal Transformer for 6-DOF Object Trajectory Synthesis in 3D Scenes
por: Zeng, Huajian, et al.
Publicado: (2026)
por: Zeng, Huajian, et al.
Publicado: (2026)
Beyond Dense Futures: World Models as Structured Planners for Robotic Manipulation
por: Jin, Minghao, et al.
Publicado: (2026)
por: Jin, Minghao, et al.
Publicado: (2026)
FlexVLN: Flexible Adaptation for Diverse Vision-and-Language Navigation Tasks
por: Zhang, Siqi, et al.
Publicado: (2025)
por: Zhang, Siqi, et al.
Publicado: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
por: Guo, Wenxuan, et al.
Publicado: (2026)
por: Guo, Wenxuan, et al.
Publicado: (2026)
TwinAligner: Visual-Dynamic Alignment Empowers Physics-aware Real2Sim2Real for Robotic Manipulation
por: Fan, Hongwei, et al.
Publicado: (2025)
por: Fan, Hongwei, et al.
Publicado: (2025)
RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception
por: Ma, Jiahao, et al.
Publicado: (2026)
por: Ma, Jiahao, et al.
Publicado: (2026)
ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics
por: Wei, Ziyu, et al.
Publicado: (2026)
por: Wei, Ziyu, et al.
Publicado: (2026)
UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models
por: Yang, Jiabing, et al.
Publicado: (2026)
por: Yang, Jiabing, et al.
Publicado: (2026)
Ensuring Force Safety in Vision-Guided Robotic Manipulation via Implicit Tactile Calibration
por: Wei, Lai, et al.
Publicado: (2024)
por: Wei, Lai, et al.
Publicado: (2024)
Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation
por: Qi, Yu, et al.
Publicado: (2025)
por: Qi, Yu, et al.
Publicado: (2025)
What Matters in Building Vision-Language-Action Models for Generalist Robots
por: Li, Xinghang, et al.
Publicado: (2024)
por: Li, Xinghang, et al.
Publicado: (2024)
History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language Navigation
por: Ding, Xichen, et al.
Publicado: (2025)
por: Ding, Xichen, et al.
Publicado: (2025)
A Real-Time Multi-Model Parametric Representation of Point Clouds
por: Gao, Yuan, et al.
Publicado: (2025)
por: Gao, Yuan, et al.
Publicado: (2025)
ManiPose: A Comprehensive Benchmark for Pose-aware Object Manipulation in Robotics
por: Yu, Qiaojun, et al.
Publicado: (2024)
por: Yu, Qiaojun, et al.
Publicado: (2024)
Multi-Task Learning for Robot Perception with Imbalanced Data
por: Erkent, Ozgur
Publicado: (2026)
por: Erkent, Ozgur
Publicado: (2026)
Towards an Accurate and Effective Robot Vision (The Problem of Topological Localization for Mobile Robots)
por: Boros, Emanuela
Publicado: (2025)
por: Boros, Emanuela
Publicado: (2025)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
por: Shi, Hao, et al.
Publicado: (2025)
por: Shi, Hao, et al.
Publicado: (2025)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
por: Shao, Rui, et al.
Publicado: (2025)
por: Shao, Rui, et al.
Publicado: (2025)
STORM: Search-Guided Generative World Models for Robotic Manipulation
por: Lin, Wenjun, et al.
Publicado: (2025)
por: Lin, Wenjun, et al.
Publicado: (2025)
FM-Fusion: Instance-aware Semantic Mapping Boosted by Vision-Language Foundation Models
por: Liu, Chuhao, et al.
Publicado: (2024)
por: Liu, Chuhao, et al.
Publicado: (2024)
LiPS: Lightweight Panoptic Segmentation for Resource-Constrained Robotics
por: Galagain, Calvin, et al.
Publicado: (2026)
por: Galagain, Calvin, et al.
Publicado: (2026)
AnyTeleop: A General Vision-Based Dexterous Robot Arm-Hand Teleoperation System
por: Qin, Yuzhe, et al.
Publicado: (2023)
por: Qin, Yuzhe, et al.
Publicado: (2023)
SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models
por: Liu, Haowen, et al.
Publicado: (2025)
por: Liu, Haowen, et al.
Publicado: (2025)
GNFactor: Multi-Task Real Robot Learning with Generalizable Neural Feature Fields
por: Ze, Yanjie, et al.
Publicado: (2023)
por: Ze, Yanjie, et al.
Publicado: (2023)
FlowHOI: Flow-based Semantics-Grounded Generation of Hand-Object Interactions for Dexterous Robot Manipulation
por: Zeng, Huajian, et al.
Publicado: (2026)
por: Zeng, Huajian, et al.
Publicado: (2026)
Ejemplares similares
-
Device-Conditioned Neural Architecture Search for Efficient Robotic Manipulation
por: Wu, Yiming, et al.
Publicado: (2026) -
RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation
por: Kuang, Yuxuan, et al.
Publicado: (2024) -
FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation
por: Wang, Sen, et al.
Publicado: (2025) -
PNAS-MOT: Multi-Modal Object Tracking with Pareto Neural Architecture Search
por: Peng, Chensheng, et al.
Publicado: (2024) -
A Novel Wide-Area Multiobject Detection System with High-Probability Region Searching
por: Long, Xianlei, et al.
Publicado: (2024)