High-Quality, ROS Compatible Video Encoding and Decoding for High-Definition Datasets
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Jian, Xu, Bowen, Schwertfeger, Sören |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
3DRef: 3D Dataset and Benchmark for Reflection Detection in RGB and Lidar Data
por: Zhao, Xiting, et al.
Publicado: (2024)
por: Zhao, Xiting, et al.
Publicado: (2024)
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
por: Yu, Zihui, et al.
Publicado: (2026)
por: Yu, Zihui, et al.
Publicado: (2026)
From Observation to Action: Latent Action-based Primitive Segmentation for VLA Pre-training in Industrial Settings
por: Zhang, Jiajie, et al.
Publicado: (2025)
por: Zhang, Jiajie, et al.
Publicado: (2025)
OnSiteVRU: A High-Resolution Trajectory Dataset for High-Density Vulnerable Road Users
por: Yan, Zhangcun, et al.
Publicado: (2025)
por: Yan, Zhangcun, et al.
Publicado: (2025)
High-Definition 5MP Stereo Vision Sensing for Robotics
por: Jiang, Leaf, et al.
Publicado: (2026)
por: Jiang, Leaf, et al.
Publicado: (2026)
SteelDS: A High-Resolution Video Dataset of E40 Steel Scrap for Object Detection and Instance Segmentation
por: Neubauer, Melanie, et al.
Publicado: (2026)
por: Neubauer, Melanie, et al.
Publicado: (2026)
BeautyMap: Binary-Encoded Adaptable Ground Matrix for Dynamic Points Removal in Global Maps
por: Jia, Mingkai, et al.
Publicado: (2024)
por: Jia, Mingkai, et al.
Publicado: (2024)
MAPLE: Encoding Dexterous Robotic Manipulation Priors Learned From Egocentric Videos
por: Gavryushin, Alexey, et al.
Publicado: (2025)
por: Gavryushin, Alexey, et al.
Publicado: (2025)
DRAW2ACT: Turning Depth-Encoded Trajectories into Robotic Demonstration Videos
por: Bai, Yang, et al.
Publicado: (2025)
por: Bai, Yang, et al.
Publicado: (2025)
LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding
por: Wang, Shihao, et al.
Publicado: (2026)
por: Wang, Shihao, et al.
Publicado: (2026)
High-Quality Unknown Object Instance Segmentation via Quadruple Boundary Error Refinement
por: Back, Seunghyeok, et al.
Publicado: (2023)
por: Back, Seunghyeok, et al.
Publicado: (2023)
HetroD: A High-Fidelity Drone Dataset and Benchmark for Autonomous Driving in Heterogeneous Traffic
por: Chen, Yu-Hsiang, et al.
Publicado: (2026)
por: Chen, Yu-Hsiang, et al.
Publicado: (2026)
DurLAR: A High-fidelity 128-channel LiDAR Dataset with Panoramic Ambient and Reflectivity Imagery for Multi-modal Autonomous Driving Applications
por: Li, Li, et al.
Publicado: (2024)
por: Li, Li, et al.
Publicado: (2024)
LRDDv3: High-Resolution Long-Range Drone Detection Dataset with Range Information and Thermal Data
por: Peterson, Knut, et al.
Publicado: (2026)
por: Peterson, Knut, et al.
Publicado: (2026)
Is the Future Compatible? Diagnosing Dynamic Consistency in World Action Models
por: Ruan, Bo-Kai, et al.
Publicado: (2026)
por: Ruan, Bo-Kai, et al.
Publicado: (2026)
RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video
por: Mei, Haiyang, et al.
Publicado: (2025)
por: Mei, Haiyang, et al.
Publicado: (2025)
SEPT: Standard-Definition Map Enhanced Scene Perception and Topology Reasoning for Autonomous Driving
por: Pei, Muleilan, et al.
Publicado: (2025)
por: Pei, Muleilan, et al.
Publicado: (2025)
DeformGS: Scene Flow in Highly Deformable Scenes for Deformable Object Manipulation
por: Duisterhof, Bardienus P., et al.
Publicado: (2023)
por: Duisterhof, Bardienus P., et al.
Publicado: (2023)
Enhancing Online Road Network Perception and Reasoning with Standard Definition Maps
por: Zhang, Hengyuan, et al.
Publicado: (2024)
por: Zhang, Hengyuan, et al.
Publicado: (2024)
UMAD: University of Macau Anomaly Detection Benchmark Dataset
por: Li, Dong, et al.
Publicado: (2024)
por: Li, Dong, et al.
Publicado: (2024)
CNSv2: Probabilistic Correspondence Encoded Neural Image Servo
por: Chen, Anzhe, et al.
Publicado: (2025)
por: Chen, Anzhe, et al.
Publicado: (2025)
RealDex: Towards Human-like Grasping for Robotic Dexterous Hand
por: Liu, Yumeng, et al.
Publicado: (2024)
por: Liu, Yumeng, et al.
Publicado: (2024)
DriveCode: Domain Specific Numerical Encoding for LLM-Based Autonomous Driving
por: Wang, Zhiye, et al.
Publicado: (2026)
por: Wang, Zhiye, et al.
Publicado: (2026)
SD++: Enhancing Standard Definition Maps by Incorporating Road Knowledge using LLMs
por: Diwanji, Hitvarth, et al.
Publicado: (2025)
por: Diwanji, Hitvarth, et al.
Publicado: (2025)
EDENet: Echo Direction Encoding Network for Place Recognition Based on Ground Penetrating Radar
por: Zhang, Pengyu, et al.
Publicado: (2025)
por: Zhang, Pengyu, et al.
Publicado: (2025)
Kinematify: Open-Vocabulary Synthesis of High-DoF Articulated Objects
por: Wang, Jiawei, et al.
Publicado: (2025)
por: Wang, Jiawei, et al.
Publicado: (2025)
Towards Comprehensive Multimodal Perception: Introducing the Touch-Language-Vision Dataset
por: Cheng, Ning, et al.
Publicado: (2024)
por: Cheng, Ning, et al.
Publicado: (2024)
HybridWorldSim: A Scalable and Controllable High-fidelity Simulator for Autonomous Driving
por: Li, Qiang, et al.
Publicado: (2025)
por: Li, Qiang, et al.
Publicado: (2025)
AoE: Always-on Egocentric Human Video Collection for Embodied AI
por: Yang, Bowen, et al.
Publicado: (2026)
por: Yang, Bowen, et al.
Publicado: (2026)
ActiveSplat: High-Fidelity Scene Reconstruction through Active Gaussian Splatting
por: Li, Yuetao, et al.
Publicado: (2024)
por: Li, Yuetao, et al.
Publicado: (2024)
UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
por: Xue, Zhucun, et al.
Publicado: (2025)
por: Xue, Zhucun, et al.
Publicado: (2025)
Robot Learning from Human Videos: A Survey
por: Ma, Junyi, et al.
Publicado: (2026)
por: Ma, Junyi, et al.
Publicado: (2026)
HiP-AD: Hierarchical and Multi-Granularity Planning with Deformable Attention for Autonomous Driving in a Single Decoder
por: Tang, Yingqi, et al.
Publicado: (2025)
por: Tang, Yingqi, et al.
Publicado: (2025)
VILP: Imitation Learning with Latent Video Planning
por: Xu, Zhengtong, et al.
Publicado: (2025)
por: Xu, Zhengtong, et al.
Publicado: (2025)
Sparse Video Generation Propels Real-World Beyond-the-View Vision-Language Navigation
por: Zhang, Hai, et al.
Publicado: (2026)
por: Zhang, Hai, et al.
Publicado: (2026)
JEPA-VLA: Video Predictive Embedding is Needed for VLA Models
por: Miao, Shangchen, et al.
Publicado: (2026)
por: Miao, Shangchen, et al.
Publicado: (2026)
HiMo: High-Speed Objects Motion Compensation in Point Clouds
por: Zhang, Qingwen, et al.
Publicado: (2025)
por: Zhang, Qingwen, et al.
Publicado: (2025)
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
por: Li, Peiyan, et al.
Publicado: (2026)
por: Li, Peiyan, et al.
Publicado: (2026)
Habitat-GS: A High-Fidelity Navigation Simulator with Dynamic Gaussian Splatting
por: Xia, Ziyuan, et al.
Publicado: (2026)
por: Xia, Ziyuan, et al.
Publicado: (2026)
DrivingSphere: Building a High-fidelity 4D World for Closed-loop Simulation
por: Yan, Tianyi, et al.
Publicado: (2024)
por: Yan, Tianyi, et al.
Publicado: (2024)
Ejemplares similares
-
3DRef: 3D Dataset and Benchmark for Reflection Detection in RGB and Lidar Data
por: Zhao, Xiting, et al.
Publicado: (2024) -
HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation
por: Yu, Zihui, et al.
Publicado: (2026) -
From Observation to Action: Latent Action-based Primitive Segmentation for VLA Pre-training in Industrial Settings
por: Zhang, Jiajie, et al.
Publicado: (2025) -
OnSiteVRU: A High-Resolution Trajectory Dataset for High-Density Vulnerable Road Users
por: Yan, Zhangcun, et al.
Publicado: (2025) -
High-Definition 5MP Stereo Vision Sensing for Robotics
por: Jiang, Leaf, et al.
Publicado: (2026)