Enregistré dans:
| Auteurs principaux: | Hou, Jiawei, Zhang, Shenghao, Wang, Can, Gu, Zheng, Ling, Yonggen, Zeng, Taiping, Xue, Xiangyang, Zhang, Jingbo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.18814 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hi-Dyna Graph: Hierarchical Dynamic Scene Graph for Robotic Autonomy in Human-Centric Environments
par: Hou, Jiawei, et autres
Publié: (2025)
par: Hou, Jiawei, et autres
Publié: (2025)
LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical Planning
par: Hou, Jiawei, et autres
Publié: (2025)
par: Hou, Jiawei, et autres
Publié: (2025)
Topo-Field: Topometric mapping with Brain-inspired Hierarchical Layout-Object-Position Fields
par: Hou, Jiawei, et autres
Publié: (2024)
par: Hou, Jiawei, et autres
Publié: (2024)
Trace Anything: Representing Any Video in 4D via Trajectory Fields
par: Liu, Xinhang, et autres
Publié: (2025)
par: Liu, Xinhang, et autres
Publié: (2025)
Place Anything into Any Video
par: Liu, Ziling, et autres
Publié: (2024)
par: Liu, Ziling, et autres
Publié: (2024)
MindVoice: Reconstructing Intelligible Speech from Non-invasive Neural Signals with Pretrained Priors
par: Bao, Guangyin, et autres
Publié: (2026)
par: Bao, Guangyin, et autres
Publié: (2026)
Dynamic Manifold Hopfield Networks for Context-Dependent Associative Memory
par: Li, Chong, et autres
Publié: (2025)
par: Li, Chong, et autres
Publié: (2025)
Towards a Vision-Language Episodic Memory Framework: Large-scale Pretrained Model-Augmented Hippocampal Attractor Dynamics
par: Li, Chong, et autres
Publié: (2025)
par: Li, Chong, et autres
Publié: (2025)
Anything in Any Scene: Photorealistic Video Object Insertion
par: Bai, Chen, et autres
Publié: (2024)
par: Bai, Chen, et autres
Publié: (2024)
SAM-DAQ: Segment Anything Model with Depth-guided Adaptive Queries for RGB-D Video Salient Object Detection
par: Lin, Jia, et autres
Publié: (2025)
par: Lin, Jia, et autres
Publié: (2025)
Face Anything: 4D Face Reconstruction from Any Image Sequence
par: Kocasari, Umut, et autres
Publié: (2026)
par: Kocasari, Umut, et autres
Publié: (2026)
Depth Anything at Any Condition
par: Sun, Boyuan, et autres
Publié: (2025)
par: Sun, Boyuan, et autres
Publié: (2025)
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image
par: Liu, Xingyu, et autres
Publié: (2024)
par: Liu, Xingyu, et autres
Publié: (2024)
CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models
par: Wu, Rundi, et autres
Publié: (2024)
par: Wu, Rundi, et autres
Publié: (2024)
TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction
par: Zheng, Zhijie, et autres
Publié: (2026)
par: Zheng, Zhijie, et autres
Publié: (2026)
Enhanced Automotive Object Detection via RGB-D Fusion in a DiffusionDet Framework
par: Orfaig, Eliraz, et autres
Publié: (2024)
par: Orfaig, Eliraz, et autres
Publié: (2024)
RaSim: A Range-aware High-fidelity RGB-D Data Simulation Pipeline for Real-world Applications
par: Liu, Xingyu, et autres
Publié: (2024)
par: Liu, Xingyu, et autres
Publié: (2024)
SAM4D: Segment Anything in Camera and LiDAR Streams
par: Xu, Jianyun, et autres
Publié: (2025)
par: Xu, Jianyun, et autres
Publié: (2025)
SAM 2++: Tracking Anything at Any Granularity
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
Compress Any Segment Anything Model (SAM)
par: Fan, Juntong, et autres
Publié: (2025)
par: Fan, Juntong, et autres
Publié: (2025)
Universal Pose Pretraining for Generalizable Vision-Language-Action Policies
par: Lin, Haitao, et autres
Publié: (2026)
par: Lin, Haitao, et autres
Publié: (2026)
Tracking and Segmenting Anything in Any Modality
par: Zhang, Tianlu, et autres
Publié: (2025)
par: Zhang, Tianlu, et autres
Publié: (2025)
R4Det: 4D Radar-Camera Fusion for High-Performance 3D Object Detection
par: Xia, Zhongyu, et autres
Publié: (2026)
par: Xia, Zhongyu, et autres
Publié: (2026)
RadarGaussianDet3D: Gaussian Representation-based Real-time 3D Object Detection with 4D Automotive Radars
par: Xiong, Weiyi, et autres
Publié: (2025)
par: Xiong, Weiyi, et autres
Publié: (2025)
Depth Anything with Any Prior
par: Wang, Zehan, et autres
Publié: (2025)
par: Wang, Zehan, et autres
Publié: (2025)
GFreeDet: Exploiting Gaussian Splatting and Foundation Models for Model-free Unseen Object Detection in the BOP Challenge 2024
par: Liu, Xingyu, et autres
Publié: (2024)
par: Liu, Xingyu, et autres
Publié: (2024)
4DGCPro: Efficient Hierarchical 4D Gaussian Compression for Progressive Volumetric Video Streaming
par: Zheng, Zihan, et autres
Publié: (2025)
par: Zheng, Zihan, et autres
Publié: (2025)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
par: Guo, Ziyu, et autres
Publié: (2024)
par: Guo, Ziyu, et autres
Publié: (2024)
RGBX-DiffusionDet: A Framework for Multi-Modal RGB-X Object Detection Using DiffusionDet
par: Orfaig, Eliraz, et autres
Publié: (2025)
par: Orfaig, Eliraz, et autres
Publié: (2025)
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
par: Hou, Jiawei, et autres
Publié: (2024)
par: Hou, Jiawei, et autres
Publié: (2024)
PromptDet: A Lightweight 3D Object Detection Framework with LiDAR Prompts
par: Guo, Kun, et autres
Publié: (2024)
par: Guo, Kun, et autres
Publié: (2024)
Biomimetic Fibrous Bone Substitute Manufacture Through Non‐Solvent‐Assisted 3D Printing
par: Kunxi Zhang, et autres
Publié: (2025)
par: Kunxi Zhang, et autres
Publié: (2025)
STS-Mixer: Spatio-Temporal-Spectral Mixer for 4D Point Cloud Video Understanding
par: Li, Wenhao, et autres
Publié: (2026)
par: Li, Wenhao, et autres
Publié: (2026)
Detect Anything 3D in the Wild
par: Zhang, Hanxue, et autres
Publié: (2025)
par: Zhang, Hanxue, et autres
Publié: (2025)
Any4D: Unified Feed-Forward Metric 4D Reconstruction
par: Karhade, Jay, et autres
Publié: (2025)
par: Karhade, Jay, et autres
Publié: (2025)
Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images
par: Zhang, Chuanrui, et autres
Publié: (2024)
par: Zhang, Chuanrui, et autres
Publié: (2024)
Salient Object Detection in RGB-D Videos
par: Mou, Ao, et autres
Publié: (2023)
par: Mou, Ao, et autres
Publié: (2023)
Gaussian-Det: Learning Closed-Surface Gaussians for 3D Object Detection
par: Yan, Hongru, et autres
Publié: (2024)
par: Yan, Hongru, et autres
Publié: (2024)
DreamGaussian4D: Generative 4D Gaussian Splatting
par: Ren, Jiawei, et autres
Publié: (2023)
par: Ren, Jiawei, et autres
Publié: (2023)
WildDet3D: Scaling Promptable 3D Detection in the Wild
par: Huang, Weikai, et autres
Publié: (2026)
par: Huang, Weikai, et autres
Publié: (2026)
Documents similaires
-
Hi-Dyna Graph: Hierarchical Dynamic Scene Graph for Robotic Autonomy in Human-Centric Environments
par: Hou, Jiawei, et autres
Publié: (2025) -
LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical Planning
par: Hou, Jiawei, et autres
Publié: (2025) -
Topo-Field: Topometric mapping with Brain-inspired Hierarchical Layout-Object-Position Fields
par: Hou, Jiawei, et autres
Publié: (2024) -
Trace Anything: Representing Any Video in 4D via Trajectory Fields
par: Liu, Xinhang, et autres
Publié: (2025) -
Place Anything into Any Video
par: Liu, Ziling, et autres
Publié: (2024)