Semantic Compression of 3D Objects for Open and Collaborative Virtual Worlds
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dotzel, Jordan, Montes, Tony, Abdelfattah, Mohamed S., Zhang, Zhiru |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring the Limits of Semantic Image Compression at Micro-bits per Pixel
par: Dotzel, Jordan, et autres
Publié: (2024)
par: Dotzel, Jordan, et autres
Publié: (2024)
Learning from Students: Applying t-Distributions to Explore Accurate and Efficient Formats for LLMs
par: Dotzel, Jordan, et autres
Publié: (2024)
par: Dotzel, Jordan, et autres
Publié: (2024)
GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
par: Shao, Yawen, et autres
Publié: (2024)
par: Shao, Yawen, et autres
Publié: (2024)
Open-World Object Counting in Videos
par: Amini-Naieni, Niki, et autres
Publié: (2025)
par: Amini-Naieni, Niki, et autres
Publié: (2025)
OpenGS-SLAM: Open-Set Dense Semantic SLAM with 3D Gaussian Splatting for Object-Level Scene Understanding
par: Yang, Dianyi, et autres
Publié: (2025)
par: Yang, Dianyi, et autres
Publié: (2025)
Open-CRB: Towards Open World Active Learning for 3D Object Detection
par: Chen, Zhuoxiao, et autres
Publié: (2023)
par: Chen, Zhuoxiao, et autres
Publié: (2023)
3D-Agent:Tri-Modal Multi-Agent Collaboration for Scalable 3D Object Annotation
par: Zhang, Jusheng, et autres
Publié: (2026)
par: Zhang, Jusheng, et autres
Publié: (2026)
Dream2Flow: Bridging Video Generation and Open-World Manipulation with 3D Object Flow
par: Dharmarajan, Karthik, et autres
Publié: (2025)
par: Dharmarajan, Karthik, et autres
Publié: (2025)
OpenGround: Active Cognition-based Reasoning for Open-World 3D Visual Grounding
par: Huang, Wenyuan, et autres
Publié: (2025)
par: Huang, Wenyuan, et autres
Publié: (2025)
CoDiff: Conditional Diffusion Model for Collaborative 3D Object Detection
par: Huang, Zhe, et autres
Publié: (2025)
par: Huang, Zhe, et autres
Publié: (2025)
From Open Vocabulary to Open World: Teaching Vision Language Models to Detect Novel Objects
par: Li, Zizhao, et autres
Publié: (2024)
par: Li, Zizhao, et autres
Publié: (2024)
Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion
par: Liang, Li, et autres
Publié: (2025)
par: Liang, Li, et autres
Publié: (2025)
Compress3D: a Compressed Latent Space for 3D Generation from a Single Image
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
Encodings for Prediction-based Neural Architecture Search
par: Akhauri, Yash, et autres
Publié: (2024)
par: Akhauri, Yash, et autres
Publié: (2024)
SpatialForge: Bootstrapping 3D-Aware Spatial Reasoning from Open-World 2D Images
par: Liu, Zishan, et autres
Publié: (2026)
par: Liu, Zishan, et autres
Publié: (2026)
GeoGuide: Hierarchical Geometric Guidance for Open-Vocabulary 3D Semantic Segmentation
par: Tao, Xujing, et autres
Publié: (2026)
par: Tao, Xujing, et autres
Publié: (2026)
Co-Fusion4D: Spatio-temporal Collaborative Fusion for Robust 3D Object Detection
par: Li, Wenxuan, et autres
Publié: (2026)
par: Li, Wenxuan, et autres
Publié: (2026)
XMask3D: Cross-modal Mask Reasoning for Open Vocabulary 3D Semantic Segmentation
par: Wang, Ziyi, et autres
Publié: (2024)
par: Wang, Ziyi, et autres
Publié: (2024)
DualMem: Bypassing the Objectness Bottleneck for Calibrated Unknown-Stream Filtering in Open-World Object Detection
par: Xiao, Yingjun, et autres
Publié: (2026)
par: Xiao, Yingjun, et autres
Publié: (2026)
Towards Adaptive Open-Set Object Detection via Category-Level Collaboration Knowledge Mining
par: Ji, Yuqi, et autres
Publié: (2026)
par: Ji, Yuqi, et autres
Publié: (2026)
OV-DQUO: Open-Vocabulary DETR with Denoising Text Query Training and Open-World Unknown Objects Supervision
par: Wang, Junjie, et autres
Publié: (2024)
par: Wang, Junjie, et autres
Publié: (2024)
Beyond Bare Queries: Open-Vocabulary Object Grounding with 3D Scene Graph
par: Linok, Sergey, et autres
Publié: (2024)
par: Linok, Sergey, et autres
Publié: (2024)
Find n' Propagate: Open-Vocabulary 3D Object Detection in Urban Environments
par: Etchegaray, Djamahl, et autres
Publié: (2024)
par: Etchegaray, Djamahl, et autres
Publié: (2024)
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
par: He, Zhuolin, et autres
Publié: (2024)
par: He, Zhuolin, et autres
Publié: (2024)
Fine-Grained Pillar Feature Encoding Via Spatio-Temporal Virtual Grid for 3D Object Detection
par: Park, Konyul, et autres
Publié: (2024)
par: Park, Konyul, et autres
Publié: (2024)
Image-Guided Semantic Pseudo-LiDAR Point Generation for 3D Object Detection
par: Lee, Minseung, et autres
Publié: (2024)
par: Lee, Minseung, et autres
Publié: (2024)
Fast Sampling Through The Reuse Of Attention Maps In Diffusion Models
par: Hunter, Rosco, et autres
Publié: (2023)
par: Hunter, Rosco, et autres
Publié: (2023)
ExtrinSplat: Decoupling Geometry and Semantics for Open-Vocabulary Understanding in 3D Gaussian Splatting
par: Ding, Jiayu, et autres
Publié: (2025)
par: Ding, Jiayu, et autres
Publié: (2025)
WoMAP: World Models For Embodied Open-Vocabulary Object Localization
par: Yin, Tenny, et autres
Publié: (2025)
par: Yin, Tenny, et autres
Publié: (2025)
Articulated 3D Scene Graphs for Open-World Mobile Manipulation
par: Büchner, Martin, et autres
Publié: (2026)
par: Büchner, Martin, et autres
Publié: (2026)
dinov3.seg: Open-Vocabulary Semantic Segmentation with DINOv3
par: Dutta, Saikat, et autres
Publié: (2026)
par: Dutta, Saikat, et autres
Publié: (2026)
RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding
par: Yang, Jihan, et autres
Publié: (2023)
par: Yang, Jihan, et autres
Publié: (2023)
Collaborative Space Object Detection with Multi-Satellite Viewpoints in LEO Constellations
par: Qu, Xingyu, et autres
Publié: (2026)
par: Qu, Xingyu, et autres
Publié: (2026)
Taxonomy-Aware Continual Semantic Segmentation in Hyperbolic Spaces for Open-World Perception
par: Hindel, Julia, et autres
Publié: (2024)
par: Hindel, Julia, et autres
Publié: (2024)
Collaborative Learning for 3D Hand-Object Reconstruction and Compositional Action Recognition from Egocentric RGB Videos Using Superquadrics
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
par: Tse, Tze Ho Elden, et autres
Publié: (2025)
Seeking Consensus: Geometric-Semantic On-the-Fly Recalibration for Open-Vocabulary Remote Sensing Semantic Segmentation
par: Wang, Guanchun, et autres
Publié: (2026)
par: Wang, Guanchun, et autres
Publié: (2026)
Collaboration of Teachers for Semi-supervised Object Detection
par: Chen, Liyu, et autres
Publié: (2024)
par: Chen, Liyu, et autres
Publié: (2024)
Open-vocabulary Mobile Manipulation in Unseen Dynamic Environments with 3D Semantic Maps
par: Qiu, Dicong, et autres
Publié: (2024)
par: Qiu, Dicong, et autres
Publié: (2024)
3D Reconstruction of Objects in Hands without Real World 3D Supervision
par: Prakash, Aditya, et autres
Publié: (2023)
par: Prakash, Aditya, et autres
Publié: (2023)
Nested Unfolding Network for Real-World Concealed Object Segmentation
par: He, Chunming, et autres
Publié: (2025)
par: He, Chunming, et autres
Publié: (2025)
Documents similaires
-
Exploring the Limits of Semantic Image Compression at Micro-bits per Pixel
par: Dotzel, Jordan, et autres
Publié: (2024) -
Learning from Students: Applying t-Distributions to Explore Accurate and Efficient Formats for LLMs
par: Dotzel, Jordan, et autres
Publié: (2024) -
GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
par: Shao, Yawen, et autres
Publié: (2024) -
Open-World Object Counting in Videos
par: Amini-Naieni, Niki, et autres
Publié: (2025) -
OpenGS-SLAM: Open-Set Dense Semantic SLAM with 3D Gaussian Splatting for Object-Level Scene Understanding
par: Yang, Dianyi, et autres
Publié: (2025)