GEAL: Generalizable 3D Affordance Learning with Cross-Modal Consistency
Fuente:
arXiv
Guardado en:
| Autores principales: | Lu, Dongyue, Kong, Lingdong, Huang, Tianxin, Lee, Gim Hee |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FreeSplat++: Generalizable 3D Gaussian Splatting for Efficient Indoor Scene Reconstruction
por: Wang, Yunsong, et al.
Publicado: (2025)
por: Wang, Yunsong, et al.
Publicado: (2025)
FreeSplat: Generalizable 3D Gaussian Splatting Towards Free-View Synthesis of Indoor Scenes
por: Wang, Yunsong, et al.
Publicado: (2024)
por: Wang, Yunsong, et al.
Publicado: (2024)
IAAO: Interactive Affordance Learning for Articulated Objects in 3D Environments
por: Zhang, Can, et al.
Publicado: (2025)
por: Zhang, Can, et al.
Publicado: (2025)
Unified Geometry and Color Compression Framework for Point Clouds via Generative Diffusion Priors
por: Huang, Tianxin, et al.
Publicado: (2025)
por: Huang, Tianxin, et al.
Publicado: (2025)
Learning to Decouple the Lights for 3D Face Texture Modeling
por: Huang, Tianxin, et al.
Publicado: (2024)
por: Huang, Tianxin, et al.
Publicado: (2024)
FlexEvent: Towards Flexible Event-Frame Object Detection at Varying Operational Frequencies
por: Lu, Dongyue, et al.
Publicado: (2024)
por: Lu, Dongyue, et al.
Publicado: (2024)
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors
por: Huang, Tianxin, et al.
Publicado: (2024)
por: Huang, Tianxin, et al.
Publicado: (2024)
Motion4D: Learning 3D-Consistent Motion and Semantics for 4D Scene Understanding
por: Zhou, Haoran, et al.
Publicado: (2025)
por: Zhou, Haoran, et al.
Publicado: (2025)
Enhancing Generalizability of Representation Learning for Data-Efficient 3D Scene Understanding
por: Wang, Yunsong, et al.
Publicado: (2024)
por: Wang, Yunsong, et al.
Publicado: (2024)
econSG: Efficient and Multi-view Consistent Open-Vocabulary 3D Semantic Gaussians
por: Zhang, Can, et al.
Publicado: (2025)
por: Zhang, Can, et al.
Publicado: (2025)
g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
VCR-GauS: View Consistent Depth-Normal Regularizer for Gaussian Surface Reconstruction
por: Chen, Hanlin, et al.
Publicado: (2024)
por: Chen, Hanlin, et al.
Publicado: (2024)
DiHuR: Diffusion-Guided Generalizable Human Reconstruction
por: Chen, Jinnan, et al.
Publicado: (2024)
por: Chen, Jinnan, et al.
Publicado: (2024)
GOV-NeSF: Generalizable Open-Vocabulary Neural Semantic Fields
por: Wang, Yunsong, et al.
Publicado: (2024)
por: Wang, Yunsong, et al.
Publicado: (2024)
DOGS: Distributed-Oriented Gaussian Splatting for Large-Scale 3D Reconstruction Via Gaussian Consensus
por: Chen, Yu, et al.
Publicado: (2024)
por: Chen, Yu, et al.
Publicado: (2024)
SCAPO: Self-Supervised Category-Level Articulated Pose Estimation from a Single 3D Observation
por: Zhang, Can, et al.
Publicado: (2026)
por: Zhang, Can, et al.
Publicado: (2026)
TriRelVLA: Triadic Relational Structure for Generalizable Embodied Manipulation
por: Zhou, Hanyu, et al.
Publicado: (2026)
por: Zhou, Hanyu, et al.
Publicado: (2026)
HandMCM: Multi-modal Point Cloud-based Correspondence State Space Model for 3D Hand Pose Estimation
por: Cheng, Wencan, et al.
Publicado: (2026)
por: Cheng, Wencan, et al.
Publicado: (2026)
LLaVA-4D: Embedding SpatioTemporal Prompt into LMMs for 4D Scene Understanding
por: Zhou, Hanyu, et al.
Publicado: (2025)
por: Zhou, Hanyu, et al.
Publicado: (2025)
SmileSplat: Generalizable Gaussian Splats for Unconstrained Sparse Images
por: Li, Yanyan, et al.
Publicado: (2024)
por: Li, Yanyan, et al.
Publicado: (2024)
Uni4D-LLM: A Unified SpatioTemporal-Aware VLM for 4D Understanding and Generation
por: Zhou, Hanyu, et al.
Publicado: (2025)
por: Zhou, Hanyu, et al.
Publicado: (2025)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
Perspective-Invariant 3D Object Detection
por: Liang, Ao, et al.
Publicado: (2025)
por: Liang, Ao, et al.
Publicado: (2025)
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
por: Lu, Dongyue, et al.
Publicado: (2025)
por: Lu, Dongyue, et al.
Publicado: (2025)
DiSR-NeRF: Diffusion-Guided View-Consistent Super-Resolution NeRF
por: Lee, Jie Long, et al.
Publicado: (2024)
por: Lee, Jie Long, et al.
Publicado: (2024)
ChatSplat: 3D Conversational Gaussian Splatting
por: Chen, Hanlin, et al.
Publicado: (2024)
por: Chen, Hanlin, et al.
Publicado: (2024)
PoseCrafter: Extreme Pose Estimation with Hybrid Video Synthesis
por: Mao, Qing, et al.
Publicado: (2025)
por: Mao, Qing, et al.
Publicado: (2025)
Reconstructing Close Human Interaction with Appearance and Proxemics Reasoning
por: Huang, Buzhen, et al.
Publicado: (2025)
por: Huang, Buzhen, et al.
Publicado: (2025)
Flow4DGS-SLAM: Optical Flow-Guided 4D Gaussian Splatting SLAM
por: Wang, Yunsong, et al.
Publicado: (2026)
por: Wang, Yunsong, et al.
Publicado: (2026)
MotionScale: Reconstructing Appearance, Geometry, and Motion of Dynamic Scenes with Scalable 4D Gaussian Splatting
por: Zhou, Haoran, et al.
Publicado: (2026)
por: Zhou, Haoran, et al.
Publicado: (2026)
Visual Foundation Models Boost Cross-Modal Unsupervised Domain Adaptation for 3D Semantic Segmentation
por: Xu, Jingyi, et al.
Publicado: (2024)
por: Xu, Jingyi, et al.
Publicado: (2024)
Syn-to-Real Unsupervised Domain Adaptation for Indoor 3D Object Detection
por: Wang, Yunsong, et al.
Publicado: (2024)
por: Wang, Yunsong, et al.
Publicado: (2024)
MVSDet: Multi-View Indoor 3D Object Detection via Efficient Plane Sweeps
por: Xu, Yating, et al.
Publicado: (2024)
por: Xu, Yating, et al.
Publicado: (2024)
SPIRAL: Semantic-Aware Progressive LiDAR Scene Generation and Understanding
por: Zhu, Dekai, et al.
Publicado: (2025)
por: Zhu, Dekai, et al.
Publicado: (2025)
DiET-GS: Diffusion Prior and Event Stream-Assisted Motion Deblurring 3D Gaussian Splatting
por: Lee, Seungjun, et al.
Publicado: (2025)
por: Lee, Seungjun, et al.
Publicado: (2025)
Segment Any 3D Object with Language
por: Lee, Seungjun, et al.
Publicado: (2024)
por: Lee, Seungjun, et al.
Publicado: (2024)
Learning to Generate 4D LiDAR Sequences
por: Liang, Ao, et al.
Publicado: (2025)
por: Liang, Ao, et al.
Publicado: (2025)
D3D-VLP: Dynamic 3D Vision-Language-Planning Model for Embodied Grounding and Navigation
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
Segment Any Events with Language
por: Lee, Seungjun, et al.
Publicado: (2026)
por: Lee, Seungjun, et al.
Publicado: (2026)
EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding
por: Lee, Seungjun, et al.
Publicado: (2026)
por: Lee, Seungjun, et al.
Publicado: (2026)
Ejemplares similares
-
FreeSplat++: Generalizable 3D Gaussian Splatting for Efficient Indoor Scene Reconstruction
por: Wang, Yunsong, et al.
Publicado: (2025) -
FreeSplat: Generalizable 3D Gaussian Splatting Towards Free-View Synthesis of Indoor Scenes
por: Wang, Yunsong, et al.
Publicado: (2024) -
IAAO: Interactive Affordance Learning for Articulated Objects in 3D Environments
por: Zhang, Can, et al.
Publicado: (2025) -
Unified Geometry and Color Compression Framework for Point Clouds via Generative Diffusion Priors
por: Huang, Tianxin, et al.
Publicado: (2025) -
Learning to Decouple the Lights for 3D Face Texture Modeling
por: Huang, Tianxin, et al.
Publicado: (2024)