GaussianCross: Cross-modal Self-supervised 3D Representation Learning via Gaussian Splatting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Lei, Wang, Yi, Zhang, Yi, Liu, Moyun, Chau, Lap-Pui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SGIFormer: Semantic-guided and Geometric-enhanced Interleaving Transformer for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2024)
par: Yao, Lei, et autres
Publié: (2024)
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
par: Yao, Lei, et autres
Publié: (2026)
par: Yao, Lei, et autres
Publié: (2026)
GVSynergy-Det: Synergistic Gaussian-Voxel Representations for Multi-View 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2026)
par: Yao, Lei, et autres
Publié: (2026)
Towards Blind Bitstream-corrupted Video Recovery via a Visual Foundation Model-driven Framework
par: Liu, Tianyi, et autres
Publié: (2025)
par: Liu, Tianyi, et autres
Publié: (2025)
A Survey on 3D Gaussian Splatting
par: Chen, Guikun, et autres
Publié: (2024)
par: Chen, Guikun, et autres
Publié: (2024)
FlashSplat: 2D to 3D Gaussian Splatting Segmentation Solved Optimally
par: Shen, Qiuhong, et autres
Publié: (2024)
par: Shen, Qiuhong, et autres
Publié: (2024)
CountingFruit: Language-Guided 3D Fruit Counting with Semantic Gaussian Splatting
par: Li, Fengze, et autres
Publié: (2025)
par: Li, Fengze, et autres
Publié: (2025)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
par: Yu, Hongyun, et autres
Publié: (2024)
par: Yu, Hongyun, et autres
Publié: (2024)
Adaptive 3D Gaussian Splatting Video Streaming
par: Gong, Han, et autres
Publié: (2025)
par: Gong, Han, et autres
Publié: (2025)
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
par: Zhang, Xinjie, et autres
Publié: (2024)
par: Zhang, Xinjie, et autres
Publié: (2024)
ByteNet: Rethinking Multimedia File Fragment Classification through Visual Perspectives
par: Liu, Wenyang, et autres
Publié: (2024)
par: Liu, Wenyang, et autres
Publié: (2024)
GGAvatar: Reconstructing Garment-Separated 3D Gaussian Splatting Avatars from Monocular Video
par: Chen, Jingxuan
Publié: (2024)
par: Chen, Jingxuan
Publié: (2024)
GaussianForest: Hierarchical-Hybrid 3D Gaussian Splatting for Compressed Scene Modeling
par: Zhang, Fengyi, et autres
Publié: (2024)
par: Zhang, Fengyi, et autres
Publié: (2024)
GSVC: Efficient Video Representation and Compression Through 2D Gaussian Splatting
par: Wang, Longan, et autres
Publié: (2025)
par: Wang, Longan, et autres
Publié: (2025)
CLASP: Cross-modal Salient Anchor-based Semantic Propagation for Weakly-supervised Dense Audio-Visual Event Localization
par: Zhou, Jinxing, et autres
Publié: (2025)
par: Zhou, Jinxing, et autres
Publié: (2025)
DiET-GS: Diffusion Prior and Event Stream-Assisted Motion Deblurring 3D Gaussian Splatting
par: Lee, Seungjun, et autres
Publié: (2025)
par: Lee, Seungjun, et autres
Publié: (2025)
Enhancing 3D Gaussian Splatting Compression via Spatial Condition-based Prediction
par: Ma, Jingui, et autres
Publié: (2025)
par: Ma, Jingui, et autres
Publié: (2025)
REArtGS: Reconstructing and Generating Articulated Objects via 3D Gaussian Splatting with Geometric and Motion Constraints
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
SizeGS: Size-aware Compression of 3D Gaussian Splatting via Mixed Integer Programming
par: Xie, Shuzhao, et autres
Publié: (2024)
par: Xie, Shuzhao, et autres
Publié: (2024)
A Hierarchical Compression Technique for 3D Gaussian Splatting Compression
par: Huang, He, et autres
Publié: (2024)
par: Huang, He, et autres
Publié: (2024)
Cross-modal Causal Intervention for Alzheimer's Disease Prediction
par: Jin, Yutao, et autres
Publié: (2025)
par: Jin, Yutao, et autres
Publié: (2025)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
par: Cho, Kyusun, et autres
Publié: (2024)
par: Cho, Kyusun, et autres
Publié: (2024)
LapisGS: Layered Progressive 3D Gaussian Splatting for Adaptive Streaming
par: Shi, Yuang, et autres
Publié: (2024)
par: Shi, Yuang, et autres
Publié: (2024)
CLCR: Cross-Level Semantic Collaborative Representation for Multimodal Learning
par: Meng, Chunlei, et autres
Publié: (2026)
par: Meng, Chunlei, et autres
Publié: (2026)
Compression of 3D Gaussian Splatting with Optimized Feature Planes and Standard Video Codecs
par: Lee, Soonbin, et autres
Publié: (2025)
par: Lee, Soonbin, et autres
Publié: (2025)
Mitigating Cross-modal Representation Bias for Multicultural Image-to-Recipe Retrieval
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
ASR-enhanced Multimodal Representation Learning for Cross-Domain Product Retrieval
par: Zhao, Ruixiang, et autres
Publié: (2024)
par: Zhao, Ruixiang, et autres
Publié: (2024)
PRoGS: Progressive Rendering of Gaussian Splats
par: Zoomers, Brent, et autres
Publié: (2024)
par: Zoomers, Brent, et autres
Publié: (2024)
Self-supervised Photographic Image Layout Representation Learning
par: Zhao, Zhaoran, et autres
Publié: (2024)
par: Zhao, Zhaoran, et autres
Publié: (2024)
2DGS-Avatar: Animatable High-fidelity Clothed Avatar via 2D Gaussian Splatting
par: Yan, Qipeng, et autres
Publié: (2025)
par: Yan, Qipeng, et autres
Publié: (2025)
Deep Reversible Consistency Learning for Cross-modal Retrieval
par: Pu, Ruitao, et autres
Publié: (2025)
par: Pu, Ruitao, et autres
Publié: (2025)
D-FCGS: Feedforward Compression of Dynamic Gaussian Splatting for Free-Viewpoint Videos
par: Zhang, Wenkang, et autres
Publié: (2025)
par: Zhang, Wenkang, et autres
Publié: (2025)
MesonGS++: Post-training Compression of 3D Gaussian Splatting with Hyperparameter Searching
par: Xie, Shuzhao, et autres
Publié: (2026)
par: Xie, Shuzhao, et autres
Publié: (2026)
Perceive-Sample-Compress: Towards Real-Time 3D Gaussian Splatting
par: Wang, Zijian, et autres
Publié: (2025)
par: Wang, Zijian, et autres
Publié: (2025)
SceneDreamer360: Text-Driven 3D-Consistent Scene Generation with Panoramic Gaussian Splatting
par: Li, Wenrui, et autres
Publié: (2024)
par: Li, Wenrui, et autres
Publié: (2024)
Sketch and Patch: Efficient 3D Gaussian Representation for Man-Made Scenes
par: Shi, Yuang, et autres
Publié: (2025)
par: Shi, Yuang, et autres
Publié: (2025)
P-GSVC: Layered Progressive 2D Gaussian Splatting for Scalable Image and Video
par: Wang, Longan, et autres
Publié: (2026)
par: Wang, Longan, et autres
Publié: (2026)
Controllable Expressive 3D Facial Animation via Diffusion in a Unified Multimodal Space
par: Liu, Kangwei, et autres
Publié: (2025)
par: Liu, Kangwei, et autres
Publié: (2025)
SwinGS: Sliding Window Gaussian Splatting for Volumetric Video Streaming with Arbitrary Length
par: Liu, Bangya, et autres
Publié: (2024)
par: Liu, Bangya, et autres
Publié: (2024)
Documents similaires
-
SGIFormer: Semantic-guided and Geometric-enhanced Interleaving Transformer for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2024) -
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
par: Yao, Lei, et autres
Publié: (2026) -
GVSynergy-Det: Synergistic Gaussian-Voxel Representations for Multi-View 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025) -
LaSSM: Efficient Semantic-Spatial Query Decoding via Local Aggregation and State Space Models for 3D Instance Segmentation
par: Yao, Lei, et autres
Publié: (2026) -
Towards Blind Bitstream-corrupted Video Recovery via a Visual Foundation Model-driven Framework
par: Liu, Tianyi, et autres
Publié: (2025)