3D-LMVIC: Learning-based Multi-View Image Coding with 3D Gaussian Geometric Priors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yujun, Chen, Bin, Lian, Niu, An, Baoyi, Xia, Shu-Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
par: Luo, Tianci, et autres
Publié: (2026)
par: Luo, Tianci, et autres
Publié: (2026)
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
par: Lian, Niu, et autres
Publié: (2025)
par: Lian, Niu, et autres
Publié: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
Efficient Self-Supervised Video Hashing with Selective State Spaces
par: Wang, Jinpeng, et autres
Publié: (2024)
par: Wang, Jinpeng, et autres
Publié: (2024)
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2023)
par: Wang, Yuting, et autres
Publié: (2023)
Zero-Shot Visual Grounding in 3D Gaussians via View Retrieval
par: Liao, Liwei, et autres
Publié: (2025)
par: Liao, Liwei, et autres
Publié: (2025)
3D Gaussian Editing with A Single Image
par: Luo, Guan, et autres
Publié: (2024)
par: Luo, Guan, et autres
Publié: (2024)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
par: Lian, Niu, et autres
Publié: (2026)
par: Lian, Niu, et autres
Publié: (2026)
REArtGS: Reconstructing and Generating Articulated Objects via 3D Gaussian Splatting with Geometric and Motion Constraints
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
Disparity-based Stereo Image Compression with Aligned Cross-View Priors
par: Zhai, Yongqi, et autres
Publié: (2022)
par: Zhai, Yongqi, et autres
Publié: (2022)
A Hierarchical Compression Technique for 3D Gaussian Splatting Compression
par: Huang, He, et autres
Publié: (2024)
par: Huang, He, et autres
Publié: (2024)
Compression of 3D Gaussian Splatting with Optimized Feature Planes and Standard Video Codecs
par: Lee, Soonbin, et autres
Publié: (2025)
par: Lee, Soonbin, et autres
Publié: (2025)
GaussianForest: Hierarchical-Hybrid 3D Gaussian Splatting for Compressed Scene Modeling
par: Zhang, Fengyi, et autres
Publié: (2024)
par: Zhang, Fengyi, et autres
Publié: (2024)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
MM-Point: Multi-View Information-Enhanced Multi-Modal Self-Supervised 3D Point Cloud Understanding
par: Yu, Hai-Tao, et autres
Publié: (2024)
par: Yu, Hai-Tao, et autres
Publié: (2024)
Dual Enhancement on 3D Vision-Language Perception for Monocular 3D Visual Grounding
par: Li, Yuzhen, et autres
Publié: (2025)
par: Li, Yuzhen, et autres
Publié: (2025)
Representation Discrepancy Bridging Method for Remote Sensing Image-Text Retrieval
par: Ning, Hailong, et autres
Publié: (2025)
par: Ning, Hailong, et autres
Publié: (2025)
Advancing 3D Scene Understanding with MV-ScanQA Multi-View Reasoning Evaluation and TripAlign Pre-training Dataset
par: Mo, Wentao, et autres
Publié: (2025)
par: Mo, Wentao, et autres
Publié: (2025)
Ambiguity-Aware and High-Order Relation Learning for Multi-Grained Image-Text Matching
par: Chen, Junyu, et autres
Publié: (2025)
par: Chen, Junyu, et autres
Publié: (2025)
Enhancing 3D Gaussian Splatting Compression via Spatial Condition-based Prediction
par: Ma, Jingui, et autres
Publié: (2025)
par: Ma, Jingui, et autres
Publié: (2025)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
par: Chen, Yang, et autres
Publié: (2024)
par: Chen, Yang, et autres
Publié: (2024)
Adaptive 3D Gaussian Splatting Video Streaming
par: Gong, Han, et autres
Publié: (2025)
par: Gong, Han, et autres
Publié: (2025)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
par: Dong, Wenqi, et autres
Publié: (2025)
par: Dong, Wenqi, et autres
Publié: (2025)
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
par: Zhang, Zhongwei, et autres
Publié: (2024)
par: Zhang, Zhongwei, et autres
Publié: (2024)
GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting
par: Yu, Hongyun, et autres
Publié: (2024)
par: Yu, Hongyun, et autres
Publié: (2024)
Efficient Object-centric Representation Learning with Pre-trained Geometric Prior
par: Khac, Phúc H. Le, et autres
Publié: (2024)
par: Khac, Phúc H. Le, et autres
Publié: (2024)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
DiET-GS: Diffusion Prior and Event Stream-Assisted Motion Deblurring 3D Gaussian Splatting
par: Lee, Seungjun, et autres
Publié: (2025)
par: Lee, Seungjun, et autres
Publié: (2025)
Creatively Upscaling Images with Global-Regional Priors
par: Qian, Yurui, et autres
Publié: (2025)
par: Qian, Yurui, et autres
Publié: (2025)
Riemann-based Multi-scale Attention Reasoning Network for Text-3D Retrieval
par: Li, Wenrui, et autres
Publié: (2024)
par: Li, Wenrui, et autres
Publié: (2024)
LapisGS: Layered Progressive 3D Gaussian Splatting for Adaptive Streaming
par: Shi, Yuang, et autres
Publié: (2024)
par: Shi, Yuang, et autres
Publié: (2024)
Sketch and Patch: Efficient 3D Gaussian Representation for Man-Made Scenes
par: Shi, Yuang, et autres
Publié: (2025)
par: Shi, Yuang, et autres
Publié: (2025)
PointCoT: A Multi-modal Benchmark for Explicit 3D Geometric Reasoning
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
CUS3D :CLIP-based Unsupervised 3D Segmentation via Object-level Denoise
par: Yu, Fuyang, et autres
Publié: (2024)
par: Yu, Fuyang, et autres
Publié: (2024)
Towards Efficient Low-rate Image Compression with Frequency-aware Diffusion Prior Refinement
par: Xia, Yichong, et autres
Publié: (2026)
par: Xia, Yichong, et autres
Publié: (2026)
GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting
par: Cho, Kyusun, et autres
Publié: (2024)
par: Cho, Kyusun, et autres
Publié: (2024)
RealX3D: A Physically-Degraded 3D Benchmark for Multi-view Visual Restoration and Reconstruction
par: Liu, Shuhong, et autres
Publié: (2025)
par: Liu, Shuhong, et autres
Publié: (2025)
3DMIT: 3D Multi-modal Instruction Tuning for Scene Understanding
par: Li, Zeju, et autres
Publié: (2024)
par: Li, Zeju, et autres
Publié: (2024)
MTFusion: Reconstructing Any 3D Object from Single Image Using Multi-word Textual Inversion
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
Documents similaires
-
Love Me, Love My Label: Rethinking the Role of Labels in Prompt Retrieval for Visual In-Context Learning
par: Luo, Tianci, et autres
Publié: (2026) -
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
par: Lian, Niu, et autres
Publié: (2025) -
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025) -
Efficient Self-Supervised Video Hashing with Selective State Spaces
par: Wang, Jinpeng, et autres
Publié: (2024) -
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2023)