$\text{VG}^2$GT: Voxel-Gaussian Splatting Visual Geometry Grounded Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Yibin, Pan, Yihan, Nan, Jun, Yang, Wenli, Chen, Liwei, Yi, Jianjun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FSFSplatter: Build Surface and Novel Views with Sparse-Views within 2min
par: Zhao, Yibin, et autres
Publié: (2025)
par: Zhao, Yibin, et autres
Publié: (2025)
VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction
par: Yan, Xiaoyang, et autres
Publié: (2026)
par: Yan, Xiaoyang, et autres
Publié: (2026)
VG3T: Visual Geometry Grounded Gaussian Transformer
par: Kim, Junho, et autres
Publié: (2025)
par: Kim, Junho, et autres
Publié: (2025)
GT2-GS: Geometry-aware Texture Transfer for Gaussian Splatting
par: Liu, Wenjie, et autres
Publié: (2025)
par: Liu, Wenjie, et autres
Publié: (2025)
Geometry-Grounded Gaussian Splatting
par: Zhang, Baowen, et autres
Publié: (2026)
par: Zhang, Baowen, et autres
Publié: (2026)
4D Neural Voxel Splatting: Dynamic Scene Rendering with Voxelized Guassian Splatting
par: Wu, Chun-Tin, et autres
Publié: (2025)
par: Wu, Chun-Tin, et autres
Publié: (2025)
TrajVG: 3D Trajectory-Coupled Visual Geometry Learning
par: Miao, Xingyu, et autres
Publié: (2026)
par: Miao, Xingyu, et autres
Publié: (2026)
HiVG: Hierarchical Multimodal Fine-grained Modulation for Visual Grounding
par: Xiao, Linhui, et autres
Publié: (2024)
par: Xiao, Linhui, et autres
Publié: (2024)
CLIP-VG: Self-paced Curriculum Adapting of CLIP for Visual Grounding
par: Xiao, Linhui, et autres
Publié: (2023)
par: Xiao, Linhui, et autres
Publié: (2023)
VoxelSplat: Dynamic Gaussian Splatting as an Effective Loss for Occupancy and Flow Prediction
par: Zhu, Ziyue, et autres
Publié: (2025)
par: Zhu, Ziyue, et autres
Publié: (2025)
ResVG: Enhancing Relation and Semantic Understanding in Multiple Instances for Visual Grounding
par: Zheng, Minghang, et autres
Publié: (2024)
par: Zheng, Minghang, et autres
Publié: (2024)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
par: Kang, Weitai, et autres
Publié: (2024)
par: Kang, Weitai, et autres
Publié: (2024)
SwimVG: Step-wise Multimodal Fusion and Adaption for Visual Grounding
par: Shi, Liangtao, et autres
Publié: (2025)
par: Shi, Liangtao, et autres
Publié: (2025)
PathVG: A New Benchmark and Dataset for Pathology Visual Grounding
par: Zhong, Chunlin, et autres
Publié: (2025)
par: Zhong, Chunlin, et autres
Publié: (2025)
VolSplat: Rethinking Feed-Forward 3D Gaussian Splatting with Voxel-Aligned Prediction
par: Wang, Weijie, et autres
Publié: (2025)
par: Wang, Weijie, et autres
Publié: (2025)
VGGT: Visual Geometry Grounded Transformer
par: Wang, Jianyuan, et autres
Publié: (2025)
par: Wang, Jianyuan, et autres
Publié: (2025)
QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer
par: Pan, Zhizhen, et autres
Publié: (2026)
par: Pan, Zhizhen, et autres
Publié: (2026)
Quantized Visual Geometry Grounded Transformer
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
PropVG: End-to-End Proposal-Driven Visual Grounding with Multi-Granularity Discrimination
par: Dai, Ming, et autres
Publié: (2025)
par: Dai, Ming, et autres
Publié: (2025)
InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams
par: Yuan, Shuai, et autres
Publié: (2026)
par: Yuan, Shuai, et autres
Publié: (2026)
AerialVG: A Challenging Benchmark for Aerial Visual Grounding by Exploring Positional Relations
par: Liu, Junli, et autres
Publié: (2025)
par: Liu, Junli, et autres
Publié: (2025)
SimVG: A Simple Framework for Visual Grounding with Decoupled Multi-modal Fusion
par: Dai, Ming, et autres
Publié: (2024)
par: Dai, Ming, et autres
Publié: (2024)
LLM4VG: Large Language Models Evaluation for Video Grounding
par: Feng, Wei, et autres
Publié: (2023)
par: Feng, Wei, et autres
Publié: (2023)
ProVG: Progressive Visual Grounding via Language Decoupling for Remote Sensing Imagery
par: Li, Ke, et autres
Publié: (2026)
par: Li, Ke, et autres
Publié: (2026)
UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning
par: Bai, Sule, et autres
Publié: (2025)
par: Bai, Sule, et autres
Publié: (2025)
GeM-VG: Towards Generalized Multi-image Visual Grounding with Multimodal Large Language Models
par: Zheng, Shurong, et autres
Publié: (2026)
par: Zheng, Shurong, et autres
Publié: (2026)
G4Splat: Geometry-Guided Gaussian Splatting with Generative Prior
par: Ni, Junfeng, et autres
Publié: (2025)
par: Ni, Junfeng, et autres
Publié: (2025)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
par: Wu, Guile, et autres
Publié: (2026)
par: Wu, Guile, et autres
Publié: (2026)
AgroVG: A Large-Scale Multi-Source Benchmark for Agricultural Visual Grounding
par: Li, Haocheng, et autres
Publié: (2026)
par: Li, Haocheng, et autres
Publié: (2026)
VG-TVP: Multimodal Procedural Planning via Visually Grounded Text-Video Prompting
par: Ilaslan, Muhammet Furkan, et autres
Publié: (2024)
par: Ilaslan, Muhammet Furkan, et autres
Publié: (2024)
VG-CoT: Towards Trustworthy Visual Reasoning via Grounded Chain-of-Thought
par: Lim, Byeonggeuk, et autres
Publié: (2026)
par: Lim, Byeonggeuk, et autres
Publié: (2026)
PointSplat: Efficient Geometry-Driven Pruning and Transformer Refinement for 3D Gaussian Splatting
par: Tran, Anh Thuan, et autres
Publié: (2026)
par: Tran, Anh Thuan, et autres
Publié: (2026)
Context and Geometry Aware Voxel Transformer for Semantic Scene Completion
par: Yu, Zhu, et autres
Publié: (2024)
par: Yu, Zhu, et autres
Publié: (2024)
Decoupling Motion and Geometry in 4D Gaussian Splatting
par: Zhang, Yi, et autres
Publié: (2026)
par: Zhang, Yi, et autres
Publié: (2026)
Emergent Outlier View Rejection in Visual Geometry Grounded Transformers
par: Han, Jisang, et autres
Publié: (2025)
par: Han, Jisang, et autres
Publié: (2025)
Reloc-VGGT: Visual Re-localization with Geometry Grounded Transformer
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
WaterVG: Waterway Visual Grounding based on Text-Guided Vision and mmWave Radar
par: Guan, Runwei, et autres
Publié: (2024)
par: Guan, Runwei, et autres
Publié: (2024)
GeoSplatting: Towards Geometry Guided Gaussian Splatting for Physically-based Inverse Rendering
par: Ye, Kai, et autres
Publié: (2024)
par: Ye, Kai, et autres
Publié: (2024)
SG-Splatting: Accelerating 3D Gaussian Splatting with Spherical Gaussians
par: Wang, Yiwen, et autres
Publié: (2024)
par: Wang, Yiwen, et autres
Publié: (2024)
EG-Gaussian: Epipolar Geometry and Graph Network Enhanced 3D Gaussian Splatting
par: Zhao, Beizhen, et autres
Publié: (2025)
par: Zhao, Beizhen, et autres
Publié: (2025)
Documents similaires
-
FSFSplatter: Build Surface and Novel Views with Sparse-Views within 2min
par: Zhao, Yibin, et autres
Publié: (2025) -
VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction
par: Yan, Xiaoyang, et autres
Publié: (2026) -
VG3T: Visual Geometry Grounded Gaussian Transformer
par: Kim, Junho, et autres
Publié: (2025) -
GT2-GS: Geometry-aware Texture Transfer for Gaussian Splatting
par: Liu, Wenjie, et autres
Publié: (2025) -
Geometry-Grounded Gaussian Splatting
par: Zhang, Baowen, et autres
Publié: (2026)