VIAFormer: Voxel-Image Alignment Transformer for High-Fidelity Voxel Refinement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fang, Tiancheng, Pan, Bowen, Chen, Lingxi, Lyu, Jiangjing, Lyu, Chengfei, Niu, Chaoyue, Wu, Fan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LESV: Language Embedded Sparse Voxel Fusion for Open-Vocabulary 3D Scene Understanding
par: Wang, Fusang, et autres
Publié: (2026)
par: Wang, Fusang, et autres
Publié: (2026)
Learning Association via Track-Detection Matching for Multi-Object Tracking
par: Adžemović, Momir
Publié: (2025)
par: Adžemović, Momir
Publié: (2025)
Generalization performance of neural mapping schemes for the space-time interpolation of satellite-derived ocean colour datasets
par: Nguyen, Thi Thuy Nga, et autres
Publié: (2025)
par: Nguyen, Thi Thuy Nga, et autres
Publié: (2025)
Observation-only learning of neural mapping schemes for gappy satellite-derived ocean colour parameters
par: Dorffer, Clément, et autres
Publié: (2025)
par: Dorffer, Clément, et autres
Publié: (2025)
Illumination and Shadows in Head Rotation: experiments with Denoising Diffusion Models
par: Asperti, Andrea, et autres
Publié: (2023)
par: Asperti, Andrea, et autres
Publié: (2023)
Removing Motion Artifact in MRI by Using a Perceptual Loss Driven Deep Learning Framework
par: Guo, Ziheng, et autres
Publié: (2026)
par: Guo, Ziheng, et autres
Publié: (2026)
Skullptor: High Fidelity 3D Head Reconstruction in Seconds with Multi-View Normal Prediction
par: Artru, Noé, et autres
Publié: (2026)
par: Artru, Noé, et autres
Publié: (2026)
AnySurf: Any Surface Generation with Directed Edge
par: Shi, Wenda, et autres
Publié: (2026)
par: Shi, Wenda, et autres
Publié: (2026)
Web-Scale Collection of Video Data for 4D Animal Reconstruction
par: Zhao, Brian Nlong, et autres
Publié: (2025)
par: Zhao, Brian Nlong, et autres
Publié: (2025)
Flexible-weighted Chamfer Distance: Enhanced Objective Function for Point Cloud Completion
par: Li, Jie, et autres
Publié: (2025)
par: Li, Jie, et autres
Publié: (2025)
Semi-supervised Latent Disentangled Diffusion Model for Textile Pattern Generation
par: Hu, Chenggong, et autres
Publié: (2026)
par: Hu, Chenggong, et autres
Publié: (2026)
RGB-Only Gaussian Splatting SLAM for Unbounded Outdoor Scenes
par: Yu, Sicheng, et autres
Publié: (2025)
par: Yu, Sicheng, et autres
Publié: (2025)
J-NeuS: Joint field optimization for Neural Surface reconstruction in urban scenes with limited image overlap
par: Wang, Fusang, et autres
Publié: (2025)
par: Wang, Fusang, et autres
Publié: (2025)
Revealing an Unattractivity Bias in Mental Reconstruction of Occluded Faces using Generative Image Models
par: Riedmann, Frederik, et autres
Publié: (2024)
par: Riedmann, Frederik, et autres
Publié: (2024)
PPC-MT: Parallel Point Cloud Completion with Mamba-Transformer Hybrid Architecture
par: Li, Jie, et autres
Publié: (2026)
par: Li, Jie, et autres
Publié: (2026)
3DGS-to-PC: Convert a 3D Gaussian Splatting Scene into a Dense Point Cloud or Mesh
par: Stuart, Lewis A G, et autres
Publié: (2025)
par: Stuart, Lewis A G, et autres
Publié: (2025)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
LVP-CLIP:Revisiting CLIP for Continual Learning with Label Vector Pool
par: Ma, Yue, et autres
Publié: (2024)
par: Ma, Yue, et autres
Publié: (2024)
Normalizing Flow-Based Metric for Image Generation
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
Bridging Knowledge Gap Between Image Inpainting and Large-Area Visible Watermark Removal
par: Leng, Yicheng, et autres
Publié: (2025)
par: Leng, Yicheng, et autres
Publié: (2025)
When in Doubt, Think Slow: Iterative Reasoning with Latent Imagination
par: Benfeghoul, Martin, et autres
Publié: (2024)
par: Benfeghoul, Martin, et autres
Publié: (2024)
Graph-PiT: Enhancing Structural Coherence in Part-Based Image Synthesis via Graph Priors
par: Zhang, Junbin, et autres
Publié: (2026)
par: Zhang, Junbin, et autres
Publié: (2026)
GIQ: Benchmarking 3D Geometric Reasoning of Vision Foundation Models with Simulated and Real Polyhedra
par: Michalkiewicz, Mateusz, et autres
Publié: (2025)
par: Michalkiewicz, Mateusz, et autres
Publié: (2025)
Learnings from Scaling Visual Tokenizers for Reconstruction and Generation
par: Hansen-Estruch, Philippe, et autres
Publié: (2025)
par: Hansen-Estruch, Philippe, et autres
Publié: (2025)
Light Transport-aware Diffusion Posterior Sampling for Single-View Reconstruction of 3D Volumes
par: Leonard, Ludwic, et autres
Publié: (2025)
par: Leonard, Ludwic, et autres
Publié: (2025)
Improving Neuropathological Reconstruction Fidelity via AI Slice Imputation
par: Aguirre, Marina Crespo, et autres
Publié: (2026)
par: Aguirre, Marina Crespo, et autres
Publié: (2026)
Non-Robust Features are Not Always Useful in One-Class Classification
par: Lau, Matthew, et autres
Publié: (2024)
par: Lau, Matthew, et autres
Publié: (2024)
VLM-NCD:Novel Class Discovery with Vision-Based Large Language Models
par: Su, Yuetong, et autres
Publié: (2025)
par: Su, Yuetong, et autres
Publié: (2025)
PlantDreamer: Achieving Realistic 3D Plant Models with Diffusion-Guided Gaussian Splatting
par: Hartley, Zane K J, et autres
Publié: (2025)
par: Hartley, Zane K J, et autres
Publié: (2025)
MRD: Using Physically Based Differentiable Rendering to Probe Vision Models for 3D Scene Understanding
par: Beilharz, Benjamin, et autres
Publié: (2025)
par: Beilharz, Benjamin, et autres
Publié: (2025)
Is Single-View Mesh Reconstruction Ready for Robotics?
par: Nolte, Frederik, et autres
Publié: (2025)
par: Nolte, Frederik, et autres
Publié: (2025)
Mask-Conditioned Voxel Diffusion for Joint Geometry and Color Inpainting
par: Sumuk, Aarya
Publié: (2026)
par: Sumuk, Aarya
Publié: (2026)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
FLD+: Data-efficient Evaluation Metric for Generative Models
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
WaveMixSR-V2: Enhancing Super-resolution with Higher Efficiency
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
Sequence Matters: Harnessing Video Models in 3D Super-Resolution
par: Ko, Hyun-kyu, et autres
Publié: (2024)
par: Ko, Hyun-kyu, et autres
Publié: (2024)
Lost in Latent Space: Disentangled Models and the Challenge of Combinatorial Generalisation
par: Montero, Milton L., et autres
Publié: (2022)
par: Montero, Milton L., et autres
Publié: (2022)
FACT: Multinomial Misalignment Classification for Point Cloud Registration
par: Dillén, Ludvig, et autres
Publié: (2025)
par: Dillén, Ludvig, et autres
Publié: (2025)
Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models
par: Li, Jinhao, et autres
Publié: (2024)
par: Li, Jinhao, et autres
Publié: (2024)
Salient Concept-Aware Generative Data Augmentation
par: Zhao, Tianchen, et autres
Publié: (2025)
par: Zhao, Tianchen, et autres
Publié: (2025)
Documents similaires
-
LESV: Language Embedded Sparse Voxel Fusion for Open-Vocabulary 3D Scene Understanding
par: Wang, Fusang, et autres
Publié: (2026) -
Learning Association via Track-Detection Matching for Multi-Object Tracking
par: Adžemović, Momir
Publié: (2025) -
Generalization performance of neural mapping schemes for the space-time interpolation of satellite-derived ocean colour datasets
par: Nguyen, Thi Thuy Nga, et autres
Publié: (2025) -
Observation-only learning of neural mapping schemes for gappy satellite-derived ocean colour parameters
par: Dorffer, Clément, et autres
Publié: (2025) -
Illumination and Shadows in Head Rotation: experiments with Denoising Diffusion Models
par: Asperti, Andrea, et autres
Publié: (2023)