Dual-Projection Fusion for Accurate Upright Panorama Generation in Robotic Vision
Fuente:
arXiv
Salvato in:
| Autori principali: | Shan, Yuhao, Yuan, Qianyi, Liu, Jingguo, Li, Shigang, Li, Jianfeng, Chen, Tong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
360-Degree Full-view Image Segmentation by Spherical Convolution compatible with Large-scale Planar Pre-trained Models
di: Liu, Jingguo, et al.
Pubblicazione: (2025)
di: Liu, Jingguo, et al.
Pubblicazione: (2025)
Estimating Depth of Monocular Panoramic Image with Teacher-Student Model Fusing Equirectangular and Spherical Representations
di: Liu, Jingguo, et al.
Pubblicazione: (2024)
di: Liu, Jingguo, et al.
Pubblicazione: (2024)
Cascaded Dual Vision Transformer for Accurate Facial Landmark Detection
di: Dang, Ziqiang, et al.
Pubblicazione: (2024)
di: Dang, Ziqiang, et al.
Pubblicazione: (2024)
Upright adjustment with graph convolutional networks
di: Jung, Raehyuk, et al.
Pubblicazione: (2024)
di: Jung, Raehyuk, et al.
Pubblicazione: (2024)
SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion
di: Yan, Qingsong, et al.
Pubblicazione: (2025)
di: Yan, Qingsong, et al.
Pubblicazione: (2025)
Taming Stable Diffusion for Text to 360° Panorama Image Generation
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
Florence-VL: Enhancing Vision-Language Models with Generative Vision Encoder and Depth-Breadth Fusion
di: Chen, Jiuhai, et al.
Pubblicazione: (2024)
di: Chen, Jiuhai, et al.
Pubblicazione: (2024)
LiftProj: Space Lifting and Projection-Based Panorama Stitching
di: Jia, Yuan, et al.
Pubblicazione: (2025)
di: Jia, Yuan, et al.
Pubblicazione: (2025)
RCR: Robust Crowd Reconstruction with Upright Space from a Single Large-scene Image
di: Huang, Jing, et al.
Pubblicazione: (2024)
di: Huang, Jing, et al.
Pubblicazione: (2024)
BiomedAP: A Vision-Informed Dual-Anchor Framework with Gated Cross-Modal Fusion for Robust Medical Vision-Language Adaptation
di: Tong, Huanyang, et al.
Pubblicazione: (2026)
di: Tong, Huanyang, et al.
Pubblicazione: (2026)
Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision
di: Han, Xiaofeng, et al.
Pubblicazione: (2025)
di: Han, Xiaofeng, et al.
Pubblicazione: (2025)
Dual-Task Vision Transformer for Rapid and Accurate Intracerebral Hemorrhage CT Image Classification
di: Fan, Jialiang, et al.
Pubblicazione: (2024)
di: Fan, Jialiang, et al.
Pubblicazione: (2024)
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
LayerPano3D: Layered 3D Panorama for Hyper-Immersive Scene Generation
di: Yang, Shuai, et al.
Pubblicazione: (2024)
di: Yang, Shuai, et al.
Pubblicazione: (2024)
CamFreeDiff: Camera-free Image to Panorama Generation with Diffusion Model
di: Yuan, Xiaoding, et al.
Pubblicazione: (2024)
di: Yuan, Xiaoding, et al.
Pubblicazione: (2024)
DesignEdit: Multi-Layered Latent Decomposition and Fusion for Unified & Accurate Image Editing
di: Jia, Yueru, et al.
Pubblicazione: (2024)
di: Jia, Yueru, et al.
Pubblicazione: (2024)
Dual-Level Precision Edges Guided Multi-View Stereo with Accurate Planarization
di: Chen, Kehua, et al.
Pubblicazione: (2024)
di: Chen, Kehua, et al.
Pubblicazione: (2024)
EVLF: Early Vision-Language Fusion for Generative Dataset Distillation
di: Cai, Wenqi, et al.
Pubblicazione: (2026)
di: Cai, Wenqi, et al.
Pubblicazione: (2026)
Towards an Accurate and Effective Robot Vision (The Problem of Topological Localization for Mobile Robots)
di: Boros, Emanuela
Pubblicazione: (2025)
di: Boros, Emanuela
Pubblicazione: (2025)
DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance
di: Tang, Linfeng, et al.
Pubblicazione: (2025)
di: Tang, Linfeng, et al.
Pubblicazione: (2025)
PSGS: Text-driven Panorama Sliding Scene Generation via Gaussian Splatting
di: Zhang, Xin, et al.
Pubblicazione: (2026)
di: Zhang, Xin, et al.
Pubblicazione: (2026)
IDOL: Unified Dual-Modal Latent Diffusion for Human-Centric Joint Video-Depth Generation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
Adapting Vision-Language Foundation Model for Next Generation Medical Ultrasound Image Analysis
di: Qu, Jingguo, et al.
Pubblicazione: (2025)
di: Qu, Jingguo, et al.
Pubblicazione: (2025)
JoPano: Unified Panorama Generation via Joint Modeling
di: Feng, Wancheng, et al.
Pubblicazione: (2025)
di: Feng, Wancheng, et al.
Pubblicazione: (2025)
ODM: A Text-Image Further Alignment Pre-training Approach for Scene Text Detection and Spotting
di: Duan, Chen, et al.
Pubblicazione: (2024)
di: Duan, Chen, et al.
Pubblicazione: (2024)
SP-Det: Self-Prompted Dual-Text Fusion for Generalized Multi-Label Lesion Detection
di: Xu, Qing, et al.
Pubblicazione: (2025)
di: Xu, Qing, et al.
Pubblicazione: (2025)
D2-Mamba: Dual-Scale Fusion and Dual-Path Scanning with SSMs for Shadow Removal
di: Li, Linhao, et al.
Pubblicazione: (2025)
di: Li, Linhao, et al.
Pubblicazione: (2025)
DualDiff: Dual-branch Diffusion Model for Autonomous Driving with Semantic Fusion
di: Li, Haoteng, et al.
Pubblicazione: (2025)
di: Li, Haoteng, et al.
Pubblicazione: (2025)
RayFusion: Ray Fusion Enhanced Collaborative Visual Perception
di: Wang, Shaohong, et al.
Pubblicazione: (2025)
di: Wang, Shaohong, et al.
Pubblicazione: (2025)
OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on
di: Xu, Yuhao, et al.
Pubblicazione: (2024)
di: Xu, Yuhao, et al.
Pubblicazione: (2024)
Towards Accurate Camouflaged Object Detection with Mixture Convolution and Interactive Fusion
di: Chen, Geng, et al.
Pubblicazione: (2021)
di: Chen, Geng, et al.
Pubblicazione: (2021)
MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision
di: Wang, Ruicheng, et al.
Pubblicazione: (2024)
di: Wang, Ruicheng, et al.
Pubblicazione: (2024)
HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone
di: Fu, Guanyiman, et al.
Pubblicazione: (2026)
di: Fu, Guanyiman, et al.
Pubblicazione: (2026)
ReWeaver: Towards Simulation-Ready and Topology-Accurate Garment Reconstruction
di: Li, Ming, et al.
Pubblicazione: (2026)
di: Li, Ming, et al.
Pubblicazione: (2026)
Defurnishing with X-Ray Vision: Joint Removal of Furniture from Panoramas and Mesh
di: Dolhasz, Alan, et al.
Pubblicazione: (2025)
di: Dolhasz, Alan, et al.
Pubblicazione: (2025)
Mitigate Replication and Copying in Diffusion Models with Generalized Caption and Dual Fusion Enhancement
di: Li, Chenghao, et al.
Pubblicazione: (2023)
di: Li, Chenghao, et al.
Pubblicazione: (2023)
VisionLLM-based Multimodal Fusion Network for Glottic Carcinoma Early Detection
di: Jin, Zhaohui, et al.
Pubblicazione: (2024)
di: Jin, Zhaohui, et al.
Pubblicazione: (2024)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
di: Liu, Kangcheng, et al.
Pubblicazione: (2023)
di: Liu, Kangcheng, et al.
Pubblicazione: (2023)
VisionCreator: A Native Visual-Generation Agentic Model with Understanding, Thinking, Planning and Creation
di: Lai, Jinxiang, et al.
Pubblicazione: (2026)
di: Lai, Jinxiang, et al.
Pubblicazione: (2026)
MoGe-2: Accurate Monocular Geometry with Metric Scale and Sharp Details
di: Wang, Ruicheng, et al.
Pubblicazione: (2025)
di: Wang, Ruicheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
360-Degree Full-view Image Segmentation by Spherical Convolution compatible with Large-scale Planar Pre-trained Models
di: Liu, Jingguo, et al.
Pubblicazione: (2025) -
Estimating Depth of Monocular Panoramic Image with Teacher-Student Model Fusing Equirectangular and Spherical Representations
di: Liu, Jingguo, et al.
Pubblicazione: (2024) -
Cascaded Dual Vision Transformer for Accurate Facial Landmark Detection
di: Dang, Ziqiang, et al.
Pubblicazione: (2024) -
Upright adjustment with graph convolutional networks
di: Jung, Raehyuk, et al.
Pubblicazione: (2024) -
SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion
di: Yan, Qingsong, et al.
Pubblicazione: (2025)