One Flight Over the Gap: A Survey from Perspective to Panoramic Vision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Xin, Ge, Xian, Zhang, Dizhe, Wan, Zhaoliang, Wang, Xianshun, Li, Xiangtai, Jiang, Wenjie, Du, Bo, Tao, Dacheng, Yang, Ming-Hsuan, Qi, Lu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training
par: Feng, Haoran, et autres
Publié: (2025)
par: Feng, Haoran, et autres
Publié: (2025)
AirSim360: A Panoramic Simulation Platform within Drone View
par: Ge, Xian, et autres
Publié: (2025)
par: Ge, Xian, et autres
Publié: (2025)
Depth Any Panoramas: A Foundation Model for Panoramic Depth Estimation
par: Lin, Xin, et autres
Publié: (2025)
par: Lin, Xin, et autres
Publié: (2025)
D$^2$GS: Depth-and-Density Guided Gaussian Splatting for Stable and Accurate Sparse-View Reconstruction
par: Song, Meixi, et autres
Publié: (2025)
par: Song, Meixi, et autres
Publié: (2025)
Quasinormal Mode Expansion Method for Resonators with Partial-fraction Material Dispersion
par: Ming, Xianshun
Publié: (2023)
par: Ming, Xianshun
Publié: (2023)
Dense360: Dense Understanding from Omnidirectional Panoramas
par: Zhou, Yikang, et autres
Publié: (2025)
par: Zhou, Yikang, et autres
Publié: (2025)
Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training
par: Zhong, Qihuang, et autres
Publié: (2026)
par: Zhong, Qihuang, et autres
Publié: (2026)
Fly360: Omnidirectional Obstacle Avoidance within Drone View
par: Zhang, Xiangkai, et autres
Publié: (2026)
par: Zhang, Xiangkai, et autres
Publié: (2026)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
par: Ye, Mang, et autres
Publié: (2025)
par: Ye, Mang, et autres
Publié: (2025)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
par: Xuan, Wenjie, et autres
Publié: (2025)
par: Xuan, Wenjie, et autres
Publié: (2025)
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
par: Wang, Chaoyang, et autres
Publié: (2025)
par: Wang, Chaoyang, et autres
Publié: (2025)
uLayout: Unified Room Layout Estimation for Perspective and Panoramic Images
par: Lee, Jonathan, et autres
Publié: (2025)
par: Lee, Jonathan, et autres
Publié: (2025)
Exploring Plain ViT Reconstruction for Multi-class Unsupervised Anomaly Detection
par: Zhang, Jiangning, et autres
Publié: (2023)
par: Zhang, Jiangning, et autres
Publié: (2023)
EATFormer: Improving Vision Transformer Inspired by Evolutionary Algorithm
par: Zhang, Jiangning, et autres
Publié: (2022)
par: Zhang, Jiangning, et autres
Publié: (2022)
Pano360: Perspective to Panoramic Vision with Geometric Consistency
par: Zhu, Zhengdong, et autres
Publié: (2026)
par: Zhu, Zhengdong, et autres
Publié: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
par: Huang, Yanjia, et autres
Publié: (2025)
par: Huang, Yanjia, et autres
Publié: (2025)
UMC: Unified Resilient Controller for Legged Robots with Joint Malfunctions
par: Qiu, Yu, et autres
Publié: (2025)
par: Qiu, Yu, et autres
Publié: (2025)
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
par: Liu, Jinxiu, et autres
Publié: (2024)
par: Liu, Jinxiu, et autres
Publié: (2024)
SLER-IR: Spherical Layer-wise Expert Routing for All-in-One Image Restoration
par: Shurui, Peng, et autres
Publié: (2026)
par: Shurui, Peng, et autres
Publié: (2026)
Video Prediction Transformers without Recurrence or Convolution
par: Tang, Yujin, et autres
Publié: (2024)
par: Tang, Yujin, et autres
Publié: (2024)
Bridging the Domain Gap for Flight-Ready Spaceborne Vision
par: Park, Tae Ha, et autres
Publié: (2024)
par: Park, Tae Ha, et autres
Publié: (2024)
PanopticPartFormer++: A Unified and Decoupled View for Panoptic Part Segmentation
par: Li, Xiangtai, et autres
Publié: (2023)
par: Li, Xiangtai, et autres
Publié: (2023)
Advancing Two‐Photon Photodynamic Therapy Over NIR‐II Excitable Conjugated Microporous Polymer with NIR‐I Emission
par: Bo Li, et autres
Publié: (2024)
par: Bo Li, et autres
Publié: (2024)
Reason3D: Searching and Reasoning 3D Segmentation via Large Language Model
par: Huang, Kuan-Chih, et autres
Publié: (2024)
par: Huang, Kuan-Chih, et autres
Publié: (2024)
On exploring the potential of quantum auto-encoder for learning quantum systems
par: Du, Yuxuan, et autres
Publié: (2021)
par: Du, Yuxuan, et autres
Publié: (2021)
EMOv2: Pushing 5M Vision Model Frontier
par: Zhang, Jiangning, et autres
Publié: (2024)
par: Zhang, Jiangning, et autres
Publié: (2024)
Mamba or RWKV: Exploring High-Quality and High-Efficiency Segment Anything Model
par: Yuan, Haobo, et autres
Publié: (2024)
par: Yuan, Haobo, et autres
Publié: (2024)
SemFlow: Binding Semantic Segmentation and Image Synthesis via Rectified Flow
par: Wang, Chaoyang, et autres
Publié: (2024)
par: Wang, Chaoyang, et autres
Publié: (2024)
Unified Dense Prediction of Video Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
LLAVADI: What Matters For Multimodal Large Language Models Distillation
par: Xu, Shilin, et autres
Publié: (2024)
par: Xu, Shilin, et autres
Publié: (2024)
VinT-6D: A Large-Scale Object-in-hand Dataset from Vision, Touch and Proprioception
par: Wan, Zhaoliang, et autres
Publié: (2024)
par: Wan, Zhaoliang, et autres
Publié: (2024)
Improving Complex Reasoning over Knowledge Graph with Logic-Aware Curriculum Tuning
par: Xia, Tianle, et autres
Publié: (2024)
par: Xia, Tianle, et autres
Publié: (2024)
Towards Understanding Generalization and Stability Gaps between Centralized and Decentralized Federated Learning
par: Sun, Yan, et autres
Publié: (2023)
par: Sun, Yan, et autres
Publié: (2023)
When ControlNet Meets Inexplicit Masks: A Case Study of ControlNet on its Contour-following Ability
par: Xuan, Wenjie, et autres
Publié: (2024)
par: Xuan, Wenjie, et autres
Publié: (2024)
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Towards Open Vocabulary Learning: A Survey
par: Wu, Jianzong, et autres
Publié: (2023)
par: Wu, Jianzong, et autres
Publié: (2023)
4th PVUW MeViS 3rd Place Report: Sa2VA
par: Yuan, Haobo, et autres
Publié: (2025)
par: Yuan, Haobo, et autres
Publié: (2025)
RTMO: Towards High-Performance One-Stage Real-Time Multi-Person Pose Estimation
par: Lu, Peng, et autres
Publié: (2023)
par: Lu, Peng, et autres
Publié: (2023)
RobuRCDet: Enhancing Robustness of Radar-Camera Fusion in Bird's Eye View for 3D Object Detection
par: Yue, Jingtong, et autres
Publié: (2025)
par: Yue, Jingtong, et autres
Publié: (2025)
Epistemic-aware Vision-Language Foundation Model for Fetal Ultrasound Interpretation
par: He, Xiao, et autres
Publié: (2025)
par: He, Xiao, et autres
Publié: (2025)
Documents similaires
-
DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training
par: Feng, Haoran, et autres
Publié: (2025) -
AirSim360: A Panoramic Simulation Platform within Drone View
par: Ge, Xian, et autres
Publié: (2025) -
Depth Any Panoramas: A Foundation Model for Panoramic Depth Estimation
par: Lin, Xin, et autres
Publié: (2025) -
D$^2$GS: Depth-and-Density Guided Gaussian Splatting for Stable and Accurate Sparse-View Reconstruction
par: Song, Meixi, et autres
Publié: (2025) -
Quasinormal Mode Expansion Method for Resonators with Partial-fraction Material Dispersion
par: Ming, Xianshun
Publié: (2023)