nvTorchCam: An Open-source Library for Camera-Agnostic Differentiable Geometric Vision
Fuente:
arXiv
Guardado en:
| Autores principales: | Lichy, Daniel, Su, Hang, Badki, Abhishek, Kautz, Jan, Gallo, Orazio |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FoVA-Depth: Field-of-View Agnostic Depth Estimation for Cross-Dataset Generalization
por: Lichy, Daniel, et al.
Publicado: (2024)
por: Lichy, Daniel, et al.
Publicado: (2024)
L4P: Towards Unified Low-Level 4D Vision Perception
por: Badki, Abhishek, et al.
Publicado: (2025)
por: Badki, Abhishek, et al.
Publicado: (2025)
Zero-Shot Monocular Scene Flow Estimation in the Wild
por: Liang, Yiqing, et al.
Publicado: (2025)
por: Liang, Yiqing, et al.
Publicado: (2025)
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
por: Xu, Dejia, et al.
Publicado: (2024)
por: Xu, Dejia, et al.
Publicado: (2024)
DeltaCam: Differential Intrinsic Camera Modeling for Video Generation
por: Mandal, Debabrata, et al.
Publicado: (2026)
por: Mandal, Debabrata, et al.
Publicado: (2026)
FoundationStereo: Zero-Shot Stereo Matching
por: Wen, Bowen, et al.
Publicado: (2025)
por: Wen, Bowen, et al.
Publicado: (2025)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
por: Hatamizadeh, Ali, et al.
Publicado: (2024)
por: Hatamizadeh, Ali, et al.
Publicado: (2024)
WorldCam: Interactive Autoregressive 3D Gaming Worlds with Camera Pose as a Unifying Geometric Representation
por: Nam, Jisu, et al.
Publicado: (2026)
por: Nam, Jisu, et al.
Publicado: (2026)
AnyCam: Learning to Recover Camera Poses and Intrinsics from Casual Videos
por: Wimbauer, Felix, et al.
Publicado: (2025)
por: Wimbauer, Felix, et al.
Publicado: (2025)
CamReasoner: Reinforcing Camera Movement Understanding via Structured Spatial Reasoning
por: Wu, Hang, et al.
Publicado: (2026)
por: Wu, Hang, et al.
Publicado: (2026)
ChatCam: Empowering Camera Control through Conversational AI
por: Liu, Xinhang, et al.
Publicado: (2024)
por: Liu, Xinhang, et al.
Publicado: (2024)
DriveCamSim: Generalizable Camera Simulation via Explicit Camera Modeling for Autonomous Driving
por: Sun, Wenchao, et al.
Publicado: (2025)
por: Sun, Wenchao, et al.
Publicado: (2025)
CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback
por: Ge, Wenhang, et al.
Publicado: (2026)
por: Ge, Wenhang, et al.
Publicado: (2026)
DiffPhysCam: Differentiable Physics-Based Camera Simulation for Inverse Rendering and Embodied AI
por: Chen, Bo-Hsun, et al.
Publicado: (2025)
por: Chen, Bo-Hsun, et al.
Publicado: (2025)
Modular-Cam: Modular Dynamic Camera-view Video Generation with LLM
por: Pan, Zirui, et al.
Publicado: (2025)
por: Pan, Zirui, et al.
Publicado: (2025)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
por: Kuang, Zhiyi, et al.
Publicado: (2026)
por: Kuang, Zhiyi, et al.
Publicado: (2026)
MultiCam: On-the-fly Multi-Camera Pose Estimation Using Spatiotemporal Overlaps of Known Objects
por: Li, Shiyu, et al.
Publicado: (2026)
por: Li, Shiyu, et al.
Publicado: (2026)
CamPro: Camera-based Anti-Facial Recognition
por: Zhu, Wenjun, et al.
Publicado: (2023)
por: Zhu, Wenjun, et al.
Publicado: (2023)
Motion-Aware Optical Camera Communication with Event Cameras
por: Su, Hang, et al.
Publicado: (2024)
por: Su, Hang, et al.
Publicado: (2024)
CamI2V: Camera-Controlled Image-to-Video Diffusion Model
por: Zheng, Guangcong, et al.
Publicado: (2024)
por: Zheng, Guangcong, et al.
Publicado: (2024)
FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
por: Lyu, Weijie, et al.
Publicado: (2026)
por: Lyu, Weijie, et al.
Publicado: (2026)
CamCloneMaster: Enabling Reference-based Camera Control for Video Generation
por: Luo, Yawen, et al.
Publicado: (2025)
por: Luo, Yawen, et al.
Publicado: (2025)
CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion
por: Ji, Chenhao, et al.
Publicado: (2025)
por: Ji, Chenhao, et al.
Publicado: (2025)
CamFreeDiff: Camera-free Image to Panorama Generation with Diffusion Model
por: Yuan, Xiaoding, et al.
Publicado: (2024)
por: Yuan, Xiaoding, et al.
Publicado: (2024)
VividCam: Learning Unconventional Camera Motions from Virtual Synthetic Videos
por: Wu, Qiucheng, et al.
Publicado: (2025)
por: Wu, Qiucheng, et al.
Publicado: (2025)
Learning Camera-Agnostic White-Balance Preferences
por: Zhao, Luxi, et al.
Publicado: (2025)
por: Zhao, Luxi, et al.
Publicado: (2025)
iFinder: Structured Zero-Shot Vision-Based LLM Grounding for Dash-Cam Video Reasoning
por: Yao, Manyi, et al.
Publicado: (2025)
por: Yao, Manyi, et al.
Publicado: (2025)
GeoDANO: Geometric VLM with Domain Agnostic Vision Encoder
por: Cho, Seunghyuk, et al.
Publicado: (2025)
por: Cho, Seunghyuk, et al.
Publicado: (2025)
An N-Point Linear Solver for Line and Motion Estimation with Event Cameras
por: Gao, Ling, et al.
Publicado: (2024)
por: Gao, Ling, et al.
Publicado: (2024)
RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control
por: Xu, Youcan, et al.
Publicado: (2026)
por: Xu, Youcan, et al.
Publicado: (2026)
RadarCam-Depth: Radar-Camera Fusion for Depth Estimation with Learned Metric Scale
por: Li, Han, et al.
Publicado: (2024)
por: Li, Han, et al.
Publicado: (2024)
SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints
por: Bai, Jianhong, et al.
Publicado: (2024)
por: Bai, Jianhong, et al.
Publicado: (2024)
ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
por: Bai, Jianhong, et al.
Publicado: (2025)
por: Bai, Jianhong, et al.
Publicado: (2025)
HitoMi-Cam: A Shape-Agnostic Person Detection Method Using the Spectral Characteristics of Clothing
por: Ono, Shuji
Publicado: (2025)
por: Ono, Shuji
Publicado: (2025)
AM-RADIO: Agglomerative Vision Foundation Model -- Reduce All Domains Into One
por: Ranzinger, Mike, et al.
Publicado: (2023)
por: Ranzinger, Mike, et al.
Publicado: (2023)
Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry
por: Seo, Junyoung, et al.
Publicado: (2025)
por: Seo, Junyoung, et al.
Publicado: (2025)
PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention
por: Chen, Yipeng, et al.
Publicado: (2025)
por: Chen, Yipeng, et al.
Publicado: (2025)
ReCamDriving: LiDAR-Free Camera-Controlled Novel Trajectory Video Generation
por: Li, Yaokun, et al.
Publicado: (2025)
por: Li, Yaokun, et al.
Publicado: (2025)
A PyTorch-Enabled Tool for Synthetic Event Camera Data Generation and Algorithm Development
por: Greene, Joseph L., et al.
Publicado: (2025)
por: Greene, Joseph L., et al.
Publicado: (2025)
OmniCam: Unified Multimodal Video Generation via Camera Control
por: Yang, Xiaoda, et al.
Publicado: (2025)
por: Yang, Xiaoda, et al.
Publicado: (2025)
Ejemplares similares
-
FoVA-Depth: Field-of-View Agnostic Depth Estimation for Cross-Dataset Generalization
por: Lichy, Daniel, et al.
Publicado: (2024) -
L4P: Towards Unified Low-Level 4D Vision Perception
por: Badki, Abhishek, et al.
Publicado: (2025) -
Zero-Shot Monocular Scene Flow Estimation in the Wild
por: Liang, Yiqing, et al.
Publicado: (2025) -
CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation
por: Xu, Dejia, et al.
Publicado: (2024) -
DeltaCam: Differential Intrinsic Camera Modeling for Video Generation
por: Mandal, Debabrata, et al.
Publicado: (2026)