Training for X-Ray Vision: Amodal Segmentation, Amodal Content Completion, and View-Invariant Object Representation from Multi-Camera Video
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Moore, Alexander, Saini, Amar, Cancilla, Kylie, Poland, Doug, Carrano, Carmen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Addressing Issues with Working Memory in Video Object Segmentation
par: Bromley, Clayton, et autres
Publié: (2024)
par: Bromley, Clayton, et autres
Publié: (2024)
An Analysis of Data Transformation Effects on Segment Anything 2
par: Bromley, Clayton, et autres
Publié: (2025)
par: Bromley, Clayton, et autres
Publié: (2025)
Training a Student Expert via Semi-Supervised Foundation Model Distillation
par: Taghavi, Pardis, et autres
Publié: (2026)
par: Taghavi, Pardis, et autres
Publié: (2026)
JVLGS: Joint Vision-Language Gas Leak Segmentation
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
Semantic Prioritization in Visual Counterfactual Explanations with Weighted Segmentation and Auto-Adaptive Region Selection
par: Zhang, Lintong, et autres
Publié: (2025)
par: Zhang, Lintong, et autres
Publié: (2025)
MRI Brain Tumor Detection with Computer Vision
par: Krolik, Jack, et autres
Publié: (2025)
par: Krolik, Jack, et autres
Publié: (2025)
CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method
par: Koh, Hyunseo, et autres
Publié: (2026)
par: Koh, Hyunseo, et autres
Publié: (2026)
Parking Space Detection in the City of Granada
par: Luis, Crespo-Orti, et autres
Publié: (2025)
par: Luis, Crespo-Orti, et autres
Publié: (2025)
ForAug: Recombining Foregrounds and Backgrounds to Improve Vision Transformer Training with Bias Mitigation
par: Nauen, Tobias Christian, et autres
Publié: (2025)
par: Nauen, Tobias Christian, et autres
Publié: (2025)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
μ-Net: A Deep Learning-Based Architecture for μ-CT Segmentation
par: Bruno, Pierangela, et autres
Publié: (2024)
par: Bruno, Pierangela, et autres
Publié: (2024)
Foam Segmentation in Wastewater Treatment Plants: A Federated Learning Approach with Segment Anything Model 2
par: Duman, Mehmet Batuhan, et autres
Publié: (2025)
par: Duman, Mehmet Batuhan, et autres
Publié: (2025)
Tricks and Plug-ins for Gradient Boosting in Image Classification
par: Fang, Biyi, et autres
Publié: (2025)
par: Fang, Biyi, et autres
Publié: (2025)
FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models
par: Chen, Kewei, et autres
Publié: (2025)
par: Chen, Kewei, et autres
Publié: (2025)
ArmFormer: Lightweight Transformer Architecture for Real-Time Multi-Class Weapon Segmentation and Classification
par: Kambhatla, Akhila, et autres
Publié: (2025)
par: Kambhatla, Akhila, et autres
Publié: (2025)
A Labeled Array Distance Metric for Measuring Image Segmentation Quality
par: Berijanian, Maryam, et autres
Publié: (2024)
par: Berijanian, Maryam, et autres
Publié: (2024)
Breast Cell Segmentation Under Extreme Data Constraints: Quantum Enhancement Meets Adaptive Loss Stabilization
par: Dasoju, Varun Kumar, et autres
Publié: (2025)
par: Dasoju, Varun Kumar, et autres
Publié: (2025)
JigsawHSI: a network for Hyperspectral Image classification
par: Moraga, Jaime
Publié: (2022)
par: Moraga, Jaime
Publié: (2022)
Scalpel-SAM: A Semi-Supervised Paradigm for Adapting SAM to Infrared Small Object Detection
par: Liu, Zihan, et autres
Publié: (2025)
par: Liu, Zihan, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
Unpacking Hateful Memes: Presupposed Context and False Claims
par: Cai, Weibin, et autres
Publié: (2025)
par: Cai, Weibin, et autres
Publié: (2025)
Differentiable Hierarchical Visual Tokenization
par: Aasan, Marius, et autres
Publié: (2025)
par: Aasan, Marius, et autres
Publié: (2025)
Generating Diverse Agricultural Data for Vision-Based Farming Applications
par: Cieslak, Mikolaj, et autres
Publié: (2024)
par: Cieslak, Mikolaj, et autres
Publié: (2024)
TauFlow: Dynamic Causal Constraint for Complexity-Adaptive Lightweight Segmentation
par: Chen, Zidong, et autres
Publié: (2025)
par: Chen, Zidong, et autres
Publié: (2025)
RefineFormer3D: Efficient 3D Medical Image Segmentation via Adaptive Multi-Scale Transformer with Cross Attention Fusion
par: Tyagi, Kavyansh, et autres
Publié: (2026)
par: Tyagi, Kavyansh, et autres
Publié: (2026)
Towards Onboard Continuous Change Detection for Floods
par: Kyselica, Daniel, et autres
Publié: (2026)
par: Kyselica, Daniel, et autres
Publié: (2026)
Fine-grained spatial-temporal perception for gas leak segmentation
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
TensLoRA: Tensor Alternatives for Low-Rank Adaptation
par: Marmoret, Axel, et autres
Publié: (2025)
par: Marmoret, Axel, et autres
Publié: (2025)
Perception-Consistency Multimodal Large Language Models Reasoning via Caption-Regularized Policy Optimization
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
Autoassociative Learning of Structural Representations for Modeling and Classification in Medical Imaging
par: Buchnajzer, Zuzanna, et autres
Publié: (2024)
par: Buchnajzer, Zuzanna, et autres
Publié: (2024)
Text-to-Events: Synthetic Event Camera Streams from Conditional Text Input
par: Ott, Joachim, et autres
Publié: (2024)
par: Ott, Joachim, et autres
Publié: (2024)
Semantically Guided Adversarial Testing of Vision Models Using Language Models
par: Filus, Katarzyna, et autres
Publié: (2025)
par: Filus, Katarzyna, et autres
Publié: (2025)
Multi-Scale Graph Learning for Anti-Sparse Downscaling
par: Fan, Yingda, et autres
Publié: (2025)
par: Fan, Yingda, et autres
Publié: (2025)
A Comparative Survey of PyTorch vs TensorFlow for Deep Learning: Usability, Performance, and Deployment Trade-offs
par: Alawi, Zakariya Ba
Publié: (2025)
par: Alawi, Zakariya Ba
Publié: (2025)
VA-$π$: Variational Policy Alignment for Pixel-Aware Autoregressive Generation
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
A Survey on Vision-Language-Action Models for Embodied AI
par: Ma, Yueen, et autres
Publié: (2024)
par: Ma, Yueen, et autres
Publié: (2024)
LAESI: Leaf Area Estimation with Synthetic Imagery
par: Kałużny, Jacek, et autres
Publié: (2024)
par: Kałużny, Jacek, et autres
Publié: (2024)
Think, Act, Learn: A Framework for Autonomous Robotic Agents using Closed-Loop Large Language Models
par: Menon, Anjali R., et autres
Publié: (2025)
par: Menon, Anjali R., et autres
Publié: (2025)
Documents similaires
-
Addressing Issues with Working Memory in Video Object Segmentation
par: Bromley, Clayton, et autres
Publié: (2024) -
An Analysis of Data Transformation Effects on Segment Anything 2
par: Bromley, Clayton, et autres
Publié: (2025) -
Training a Student Expert via Semi-Supervised Foundation Model Distillation
par: Taghavi, Pardis, et autres
Publié: (2026) -
JVLGS: Joint Vision-Language Gas Leak Segmentation
par: Zhao, Xinlong, et autres
Publié: (2025) -
Semantic Prioritization in Visual Counterfactual Explanations with Weighted Segmentation and Auto-Adaptive Region Selection
par: Zhang, Lintong, et autres
Publié: (2025)