TraceNet: Segment one thing efficiently
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Mingyuan, Liu, Zichuan, Zheng, Haozhen, Guo, Hongpeng, Chen, Bo, Lu, Xin, Nahrstedt, Klara |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Spatio-Temporal LLM: Reasoning about Environments and Actions
par: Zheng, Haozhen, et autres
Publié: (2025)
par: Zheng, Haozhen, et autres
Publié: (2025)
UOUO: Uncontextualized Uncommon Objects for Measuring Knowledge Horizons of Vision Language Models
par: Pi, Xinyu, et autres
Publié: (2024)
par: Pi, Xinyu, et autres
Publié: (2024)
Circuit Tracing in Vision-Language Models: Understanding the Internal Mechanisms of Multimodal Thinking
par: Yang, Jingcheng, et autres
Publié: (2026)
par: Yang, Jingcheng, et autres
Publié: (2026)
ACT360: An Efficient 360-Degree Action Detection and Summarization Framework for Mission-Critical Training and Debriefing
par: Tiwari, Aditi, et autres
Publié: (2025)
par: Tiwari, Aditi, et autres
Publié: (2025)
EcoLens: Leveraging Multi-Objective Bayesian Optimization for Energy-Efficient Video Processing on Edge Devices
par: Civjan, Benjamin, et autres
Publié: (2025)
par: Civjan, Benjamin, et autres
Publié: (2025)
Viewport-based Neural 360° Image Compression
par: Liao, Jingwei, et autres
Publié: (2026)
par: Liao, Jingwei, et autres
Publié: (2026)
Pseudo Dataset Generation for Out-of-Domain Multi-Camera View Recommendation
par: Lee, Kuan-Ying, et autres
Publié: (2024)
par: Lee, Kuan-Ying, et autres
Publié: (2024)
Fire360: A Benchmark for Robust Perception and Episodic Memory in Degraded 360-Degree Firefighting Videos
par: Tiwari, Aditi, et autres
Publié: (2025)
par: Tiwari, Aditi, et autres
Publié: (2025)
ChangeNet: Multi-Temporal Asymmetric Change Detection Dataset
par: Ji, Deyi, et autres
Publié: (2023)
par: Ji, Deyi, et autres
Publié: (2023)
Deep Image Clustering Based on Curriculum Learning and Density Information
par: Zheng, Haiyang, et autres
Publié: (2026)
par: Zheng, Haiyang, et autres
Publié: (2026)
CNMBI: Determining the Number of Clusters Using Center Pairwise Matching and Boundary Filtering
par: Zhang, Ruilin, et autres
Publié: (2026)
par: Zhang, Ruilin, et autres
Publié: (2026)
SegNet4D: Efficient Instance-Aware 4D Semantic Segmentation for LiDAR Point Cloud
par: Wang, Neng, et autres
Publié: (2024)
par: Wang, Neng, et autres
Publié: (2024)
AFFSegNet: Adaptive Feature Fusion Segmentation Network for Microtumors and Multi-Organ Segmentation
par: Zheng, Fuchen, et autres
Publié: (2024)
par: Zheng, Fuchen, et autres
Publié: (2024)
CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP
par: Tang, Zhenchen, et autres
Publié: (2024)
par: Tang, Zhenchen, et autres
Publié: (2024)
PeLK: Parameter-efficient Large Kernel ConvNets with Peripheral Convolution
par: Chen, Honghao, et autres
Publié: (2024)
par: Chen, Honghao, et autres
Publié: (2024)
Single Image Test-Time Adaptation for Segmentation
par: Janouskova, Klara, et autres
Publié: (2023)
par: Janouskova, Klara, et autres
Publié: (2023)
Language-Guided Open-World Anomaly Segmentation
par: Reichard, Klara, et autres
Publié: (2025)
par: Reichard, Klara, et autres
Publié: (2025)
Flaws of ImageNet, Computer Vision's Favourite Dataset
par: Kisel, Nikita, et autres
Publié: (2024)
par: Kisel, Nikita, et autres
Publié: (2024)
JanusNet: Hierarchical Slice-Block Shuffle and Displacement for Semi-Supervised 3D Multi-Organ Segmentation
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
MetaSeg: Content-Aware Meta-Net for Omni-Supervised Semantic Segmentation
par: Jiang, Shenwang, et autres
Publié: (2024)
par: Jiang, Shenwang, et autres
Publié: (2024)
NormAUG: Normalization-guided Augmentation for Domain Generalization
par: Qi, Lei, et autres
Publié: (2023)
par: Qi, Lei, et autres
Publié: (2023)
MultiMatch: Multi-task Learning for Semi-supervised Domain Generalization
par: Qi, Lei, et autres
Publié: (2022)
par: Qi, Lei, et autres
Publié: (2022)
A Cross-Domain Few-Shot Learning Method Based on Domain Knowledge Mapping
par: Chen, Jiajun, et autres
Publié: (2025)
par: Chen, Jiajun, et autres
Publié: (2025)
Trace3D: Consistent Segmentation Lifting via Gaussian Instance Tracing
par: Shen, Hongyu, et autres
Publié: (2025)
par: Shen, Hongyu, et autres
Publié: (2025)
Structural and Statistical Texture Knowledge Distillation for Semantic Segmentation
par: Ji, Deyi, et autres
Publié: (2023)
par: Ji, Deyi, et autres
Publié: (2023)
M$^{2}$SNet: Multi-scale in Multi-scale Subtraction Network for Medical Image Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
RPBA-Net: An Interpretable Residual Pyramid Bilateral Affine Network for RAW-Domain ISP Enhancement
par: Xin, Yucheng, et autres
Publié: (2026)
par: Xin, Yucheng, et autres
Publié: (2026)
ThinkRL-Edit: Thinking in Reinforcement Learning for Reasoning-Centric Image Editing
par: Li, Hengjia, et autres
Publié: (2026)
par: Li, Hengjia, et autres
Publié: (2026)
HandEval: Taking the First Step Towards Hand Quality Evaluation in Generated Images
par: Wang, Zichuan, et autres
Publié: (2025)
par: Wang, Zichuan, et autres
Publié: (2025)
Revisiting MLLM Based Image Quality Assessment: Errors and Remedy
par: Tang, Zhenchen, et autres
Publié: (2025)
par: Tang, Zhenchen, et autres
Publié: (2025)
Codebook-Based Adaptive Feature Compression With Semantic Enhancement for Edge-Cloud Systems
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
Sparsity- and Hybridity-Inspired Visual Parameter-Efficient Fine-Tuning for Medical Diagnosis
par: Liu, Mingyuan, et autres
Publié: (2024)
par: Liu, Mingyuan, et autres
Publié: (2024)
ClawCraneNet: Leveraging Object-level Relation for Text-based Video Segmentation
par: Liang, Chen, et autres
Publié: (2021)
par: Liang, Chen, et autres
Publié: (2021)
Dcl-Net: Dual Contrastive Learning Network for Semi-Supervised Multi-Organ Segmentation
par: Wen, Lu, et autres
Publié: (2024)
par: Wen, Lu, et autres
Publié: (2024)
InfiniteYou: Flexible Photo Recrafting While Preserving Your Identity
par: Jiang, Liming, et autres
Publié: (2025)
par: Jiang, Liming, et autres
Publié: (2025)
Learning Joint ID-Textual Representation for ID-Preserving Image Synthesis
par: Liu, Zichuan, et autres
Publié: (2025)
par: Liu, Zichuan, et autres
Publié: (2025)
BRAU-Net++: U-Shaped Hybrid CNN-Transformer Network for Medical Image Segmentation
par: Lan, Libin, et autres
Publié: (2024)
par: Lan, Libin, et autres
Publié: (2024)
TDEC: Deep Embedded Image Clustering with Transformer and Distribution Information
par: Zhang, Ruilin, et autres
Publié: (2026)
par: Zhang, Ruilin, et autres
Publié: (2026)
OmniTransfer: All-in-one Framework for Spatio-temporal Video Transfer
par: Zhang, Pengze, et autres
Publié: (2026)
par: Zhang, Pengze, et autres
Publié: (2026)
Alleviating Textual Reliance in Medical Language-guided Segmentation via Prototype-driven Semantic Approximation
par: Ye, Shuchang, et autres
Publié: (2025)
par: Ye, Shuchang, et autres
Publié: (2025)
Documents similaires
-
Spatio-Temporal LLM: Reasoning about Environments and Actions
par: Zheng, Haozhen, et autres
Publié: (2025) -
UOUO: Uncontextualized Uncommon Objects for Measuring Knowledge Horizons of Vision Language Models
par: Pi, Xinyu, et autres
Publié: (2024) -
Circuit Tracing in Vision-Language Models: Understanding the Internal Mechanisms of Multimodal Thinking
par: Yang, Jingcheng, et autres
Publié: (2026) -
ACT360: An Efficient 360-Degree Action Detection and Summarization Framework for Mission-Critical Training and Debriefing
par: Tiwari, Aditi, et autres
Publié: (2025) -
EcoLens: Leveraging Multi-Objective Bayesian Optimization for Energy-Efficient Video Processing on Edge Devices
par: Civjan, Benjamin, et autres
Publié: (2025)