Guardado en:
| Autores principales: | Zhan, Yuliang, Li, Jian, Huang, Wenbing, Liu, Yang, Sun, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.01844 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CloSe: A 3D Clothing Segmentation Dataset and Model
por: Antić, Dimitrije, et al.
Publicado: (2024)
por: Antić, Dimitrije, et al.
Publicado: (2024)
Shedding Light on VLN Robustness: A Black-box Framework for Indoor Lighting-based Adversarial Attack
por: Li, Chenyang, et al.
Publicado: (2025)
por: Li, Chenyang, et al.
Publicado: (2025)
Recurrent Reasoning with Vision-Language Models for Estimating Long-Horizon Embodied Task Progress
por: Zhang, Yuelin, et al.
Publicado: (2026)
por: Zhang, Yuelin, et al.
Publicado: (2026)
Cross-View Referring Multi-Object Tracking
por: Chen, Sijia, et al.
Publicado: (2024)
por: Chen, Sijia, et al.
Publicado: (2024)
PG-NeuS: Robust and Efficient Point Guidance for Multi-View Neural Surface Reconstruction
por: Zhang, Chen, et al.
Publicado: (2023)
por: Zhang, Chen, et al.
Publicado: (2023)
DRMOT: A Dataset and Framework for RGBD Referring Multi-Object Tracking
por: Chen, Sijia, et al.
Publicado: (2026)
por: Chen, Sijia, et al.
Publicado: (2026)
Accountable Textual-Visual Chat Learns to Reject Human Instructions in Image Re-creation
por: Zhang, Zhiwei, et al.
Publicado: (2023)
por: Zhang, Zhiwei, et al.
Publicado: (2023)
CHRIS: Clothed Human Reconstruction with Side View Consistency
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
CloSET: Modeling Clothed Humans on Continuous Surface with Explicit Template Decomposition
por: Zhang, Hongwen, et al.
Publicado: (2023)
por: Zhang, Hongwen, et al.
Publicado: (2023)
Work Zones challenge VLM Trajectory Planning: Toward Mitigation and Robust Autonomous Driving
por: Liao, Yifan, et al.
Publicado: (2025)
por: Liao, Yifan, et al.
Publicado: (2025)
ETCH: Generalizing Body Fitting to Clothed Humans via Equivariant Tightness
por: Li, Boqian, et al.
Publicado: (2025)
por: Li, Boqian, et al.
Publicado: (2025)
CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering
por: Cai, Yuliang, et al.
Publicado: (2024)
por: Cai, Yuliang, et al.
Publicado: (2024)
Visual Self-paced Iterative Learning for Unsupervised Temporal Action Localization
por: Hu, Yupeng, et al.
Publicado: (2023)
por: Hu, Yupeng, et al.
Publicado: (2023)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
por: Ma, Xiaoyu, et al.
Publicado: (2026)
por: Ma, Xiaoyu, et al.
Publicado: (2026)
DGFamba: Learning Flow Factorized State Space for Visual Domain Generalization
por: Bi, Qi, et al.
Publicado: (2025)
por: Bi, Qi, et al.
Publicado: (2025)
Saliency-Guided Representation with Consistency Policy Learning for Visual Unsupervised Reinforcement Learning
por: Sun, Jingbo, et al.
Publicado: (2026)
por: Sun, Jingbo, et al.
Publicado: (2026)
ClothHMR: 3D Mesh Recovery of Humans in Diverse Clothing from Single Image
por: Gao, Yunqi, et al.
Publicado: (2025)
por: Gao, Yunqi, et al.
Publicado: (2025)
Poivre: Self-Refining Visual Pointing with Reinforcement Learning
por: Yang, Wenjie, et al.
Publicado: (2025)
por: Yang, Wenjie, et al.
Publicado: (2025)
Cluster Contrast for Unsupervised Visual Representation Learning
por: Giakoumoglou, Nikolaos, et al.
Publicado: (2025)
por: Giakoumoglou, Nikolaos, et al.
Publicado: (2025)
SeaBird: Segmentation in Bird's View with Dice Loss Improves Monocular 3D Detection of Large Objects
por: Kumar, Abhinav, et al.
Publicado: (2024)
por: Kumar, Abhinav, et al.
Publicado: (2024)
Pretrained Reversible Generation as Unsupervised Visual Representation Learning
por: Xue, Rongkun, et al.
Publicado: (2024)
por: Xue, Rongkun, et al.
Publicado: (2024)
SCULPT: Shape-Conditioned Unpaired Learning of Pose-dependent Clothed and Textured Human Meshes
por: Sanyal, Soubhik, et al.
Publicado: (2023)
por: Sanyal, Soubhik, et al.
Publicado: (2023)
CloSE: A Geometric Shape-Agnostic Cloth State Representation
por: Kamat, Jay, et al.
Publicado: (2025)
por: Kamat, Jay, et al.
Publicado: (2025)
Unsupervised Audio-Visual Segmentation with Modality Alignment
por: Bhosale, Swapnil, et al.
Publicado: (2024)
por: Bhosale, Swapnil, et al.
Publicado: (2024)
Physically Realistic Sequence-Level Adversarial Clothing for Robust Human-Detection Evasion
por: Zhou, Dingkun, et al.
Publicado: (2025)
por: Zhou, Dingkun, et al.
Publicado: (2025)
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
por: Mei, Guofeng, et al.
Publicado: (2022)
por: Mei, Guofeng, et al.
Publicado: (2022)
ClothPPO: A Proximal Policy Optimization Enhancing Framework for Robotic Cloth Manipulation with Observation-Aligned Action Spaces
por: Yang, Libing, et al.
Publicado: (2024)
por: Yang, Libing, et al.
Publicado: (2024)
Source-Free and Image-Only Unsupervised Domain Adaptation for Category Level Object Pose Estimation
por: Kaushik, Prakhar, et al.
Publicado: (2024)
por: Kaushik, Prakhar, et al.
Publicado: (2024)
AvatarShield: Visual Reinforcement Learning for Human-Centric Synthetic Video Detection
por: Xu, Zhipei, et al.
Publicado: (2025)
por: Xu, Zhipei, et al.
Publicado: (2025)
Leveraging Unsupervised Learning for Cost-Effective Visual Anomaly Detection
por: Long, Yunbo, et al.
Publicado: (2024)
por: Long, Yunbo, et al.
Publicado: (2024)
Unsupervised Anomaly Detection in Brain MRI via Disentangled Anatomy Learning
por: Yang, Tao, et al.
Publicado: (2025)
por: Yang, Tao, et al.
Publicado: (2025)
OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
por: Fu, Ling, et al.
Publicado: (2024)
por: Fu, Ling, et al.
Publicado: (2024)
VimTS: A Unified Video and Image Text Spotter for Enhancing the Cross-domain Generalization
por: Liu, Yuliang, et al.
Publicado: (2024)
por: Liu, Yuliang, et al.
Publicado: (2024)
Rethinking Alignment and Uniformity in Unsupervised Semantic Segmentation
por: Zhang, Daoan, et al.
Publicado: (2022)
por: Zhang, Daoan, et al.
Publicado: (2022)
OpenGround: Active Cognition-based Reasoning for Open-World 3D Visual Grounding
por: Huang, Wenyuan, et al.
Publicado: (2025)
por: Huang, Wenyuan, et al.
Publicado: (2025)
Hierarchical Semantic Correlation-Aware Masked Autoencoder for Unsupervised Audio-Visual Representation Learning
por: Zeng, Donghuo, et al.
Publicado: (2026)
por: Zeng, Donghuo, et al.
Publicado: (2026)
Semantic Is Enough: Only Semantic Information For NeRF Reconstruction
por: Wang, Ruibo, et al.
Publicado: (2024)
por: Wang, Ruibo, et al.
Publicado: (2024)
DS$^2$Net: Detail-Semantic Deep Supervision Network for Medical Image Segmentation
por: Huang, Zhaohong, et al.
Publicado: (2025)
por: Huang, Zhaohong, et al.
Publicado: (2025)
Reasoning-Enhanced Object-Centric Learning for Videos
por: Li, Jian, et al.
Publicado: (2024)
por: Li, Jian, et al.
Publicado: (2024)
Online Language Splatting
por: Katragadda, Saimouli, et al.
Publicado: (2025)
por: Katragadda, Saimouli, et al.
Publicado: (2025)
Ejemplares similares
-
CloSe: A 3D Clothing Segmentation Dataset and Model
por: Antić, Dimitrije, et al.
Publicado: (2024) -
Shedding Light on VLN Robustness: A Black-box Framework for Indoor Lighting-based Adversarial Attack
por: Li, Chenyang, et al.
Publicado: (2025) -
Recurrent Reasoning with Vision-Language Models for Estimating Long-Horizon Embodied Task Progress
por: Zhang, Yuelin, et al.
Publicado: (2026) -
Cross-View Referring Multi-Object Tracking
por: Chen, Sijia, et al.
Publicado: (2024) -
PG-NeuS: Robust and Efficient Point Guidance for Multi-View Neural Surface Reconstruction
por: Zhang, Chen, et al.
Publicado: (2023)