Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Xingyu, Yi, Liang, Wang, Shuo, Zhu, Wenbo, Wu, Yonglinag, Zhu, Beier, Zhang, Hanwang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Enhancing CLIP Robustness via Cross-Modality Alignment
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Dynamic Multimodal Prototype Learning in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Robust Fine-tuning of Zero-shot Models via Variance Reduction
par: Zhu, Beier, et autres
Publié: (2024)
par: Zhu, Beier, et autres
Publié: (2024)
Hierarchical Semantic Alignment for Image Clustering
par: Zhu, Xingyu, et autres
Publié: (2025)
par: Zhu, Xingyu, et autres
Publié: (2025)
Thinking with Images as Continuous Actions: Numerical Visual Chain-of-Thought
par: Zhao, Kesen, et autres
Publié: (2026)
par: Zhao, Kesen, et autres
Publié: (2026)
Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness
par: Zhu, Beier, et autres
Publié: (2025)
par: Zhu, Beier, et autres
Publié: (2025)
MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering
par: Zhou, Yuan, et autres
Publié: (2026)
par: Zhou, Yuan, et autres
Publié: (2026)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Generalized Logit Adjustment: Calibrating Fine-tuned Models by Removing Label Bias in Foundation Models
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Prompt-aligned Gradient for Prompt Tuning
par: Zhu, Beier, et autres
Publié: (2022)
par: Zhu, Beier, et autres
Publié: (2022)
Distilling Parallel Gradients for Fast ODE Solvers of Diffusion Models
par: Zhu, Beier, et autres
Publié: (2025)
par: Zhu, Beier, et autres
Publié: (2025)
Debiased Fine-Tuning for Vision-language Models by Prompt Regularization
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Learning to Adapt SAM for Segmenting Cross-domain Point Clouds
par: Peng, Xidong, et autres
Publié: (2023)
par: Peng, Xidong, et autres
Publié: (2023)
Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
Point Cloud Quantization through Multimodal Prompting for 3D Understanding
par: Li, Hongxuan, et autres
Publié: (2025)
par: Li, Hongxuan, et autres
Publié: (2025)
Parallel Diffusion Solver via Residual Dirichlet Policy Optimization
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
Adapt PointFormer: 3D Point Cloud Analysis via Adapting 2D Visual Transformers
par: Li, Mengke, et autres
Publié: (2024)
par: Li, Mengke, et autres
Publié: (2024)
Reducing Class-Wise Performance Disparity via Margin Regularization
par: Zhu, Beier, et autres
Publié: (2026)
par: Zhu, Beier, et autres
Publié: (2026)
Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!
par: Zhou, Junbao, et autres
Publié: (2025)
par: Zhou, Junbao, et autres
Publié: (2025)
Matching Distance and Geometric Distribution Aided Learning Multiview Point Cloud Registration
par: Li, Shiqi, et autres
Publié: (2025)
par: Li, Shiqi, et autres
Publié: (2025)
Classes Are Not Equal: An Empirical Study on Image Recognition Fairness
par: Cui, Jiequan, et autres
Publié: (2024)
par: Cui, Jiequan, et autres
Publié: (2024)
Generative Distribution Distillation
par: Cui, Jiequan, et autres
Publié: (2025)
par: Cui, Jiequan, et autres
Publié: (2025)
Graph Smoothing for Enhanced Local Geometry Learning in Point Cloud Analysis
par: Yuan, Shangbo, et autres
Publié: (2026)
par: Yuan, Shangbo, et autres
Publié: (2026)
PointSea: Point Cloud Completion via Self-structure Augmentation
par: Zhu, Zhe, et autres
Publié: (2025)
par: Zhu, Zhe, et autres
Publié: (2025)
PointMamba: A Simple State Space Model for Point Cloud Analysis
par: Liang, Dingkang, et autres
Publié: (2024)
par: Liang, Dingkang, et autres
Publié: (2024)
Dynamic Adapter Meets Prompt Tuning: Parameter-Efficient Transfer Learning for Point Cloud Analysis
par: Zhou, Xin, et autres
Publié: (2024)
par: Zhou, Xin, et autres
Publié: (2024)
Boosting Few-Shot Learning via Attentive Feature Regularization
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Real-Time Motion-Controllable Autoregressive Video Diffusion
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
Advancements in Point Cloud Data Augmentation for Deep Learning: A Survey
par: Zhu, Qinfeng, et autres
Publié: (2023)
par: Zhu, Qinfeng, et autres
Publié: (2023)
Multimodal Feature Prototype Learning for Interpretable and Discriminative Cancer Survival Prediction
par: Jiang, Shuo, et autres
Publié: (2025)
par: Jiang, Shuo, et autres
Publié: (2025)
GenPC: Zero-shot Point Cloud Completion via 3D Generative Priors
par: Li, An, et autres
Publié: (2025)
par: Li, An, et autres
Publié: (2025)
Free Lunch for Stabilizing Rectified Flow Inversion
par: Wang, Chenru, et autres
Publié: (2026)
par: Wang, Chenru, et autres
Publié: (2026)
3D Object Detection from Point Cloud via Voting Step Diffusion
par: Hou, Haoran, et autres
Publié: (2024)
par: Hou, Haoran, et autres
Publié: (2024)
Transferable and Undefendable Point Cloud Attacks via Medial Axis Transform
par: Tang, Keke, et autres
Publié: (2025)
par: Tang, Keke, et autres
Publié: (2025)
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
par: Sun, Yuyang, et autres
Publié: (2026)
par: Sun, Yuyang, et autres
Publié: (2026)
Documents similaires
-
Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
par: Zhu, Xingyu, et autres
Publié: (2024) -
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
par: Zhu, Xingyu, et autres
Publié: (2026) -
Enhancing CLIP Robustness via Cross-Modality Alignment
par: Zhu, Xingyu, et autres
Publié: (2025) -
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024) -
Dynamic Multimodal Prototype Learning in Vision-Language Models
par: Zhu, Xingyu, et autres
Publié: (2025)