Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Xingyu, Yi, Liang, Wang, Shuo, Zhu, Wenbo, Wu, Yonglinag, Zhu, Beier, Zhang, Hanwang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
por: Zhu, Xingyu, et al.
Publicado: (2024)
por: Zhu, Xingyu, et al.
Publicado: (2024)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
Enhancing CLIP Robustness via Cross-Modality Alignment
por: Zhu, Xingyu, et al.
Publicado: (2025)
por: Zhu, Xingyu, et al.
Publicado: (2025)
Selective Vision-Language Subspace Projection for Few-shot CLIP
por: Zhu, Xingyu, et al.
Publicado: (2024)
por: Zhu, Xingyu, et al.
Publicado: (2024)
Dynamic Multimodal Prototype Learning in Vision-Language Models
por: Zhu, Xingyu, et al.
Publicado: (2025)
por: Zhu, Xingyu, et al.
Publicado: (2025)
Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
Robust Fine-tuning of Zero-shot Models via Variance Reduction
por: Zhu, Beier, et al.
Publicado: (2024)
por: Zhu, Beier, et al.
Publicado: (2024)
Hierarchical Semantic Alignment for Image Clustering
por: Zhu, Xingyu, et al.
Publicado: (2025)
por: Zhu, Xingyu, et al.
Publicado: (2025)
Thinking with Images as Continuous Actions: Numerical Visual Chain-of-Thought
por: Zhao, Kesen, et al.
Publicado: (2026)
por: Zhao, Kesen, et al.
Publicado: (2026)
Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization
por: Zhao, Kesen, et al.
Publicado: (2025)
por: Zhao, Kesen, et al.
Publicado: (2025)
Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness
por: Zhu, Beier, et al.
Publicado: (2025)
por: Zhu, Beier, et al.
Publicado: (2025)
MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering
por: Zhou, Yuan, et al.
Publicado: (2026)
por: Zhou, Yuan, et al.
Publicado: (2026)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
Generalized Logit Adjustment: Calibrating Fine-tuned Models by Removing Label Bias in Foundation Models
por: Zhu, Beier, et al.
Publicado: (2023)
por: Zhu, Beier, et al.
Publicado: (2023)
Prompt-aligned Gradient for Prompt Tuning
por: Zhu, Beier, et al.
Publicado: (2022)
por: Zhu, Beier, et al.
Publicado: (2022)
Distilling Parallel Gradients for Fast ODE Solvers of Diffusion Models
por: Zhu, Beier, et al.
Publicado: (2025)
por: Zhu, Beier, et al.
Publicado: (2025)
Debiased Fine-Tuning for Vision-language Models by Prompt Regularization
por: Zhu, Beier, et al.
Publicado: (2023)
por: Zhu, Beier, et al.
Publicado: (2023)
Learning to Adapt SAM for Segmenting Cross-domain Point Clouds
por: Peng, Xidong, et al.
Publicado: (2023)
por: Peng, Xidong, et al.
Publicado: (2023)
Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation
por: Zhu, Xingyu, et al.
Publicado: (2026)
por: Zhu, Xingyu, et al.
Publicado: (2026)
Point Cloud Quantization through Multimodal Prompting for 3D Understanding
por: Li, Hongxuan, et al.
Publicado: (2025)
por: Li, Hongxuan, et al.
Publicado: (2025)
Parallel Diffusion Solver via Residual Dirichlet Policy Optimization
por: Wang, Ruoyu, et al.
Publicado: (2025)
por: Wang, Ruoyu, et al.
Publicado: (2025)
Adapt PointFormer: 3D Point Cloud Analysis via Adapting 2D Visual Transformers
por: Li, Mengke, et al.
Publicado: (2024)
por: Li, Mengke, et al.
Publicado: (2024)
Reducing Class-Wise Performance Disparity via Margin Regularization
por: Zhu, Beier, et al.
Publicado: (2026)
por: Zhu, Beier, et al.
Publicado: (2026)
Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!
por: Zhou, Junbao, et al.
Publicado: (2025)
por: Zhou, Junbao, et al.
Publicado: (2025)
Matching Distance and Geometric Distribution Aided Learning Multiview Point Cloud Registration
por: Li, Shiqi, et al.
Publicado: (2025)
por: Li, Shiqi, et al.
Publicado: (2025)
Classes Are Not Equal: An Empirical Study on Image Recognition Fairness
por: Cui, Jiequan, et al.
Publicado: (2024)
por: Cui, Jiequan, et al.
Publicado: (2024)
Generative Distribution Distillation
por: Cui, Jiequan, et al.
Publicado: (2025)
por: Cui, Jiequan, et al.
Publicado: (2025)
Graph Smoothing for Enhanced Local Geometry Learning in Point Cloud Analysis
por: Yuan, Shangbo, et al.
Publicado: (2026)
por: Yuan, Shangbo, et al.
Publicado: (2026)
PointSea: Point Cloud Completion via Self-structure Augmentation
por: Zhu, Zhe, et al.
Publicado: (2025)
por: Zhu, Zhe, et al.
Publicado: (2025)
PointMamba: A Simple State Space Model for Point Cloud Analysis
por: Liang, Dingkang, et al.
Publicado: (2024)
por: Liang, Dingkang, et al.
Publicado: (2024)
Dynamic Adapter Meets Prompt Tuning: Parameter-Efficient Transfer Learning for Point Cloud Analysis
por: Zhou, Xin, et al.
Publicado: (2024)
por: Zhou, Xin, et al.
Publicado: (2024)
Boosting Few-Shot Learning via Attentive Feature Regularization
por: Zhu, Xingyu, et al.
Publicado: (2024)
por: Zhu, Xingyu, et al.
Publicado: (2024)
Real-Time Motion-Controllable Autoregressive Video Diffusion
por: Zhao, Kesen, et al.
Publicado: (2025)
por: Zhao, Kesen, et al.
Publicado: (2025)
Advancements in Point Cloud Data Augmentation for Deep Learning: A Survey
por: Zhu, Qinfeng, et al.
Publicado: (2023)
por: Zhu, Qinfeng, et al.
Publicado: (2023)
Multimodal Feature Prototype Learning for Interpretable and Discriminative Cancer Survival Prediction
por: Jiang, Shuo, et al.
Publicado: (2025)
por: Jiang, Shuo, et al.
Publicado: (2025)
GenPC: Zero-shot Point Cloud Completion via 3D Generative Priors
por: Li, An, et al.
Publicado: (2025)
por: Li, An, et al.
Publicado: (2025)
3D Object Detection from Point Cloud via Voting Step Diffusion
por: Hou, Haoran, et al.
Publicado: (2024)
por: Hou, Haoran, et al.
Publicado: (2024)
Free Lunch for Stabilizing Rectified Flow Inversion
por: Wang, Chenru, et al.
Publicado: (2026)
por: Wang, Chenru, et al.
Publicado: (2026)
Transferable and Undefendable Point Cloud Attacks via Medial Axis Transform
por: Tang, Keke, et al.
Publicado: (2025)
por: Tang, Keke, et al.
Publicado: (2025)
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
por: Sun, Yuyang, et al.
Publicado: (2026)
por: Sun, Yuyang, et al.
Publicado: (2026)
Ejemplares similares
-
Enhancing Zero-Shot Vision Models by Label-Free Prompt Distribution Learning and Bias Correcting
por: Zhu, Xingyu, et al.
Publicado: (2024) -
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
por: Zhu, Xingyu, et al.
Publicado: (2026) -
Enhancing CLIP Robustness via Cross-Modality Alignment
por: Zhu, Xingyu, et al.
Publicado: (2025) -
Selective Vision-Language Subspace Projection for Few-shot CLIP
por: Zhu, Xingyu, et al.
Publicado: (2024) -
Dynamic Multimodal Prototype Learning in Vision-Language Models
por: Zhu, Xingyu, et al.
Publicado: (2025)