MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Han, Xu, Tang, Yuan, Xu, Jinfeng, Li, Xianzhi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mamba3D: Enhancing Local Features for 3D Point Cloud Analysis via State Space Model
par: Han, Xu, et autres
Publié: (2024)
par: Han, Xu, et autres
Publié: (2024)
MoST: Multi-modality Scene Tokenization for Motion Prediction
par: Mu, Norman, et autres
Publié: (2024)
par: Mu, Norman, et autres
Publié: (2024)
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
MonarchRT: Efficient Attention for Real-Time Video Generation
par: Agarwal, Krish, et autres
Publié: (2026)
par: Agarwal, Krish, et autres
Publié: (2026)
MoST: Motion Style Transformer between Diverse Action Contents
par: Kim, Boeun, et autres
Publié: (2024)
par: Kim, Boeun, et autres
Publié: (2024)
LumiX: Structured and Coherent Text-to-Intrinsic Generation
par: Han, Xu, et autres
Publié: (2025)
par: Han, Xu, et autres
Publié: (2025)
PointDreamer: Zero-shot 3D Textured Mesh Reconstruction from Colored Point Cloud
par: Yu, Qiao, et autres
Publié: (2024)
par: Yu, Qiao, et autres
Publié: (2024)
TSP3D: Text-guided Sparse Voxel Pruning for Efficient 3D Visual Grounding
par: Guo, Wenxuan, et autres
Publié: (2025)
par: Guo, Wenxuan, et autres
Publié: (2025)
GRPO-RM: Fine-Tuning Representation Models via GRPO-Driven Reinforcement Learning
par: Xu, Yanchen, et autres
Publié: (2025)
par: Xu, Yanchen, et autres
Publié: (2025)
More Text, Less Point: Towards 3D Data-Efficient Point-Language Understanding
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
CLIP-UP: A Simple and Efficient Mixture-of-Experts CLIP Training Recipe with Sparse Upcycling
par: Wang, Xinze, et autres
Publié: (2025)
par: Wang, Xinze, et autres
Publié: (2025)
PDF: A Probability-Driven Framework for Open World 3D Point Cloud Semantic Segmentation
par: Xu, Jinfeng, et autres
Publié: (2024)
par: Xu, Jinfeng, et autres
Publié: (2024)
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
par: Ma, Yuting, et autres
Publié: (2024)
par: Ma, Yuting, et autres
Publié: (2024)
SASep: Saliency-Aware Structured Separation of Geometry and Feature for Open Set Learning on Point Clouds
par: Xu, Jinfeng, et autres
Publié: (2025)
par: Xu, Jinfeng, et autres
Publié: (2025)
MoEGCL: Mixture of Ego-Graphs Contrastive Representation Learning for Multi-View Clustering
par: Zhu, Jian, et autres
Publié: (2025)
par: Zhu, Jian, et autres
Publié: (2025)
Unsupervised Representation Learning from Sparse Transformation Analysis
par: Song, Yue, et autres
Publié: (2024)
par: Song, Yue, et autres
Publié: (2024)
Sparse Autoencoders for Interpretable Medical Image Representation Learning
par: Wesp, Philipp, et autres
Publié: (2026)
par: Wesp, Philipp, et autres
Publié: (2026)
RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)
par: Liu, Yuxi, et autres
Publié: (2026)
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations
par: Ze, Yanjie, et autres
Publié: (2024)
par: Ze, Yanjie, et autres
Publié: (2024)
Spectrum-Aware Parameter Efficient Fine-Tuning for Diffusion Models
par: Zhang, Xinxi, et autres
Publié: (2024)
par: Zhang, Xinxi, et autres
Publié: (2024)
SRL-SOA: Self-Representation Learning with Sparse 1D-Operational Autoencoder for Hyperspectral Image Band Selection
par: Ahishali, Mete, et autres
Publié: (2022)
par: Ahishali, Mete, et autres
Publié: (2022)
Point-PEFT: Parameter-Efficient Fine-Tuning for 3D Pre-trained Models
par: Tang, Yiwen, et autres
Publié: (2023)
par: Tang, Yiwen, et autres
Publié: (2023)
Expanding Sparse Tuning for Low Memory Usage
par: Shen, Shufan, et autres
Publié: (2024)
par: Shen, Shufan, et autres
Publié: (2024)
LoST: Level of Semantics Tokenization for 3D Shapes
par: Dutt, Niladri Shekhar, et autres
Publié: (2026)
par: Dutt, Niladri Shekhar, et autres
Publié: (2026)
Rep-MTL: Unleashing the Power of Representation-level Task Saliency for Multi-Task Learning
par: Wang, Zedong, et autres
Publié: (2025)
par: Wang, Zedong, et autres
Publié: (2025)
CGL: Advancing Continual GUI Learning via Reinforcement Fine-Tuning
par: Yao, Zhenquan, et autres
Publié: (2026)
par: Yao, Zhenquan, et autres
Publié: (2026)
Probing the Representational Power of Sparse Autoencoders in Vision Models
par: Olson, Matthew Lyle, et autres
Publié: (2025)
par: Olson, Matthew Lyle, et autres
Publié: (2025)
When Does Sparse MoE Help in Vision? The Role of Backbone Compute Leverage in Sparse Routing
par: Sun, Libo, et autres
Publié: (2026)
par: Sun, Libo, et autres
Publié: (2026)
GRPO-TTA: Test-Time Visual Tuning for Vision-Language Models via GRPO-Driven Reinforcement Learning
par: Li, Yujun, et autres
Publié: (2026)
par: Li, Yujun, et autres
Publié: (2026)
MoP-CLIP: A Mixture of Prompt-Tuned CLIP Models for Domain Incremental Learning
par: Nicolas, Julien, et autres
Publié: (2023)
par: Nicolas, Julien, et autres
Publié: (2023)
Hierarchy-Guided Multimodal Representation Learning for Taxonomic Inference
par: Ahmed, Sk Miraj, et autres
Publié: (2026)
par: Ahmed, Sk Miraj, et autres
Publié: (2026)
Towards Sparse Video Understanding and Reasoning
par: Xu, Chenwei, et autres
Publié: (2026)
par: Xu, Chenwei, et autres
Publié: (2026)
Neighbour-level Message Interaction Encoding for Improved Representation Learning on Graphs
par: Zhang, Haimin, et autres
Publié: (2024)
par: Zhang, Haimin, et autres
Publié: (2024)
Trustworthy Personalized Bayesian Federated Learning via Posterior Fine-Tune
par: Luo, Mengen, et autres
Publié: (2024)
par: Luo, Mengen, et autres
Publié: (2024)
Memory-Space Visual Prompting for Efficient Vision-Language Fine-Tuning
par: Jie, Shibo, et autres
Publié: (2024)
par: Jie, Shibo, et autres
Publié: (2024)
Mixed Autoencoder for Self-supervised Visual Representation Learning
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
Learning Semantic Proxies from Visual Prompts for Parameter-Efficient Fine-Tuning in Deep Metric Learning
par: Ren, Li, et autres
Publié: (2024)
par: Ren, Li, et autres
Publié: (2024)
LiMoE: Mixture of LiDAR Representation Learners from Automotive Scenes
par: Xu, Xiang, et autres
Publié: (2025)
par: Xu, Xiang, et autres
Publié: (2025)
Learning Continuous Face Representation with Explicit Functions
par: Zhang, Liping, et autres
Publié: (2021)
par: Zhang, Liping, et autres
Publié: (2021)
4D Contrastive Superflows are Dense 3D Representation Learners
par: Xu, Xiang, et autres
Publié: (2024)
par: Xu, Xiang, et autres
Publié: (2024)
Documents similaires
-
Mamba3D: Enhancing Local Features for 3D Point Cloud Analysis via State Space Model
par: Han, Xu, et autres
Publié: (2024) -
MoST: Multi-modality Scene Tokenization for Motion Prediction
par: Mu, Norman, et autres
Publié: (2024) -
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024) -
MonarchRT: Efficient Attention for Real-Time Video Generation
par: Agarwal, Krish, et autres
Publié: (2026) -
MoST: Motion Style Transformer between Diverse Action Contents
par: Kim, Boeun, et autres
Publié: (2024)