Salvato in:
| Autori principali: | Pan, Baiyu, jiao, jichao, Yao, Bowen, Pang, Jianxin, Cheng, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2410.06527 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distill-then-prune: An Efficient Compression Framework for Real-time Stereo Matching Network on Edge Devices
di: Pan, Baiyu, et al.
Pubblicazione: (2024)
di: Pan, Baiyu, et al.
Pubblicazione: (2024)
StereoVAE: A lightweight stereo-matching system using embedded GPUs
di: Chang, Qiong, et al.
Pubblicazione: (2023)
di: Chang, Qiong, et al.
Pubblicazione: (2023)
LACOSTE: Exploiting stereo and temporal contexts for surgical instrument segmentation
di: Wang, Qiyuan, et al.
Pubblicazione: (2024)
di: Wang, Qiyuan, et al.
Pubblicazione: (2024)
Thinker: A vision-language foundation model for embodied intelligence
di: Pan, Baiyu, et al.
Pubblicazione: (2026)
di: Pan, Baiyu, et al.
Pubblicazione: (2026)
GeoPE:A Unified Geometric Positional Embedding for Structured Tensors
di: Yao, Yupu, et al.
Pubblicazione: (2025)
di: Yao, Yupu, et al.
Pubblicazione: (2025)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
di: Wu, Yiming, et al.
Pubblicazione: (2025)
di: Wu, Yiming, et al.
Pubblicazione: (2025)
Adaptively Sampling-Reusing-Mixing Decomposed Gradients to Speed Up Sharpness Aware Minimization
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
AppleGrowthVision: A large-scale stereo dataset for phenological analysis, fruit detection, and 3D reconstruction in apple orchards
di: von Hirschhausen, Laura-Sophia, et al.
Pubblicazione: (2025)
di: von Hirschhausen, Laura-Sophia, et al.
Pubblicazione: (2025)
Language Models Can See Better: Visual Contrastive Decoding For LLM Multimodal Reasoning
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
di: Shenoy, Rahul, et al.
Pubblicazione: (2024)
di: Shenoy, Rahul, et al.
Pubblicazione: (2024)
MoCHA: Advanced Vision-Language Reasoning with MoE Connector and Hierarchical Group Attention
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
All You Need in Knowledge Distillation Is a Tailored Coordinate System
di: Zhou, Junjie, et al.
Pubblicazione: (2024)
di: Zhou, Junjie, et al.
Pubblicazione: (2024)
DTL: Disentangled Transfer Learning for Visual Recognition
di: Fu, Minghao, et al.
Pubblicazione: (2023)
di: Fu, Minghao, et al.
Pubblicazione: (2023)
Multi-Sample Anti-Aliasing and Constrained Optimization for 3D Gaussian Splatting
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
Progressive Gaussian Transformer with Anisotropy-aware Sampling for Open Vocabulary Occupancy Prediction
di: Yan, Chi, et al.
Pubblicazione: (2025)
di: Yan, Chi, et al.
Pubblicazione: (2025)
Temporal-adaptive Weight Quantization for Spiking Neural Networks
di: Zhang, Han, et al.
Pubblicazione: (2025)
di: Zhang, Han, et al.
Pubblicazione: (2025)
Enhanced Sample Selection with Confidence Tracking: Identifying Correctly Labeled yet Hard-to-Learn Samples in Noisy Data
di: Pan, Weiran, et al.
Pubblicazione: (2025)
di: Pan, Weiran, et al.
Pubblicazione: (2025)
Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning
di: Cheng, Hanbo, et al.
Pubblicazione: (2026)
di: Cheng, Hanbo, et al.
Pubblicazione: (2026)
Low-rank Attention Side-Tuning for Parameter-Efficient Fine-Tuning
di: Tang, Ningyuan, et al.
Pubblicazione: (2024)
di: Tang, Ningyuan, et al.
Pubblicazione: (2024)
Restoring Real-World Images with an Internal Detail Enhancement Diffusion Model
di: Xiao, Peng, et al.
Pubblicazione: (2025)
di: Xiao, Peng, et al.
Pubblicazione: (2025)
SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition
di: Yang, Jingxiao, et al.
Pubblicazione: (2026)
di: Yang, Jingxiao, et al.
Pubblicazione: (2026)
Subspace-Guided Semantic and Topological Invariant Registration for Annotation-Free Ultrasound Plane Quality Control
di: Zhu, Chunzheng, et al.
Pubblicazione: (2026)
di: Zhu, Chunzheng, et al.
Pubblicazione: (2026)
Diffusion-Based Cross-Modal Feature Extraction for Multi-Label Classification
di: Lan, Tian, et al.
Pubblicazione: (2025)
di: Lan, Tian, et al.
Pubblicazione: (2025)
Learning Physics-Grounded 4D Dynamics with Neural Gaussian Force Fields
di: Li, Shiqian, et al.
Pubblicazione: (2026)
di: Li, Shiqian, et al.
Pubblicazione: (2026)
Deep Learning for Video Anomaly Detection: A Review
di: Wu, Peng, et al.
Pubblicazione: (2024)
di: Wu, Peng, et al.
Pubblicazione: (2024)
MedEyes: Learning Dynamic Visual Focus for Medical Progressive Diagnosis
di: Zhu, Chunzheng, et al.
Pubblicazione: (2025)
di: Zhu, Chunzheng, et al.
Pubblicazione: (2025)
MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution
di: Zhu, Chunzheng, et al.
Pubblicazione: (2026)
di: Zhu, Chunzheng, et al.
Pubblicazione: (2026)
ExtrinSplat: Decoupling Geometry and Semantics for Open-Vocabulary Understanding in 3D Gaussian Splatting
di: Ding, Jiayu, et al.
Pubblicazione: (2025)
di: Ding, Jiayu, et al.
Pubblicazione: (2025)
COMODO: Cross-Modal Video-to-IMU Distillation for Efficient Egocentric Human Activity Recognition
di: Chen, Baiyu, et al.
Pubblicazione: (2025)
di: Chen, Baiyu, et al.
Pubblicazione: (2025)
GS-DMSR: Dynamic Sensitive Multi-scale Manifold Enhancement for Accelerated High-Quality 3D Gaussian Splatting
di: Lu, Nengbo, et al.
Pubblicazione: (2026)
di: Lu, Nengbo, et al.
Pubblicazione: (2026)
GaussianCross: Cross-modal Self-supervised 3D Representation Learning via Gaussian Splatting
di: Yao, Lei, et al.
Pubblicazione: (2025)
di: Yao, Lei, et al.
Pubblicazione: (2025)
Gamba: Marry Gaussian Splatting with Mamba for single view 3D reconstruction
di: Shen, Qiuhong, et al.
Pubblicazione: (2024)
di: Shen, Qiuhong, et al.
Pubblicazione: (2024)
Robust 3D-Masked Part-level Editing in 3D Gaussian Splatting with Regularized Score Distillation Sampling
di: Kim, Hayeon, et al.
Pubblicazione: (2025)
di: Kim, Hayeon, et al.
Pubblicazione: (2025)
Acquiring Weak Annotations for Tumor Localization in Temporal and Volumetric Data
di: Chou, Yu-Cheng, et al.
Pubblicazione: (2023)
di: Chou, Yu-Cheng, et al.
Pubblicazione: (2023)
Morse: Dual-Sampling for Lossless Acceleration of Diffusion Models
di: Li, Chao, et al.
Pubblicazione: (2025)
di: Li, Chao, et al.
Pubblicazione: (2025)
Few-shot Open Relation Extraction with Gaussian Prototype and Adaptive Margin
di: Guo, Tianlin, et al.
Pubblicazione: (2024)
di: Guo, Tianlin, et al.
Pubblicazione: (2024)
HFGaussian: Learning Generalizable Gaussian Human with Integrated Human Features
di: Dey, Arnab, et al.
Pubblicazione: (2024)
di: Dey, Arnab, et al.
Pubblicazione: (2024)
UnitedVLN: Generalizable Gaussian Splatting for Continuous Vision-Language Navigation
di: Dai, Guangzhao, et al.
Pubblicazione: (2024)
di: Dai, Guangzhao, et al.
Pubblicazione: (2024)
GaussianAD: Gaussian-Centric End-to-End Autonomous Driving
di: Zheng, Wenzhao, et al.
Pubblicazione: (2024)
di: Zheng, Wenzhao, et al.
Pubblicazione: (2024)
Spoof Trace Discovery for Deep Learning Based Explainable Face Anti-Spoofing
di: Zhang, Haoyuan, et al.
Pubblicazione: (2024)
di: Zhang, Haoyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Distill-then-prune: An Efficient Compression Framework for Real-time Stereo Matching Network on Edge Devices
di: Pan, Baiyu, et al.
Pubblicazione: (2024) -
StereoVAE: A lightweight stereo-matching system using embedded GPUs
di: Chang, Qiong, et al.
Pubblicazione: (2023) -
LACOSTE: Exploiting stereo and temporal contexts for surgical instrument segmentation
di: Wang, Qiyuan, et al.
Pubblicazione: (2024) -
Thinker: A vision-language foundation model for embodied intelligence
di: Pan, Baiyu, et al.
Pubblicazione: (2026) -
GeoPE:A Unified Geometric Positional Embedding for Structured Tensors
di: Yao, Yupu, et al.
Pubblicazione: (2025)