Faster Diffusion Action Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Shuaibing, Wang, Shunli, Li, Mingcheng, Yang, Dingkang, Kuang, Haopeng, Qian, Ziyun, Zhang, Lihua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HandGCAT: Occlusion-Robust 3D Hand Mesh Reconstruction from Monocular Images
di: Wang, Shuaibing, et al.
Pubblicazione: (2024)
di: Wang, Shuaibing, et al.
Pubblicazione: (2024)
Robust Emotion Recognition in Context Debiasing
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
Correlation-Decoupled Knowledge Distillation for Multimodal Sentiment Analysis with Incomplete Modalities
di: Li, Mingcheng, et al.
Pubblicazione: (2024)
di: Li, Mingcheng, et al.
Pubblicazione: (2024)
Toward Robust Incomplete Multimodal Sentiment Analysis via Hierarchical Representation Learning
di: Li, Mingcheng, et al.
Pubblicazione: (2024)
di: Li, Mingcheng, et al.
Pubblicazione: (2024)
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
SMCD: High Realism Motion Style Transfer via Mamba-based Diffusion
di: Qian, Ziyun, et al.
Pubblicazione: (2024)
di: Qian, Ziyun, et al.
Pubblicazione: (2024)
CoMT: Chain-of-Medical-Thought Reduces Hallucination in Medical Report Generation
di: Jiang, Yue, et al.
Pubblicazione: (2024)
di: Jiang, Yue, et al.
Pubblicazione: (2024)
Towards Context-Aware Emotion Recognition Debiasing from a Causal Demystification Perspective via De-confounded Training
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
di: Li, Mingcheng, et al.
Pubblicazione: (2025)
di: Li, Mingcheng, et al.
Pubblicazione: (2025)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
Multi-Scale Heterogeneity-Aware Hypergraph Representation for Histopathology Whole Slide Images
di: Han, Minghao, et al.
Pubblicazione: (2024)
di: Han, Minghao, et al.
Pubblicazione: (2024)
PersonaAnimator: Personalized Motion Transfer from Unconstrained Videos
di: Qian, Ziyun, et al.
Pubblicazione: (2025)
di: Qian, Ziyun, et al.
Pubblicazione: (2025)
Asynchronous Multimodal Video Sequence Fusion via Learning Modality-Exclusive and -Agnostic Representations
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
Resolving Evidence Sparsity: Agentic Context Engineering for Long-Document Understanding
di: Liu, Keliang, et al.
Pubblicazione: (2025)
di: Liu, Keliang, et al.
Pubblicazione: (2025)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
di: Xue, Wei, et al.
Pubblicazione: (2026)
di: Xue, Wei, et al.
Pubblicazione: (2026)
Skip and Skip: Segmenting Medical Images with Prompts
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
Improving Multimodal Sentiment Analysis via Modality Optimization and Dynamic Primary Modality Selection
di: Yang, Dingkang, et al.
Pubblicazione: (2025)
di: Yang, Dingkang, et al.
Pubblicazione: (2025)
SatireDecoder: Visual Cascaded Decoupling for Enhancing Satirical Image Comprehension
di: Jiang, Yue, et al.
Pubblicazione: (2025)
di: Jiang, Yue, et al.
Pubblicazione: (2025)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
HybridOcc: NeRF Enhanced Transformer-based Multi-Camera 3D Occupancy Prediction
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
Towards Multimodal Sentiment Analysis Debiasing via Bias Purification
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
FysicsWorld: A Unified Full-Modality Benchmark for Any-to-Any Understanding, Generation, and Reasoning
di: Jiang, Yue, et al.
Pubblicazione: (2025)
di: Jiang, Yue, et al.
Pubblicazione: (2025)
MSCPT: Few-shot Whole Slide Image Classification with Multi-scale and Context-focused Prompt Tuning
di: Han, Minghao, et al.
Pubblicazione: (2024)
di: Han, Minghao, et al.
Pubblicazione: (2024)
OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization
di: Han, Minghao, et al.
Pubblicazione: (2026)
di: Han, Minghao, et al.
Pubblicazione: (2026)
Image-Conditioned Instance Prompt Network for Referring Remote Sensing Image Segmentation
di: Ren, Biaoyu, et al.
Pubblicazione: (2026)
di: Ren, Biaoyu, et al.
Pubblicazione: (2026)
Make Your ViT-based Multi-view 3D Detectors Faster via Token Compression
di: Zhang, Dingyuan, et al.
Pubblicazione: (2024)
di: Zhang, Dingyuan, et al.
Pubblicazione: (2024)
Fusing Pixels and Genes: Spatially-Aware Learning in Computational Pathology
di: Han, Minghao, et al.
Pubblicazione: (2026)
di: Han, Minghao, et al.
Pubblicazione: (2026)
Un-EVIMO: Unsupervised Event-Based Independent Motion Segmentation
di: Wang, Ziyun, et al.
Pubblicazione: (2023)
di: Wang, Ziyun, et al.
Pubblicazione: (2023)
SPT: Sequence Prompt Transformer for Interactive Image Segmentation
di: Cheng, Senlin, et al.
Pubblicazione: (2024)
di: Cheng, Senlin, et al.
Pubblicazione: (2024)
FasterDiT: Towards Faster Diffusion Transformers Training without Architecture Modification
di: Yao, Jingfeng, et al.
Pubblicazione: (2024)
di: Yao, Jingfeng, et al.
Pubblicazione: (2024)
Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference
di: Li, Senmao, et al.
Pubblicazione: (2023)
di: Li, Senmao, et al.
Pubblicazione: (2023)
De-confounded Data-free Knowledge Distillation for Handling Distribution Shifts
di: Wang, Yuzheng, et al.
Pubblicazione: (2024)
di: Wang, Yuzheng, et al.
Pubblicazione: (2024)
Loom: Diffusion-Transformer for Interleaved Generation
di: Ye, Mingcheng, et al.
Pubblicazione: (2025)
di: Ye, Mingcheng, et al.
Pubblicazione: (2025)
MISS: A Generative Pretraining and Finetuning Approach for Med-VQA
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
Distribution Backtracking Builds A Faster Convergence Trajectory for Diffusion Distillation
di: Zhang, Shengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Shengyuan, et al.
Pubblicazione: (2024)
Autoregressive Image Generation with Randomized Parallel Decoding
di: Li, Haopeng, et al.
Pubblicazione: (2025)
di: Li, Haopeng, et al.
Pubblicazione: (2025)
MM-Snowball: Evaluating and Mitigating Hallucination Snowballing in Multimodal Multi-Turn Dialogue
di: Jiang, Yue, et al.
Pubblicazione: (2026)
di: Jiang, Yue, et al.
Pubblicazione: (2026)
Bidirectional Sparse Attention for Faster Video Diffusion Training
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
di: Zhan, Chenlu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HandGCAT: Occlusion-Robust 3D Hand Mesh Reconstruction from Monocular Images
di: Wang, Shuaibing, et al.
Pubblicazione: (2024) -
Robust Emotion Recognition in Context Debiasing
di: Yang, Dingkang, et al.
Pubblicazione: (2024) -
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024) -
Correlation-Decoupled Knowledge Distillation for Multimodal Sentiment Analysis with Incomplete Modalities
di: Li, Mingcheng, et al.
Pubblicazione: (2024) -
Toward Robust Incomplete Multimodal Sentiment Analysis via Hierarchical Representation Learning
di: Li, Mingcheng, et al.
Pubblicazione: (2024)