Saved in:
| Main Authors: | Wang, Haicheng, Ju, Chen, Lin, Weixiong, Xiao, Shuai, Chen, Mengting, Huang, Yixuan, Liu, Chang, Yao, Mingshuai, Lan, Jinsong, Chen, Ying, Liu, Qingwen, Wang, Yanfeng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2412.00440 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Squeeze Out Tokens from Sample for Finer-Grained Data Governance
by: Lin, Weixiong, et al.
Published: (2025)
by: Lin, Weixiong, et al.
Published: (2025)
Improving Human Image Animation via Semantic Representation Alignment
by: Liu, Chang, et al.
Published: (2026)
by: Liu, Chang, et al.
Published: (2026)
Contrast-Unity for Partially-Supervised Temporal Sentence Grounding
by: Wang, Haicheng, et al.
Published: (2025)
by: Wang, Haicheng, et al.
Published: (2025)
Beyond Static Scenes: Camera-controllable Background Generation for Human Motion
by: Yao, Mingshuai, et al.
Published: (2025)
by: Yao, Mingshuai, et al.
Published: (2025)
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
by: Cui, Jiajun, et al.
Published: (2024)
by: Cui, Jiajun, et al.
Published: (2024)
Wear-Any-Way: Manipulable Virtual Try-on via Sparse Correspondence Alignment
by: Chen, Mengting, et al.
Published: (2024)
by: Chen, Mengting, et al.
Published: (2024)
DENOISER: Rethinking the Robustness for Open-Vocabulary Action Recognition
by: Cheng, Haozhe, et al.
Published: (2024)
by: Cheng, Haozhe, et al.
Published: (2024)
Turbo: Informativity-Driven Acceleration Plug-In for Vision-Language Large Models
by: Ju, Chen, et al.
Published: (2024)
by: Ju, Chen, et al.
Published: (2024)
Cell Variational Information Bottleneck Network
by: Zhai, Zhonghua, et al.
Published: (2024)
by: Zhai, Zhonghua, et al.
Published: (2024)
Wave-Particle (Continuous-Discrete) Dualistic Visual Tokenization for Unified Understanding and Generation
by: Chen, Yizhu, et al.
Published: (2025)
by: Chen, Yizhu, et al.
Published: (2025)
Explore More, Learn Better: Parallel MLLM Embeddings under Mutual Information Minimization
by: Wang, Zhicheng, et al.
Published: (2025)
by: Wang, Zhicheng, et al.
Published: (2025)
Enhancing Cross-domain Click-Through Rate Prediction via Explicit Feature Augmentation
by: Chen, Xu, et al.
Published: (2023)
by: Chen, Xu, et al.
Published: (2023)
Advancing Multi-grained Alignment for Contrastive Language-Audio Pre-training
by: Li, Yiming, et al.
Published: (2024)
by: Li, Yiming, et al.
Published: (2024)
Towards Building Multilingual Language Model for Medicine
by: Qiu, Pengcheng, et al.
Published: (2024)
by: Qiu, Pengcheng, et al.
Published: (2024)
Tunnel Try-on: Excavating Spatial-temporal Tunnels for High-quality Virtual Try-on in Videos
by: Xu, Zhengze, et al.
Published: (2024)
by: Xu, Zhengze, et al.
Published: (2024)
Temporal Adaptation of Pre-trained Foundation Models for Music Structure Analysis
by: Zhang, Yixiao, et al.
Published: (2025)
by: Zhang, Yixiao, et al.
Published: (2025)
FOLDER: Accelerating Multi-modal Large Language Models with Enhanced Performance
by: Wang, Haicheng, et al.
Published: (2025)
by: Wang, Haicheng, et al.
Published: (2025)
Holisms of communication
Published: (2021)
Published: (2021)
On the Blessing of Pre-training in Weak-to-Strong Generalization
by: Yao, Wei, et al.
Published: (2026)
by: Yao, Wei, et al.
Published: (2026)
LEDA: Latent Semantic Distribution Alignment for Multi-domain Graph Pre-training
by: Shan, Lianze, et al.
Published: (2026)
by: Shan, Lianze, et al.
Published: (2026)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
by: Liu, Hao, et al.
Published: (2024)
by: Liu, Hao, et al.
Published: (2024)
Dataset Ownership Verification in Contrastive Pre-trained Models
by: Xie, Yuechen, et al.
Published: (2025)
by: Xie, Yuechen, et al.
Published: (2025)
Differential-informed Sample Selection Accelerates Multimodal Contrastive Learning
by: Zhao, Zihua, et al.
Published: (2025)
by: Zhao, Zihua, et al.
Published: (2025)
Eye Movement Variations in Indoor, Outdoor, and Reading Scenarios and Their Implications for Myopia
by: Qi Li, et al.
Published: (2025)
by: Qi Li, et al.
Published: (2025)
Canny2Palm: Realistic and Controllable Palmprint Generation for Large-scale Pre-training
by: Lan, Xingzeng, et al.
Published: (2025)
by: Lan, Xingzeng, et al.
Published: (2025)
Creative‐Becoming Holism: Reflections on and Development of Creative Holism in the Case of Science Education
by: Chenjia Xu, et al.
Published: (2024)
by: Chenjia Xu, et al.
Published: (2024)
Test Gravitational-Wave Polarizations with Space-Based Detectors
by: Wang, Jun-Shuai, et al.
Published: (2025)
by: Wang, Jun-Shuai, et al.
Published: (2025)
ChatMyopia: An AI Agent for Pre-consultation Education in Primary Eye Care Settings
by: Wu, Yue, et al.
Published: (2025)
by: Wu, Yue, et al.
Published: (2025)
Self-Alignment Resonant Beam Empowers Beamforming without Estimation and Control for 6G IoT
by: Guo, Yixuan, et al.
Published: (2025)
by: Guo, Yixuan, et al.
Published: (2025)
Cross-Subject EEG Emotion Recognition Based on Temporal Asynchronous Alignment Contrastive Learning
by: Xie, Ying, et al.
Published: (2026)
by: Xie, Ying, et al.
Published: (2026)
Lory: Fully Differentiable Mixture-of-Experts for Autoregressive Language Model Pre-training
by: Zhong, Zexuan, et al.
Published: (2024)
by: Zhong, Zexuan, et al.
Published: (2024)
Can Pre-trained Language Models Understand Chinese Humor?
by: Chen, Yuyan, et al.
Published: (2024)
by: Chen, Yuyan, et al.
Published: (2024)
Pre-training vs. Fine-tuning: A Reproducibility Study on Dense Retrieval Knowledge Acquisition
by: Yao, Zheng, et al.
Published: (2025)
by: Yao, Zheng, et al.
Published: (2025)
Disentangling the Prosody and Semantic Information with Pre-trained Model for In-Context Learning based Zero-Shot Voice Conversion
by: Chen, Zhengyang, et al.
Published: (2024)
by: Chen, Zhengyang, et al.
Published: (2024)
Contrastive Language Video Time Pre-training
by: Liu, Hengyue, et al.
Published: (2024)
by: Liu, Hengyue, et al.
Published: (2024)
Serendipity and Holism: The Beauty of OPACs.
by: Rice, James
Published: (1988)
by: Rice, James
Published: (1988)
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
by: Hu, Shengchao, et al.
Published: (2024)
by: Hu, Shengchao, et al.
Published: (2024)
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
by: Wang, Zhihao, et al.
Published: (2024)
by: Wang, Zhihao, et al.
Published: (2024)
UniChest: Conquer-and-Divide Pre-training for Multi-Source Chest X-Ray Classification
by: Dai, Tianjie, et al.
Published: (2023)
by: Dai, Tianjie, et al.
Published: (2023)
Towards Fine-Grained and Multi-Granular Contrastive Language-Speech Pre-training
by: Yang, Yifan, et al.
Published: (2026)
by: Yang, Yifan, et al.
Published: (2026)
Similar Items
-
Squeeze Out Tokens from Sample for Finer-Grained Data Governance
by: Lin, Weixiong, et al.
Published: (2025) -
Improving Human Image Animation via Semantic Representation Alignment
by: Liu, Chang, et al.
Published: (2026) -
Contrast-Unity for Partially-Supervised Temporal Sentence Grounding
by: Wang, Haicheng, et al.
Published: (2025) -
Beyond Static Scenes: Camera-controllable Background Generation for Human Motion
by: Yao, Mingshuai, et al.
Published: (2025) -
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
by: Cui, Jiajun, et al.
Published: (2024)