MLIP: Efficient Multi-Perspective Language-Image Pretraining with Exhaustive Data Utilization
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yu, Zhang, Qi, Gong, Zixuan, Shi, Yiwei, Liu, Yepeng, Miao, Duoqian, Liu, Yang, Liu, Ke, Yi, Kun, Fan, Wei, Hu, Liang, Wang, Changwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lite-Mind: Towards Efficient and Robust Brain Representation Network
di: Gong, Zixuan, et al.
Pubblicazione: (2023)
di: Gong, Zixuan, et al.
Pubblicazione: (2023)
Multimodal Federated Learning with Missing Modality via Prototype Mask and Contrast
di: Bao, Guangyin, et al.
Pubblicazione: (2023)
di: Bao, Guangyin, et al.
Pubblicazione: (2023)
Markovian Scale Prediction: A New Era of Visual Autoregressive Generation
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
MindTuner: Cross-Subject Visual Decoding with Visual Fingerprint and Semantic Correction
di: Gong, Zixuan, et al.
Pubblicazione: (2024)
di: Gong, Zixuan, et al.
Pubblicazione: (2024)
Boosting Adversarial Transferability via Commonality-Oriented Gradient Optimization
di: Gao, Yanting, et al.
Pubblicazione: (2025)
di: Gao, Yanting, et al.
Pubblicazione: (2025)
Wills Aligner: Multi-Subject Collaborative Brain Visual Decoding
di: Bao, Guangyin, et al.
Pubblicazione: (2024)
di: Bao, Guangyin, et al.
Pubblicazione: (2024)
HyDiscGAN: A Hybrid Distributed cGAN for Audio-Visual Privacy Preservation in Multimodal Sentiment Analysis
di: Wu, Zhuojia, et al.
Pubblicazione: (2024)
di: Wu, Zhuojia, et al.
Pubblicazione: (2024)
NeuroClips: Towards High-fidelity and Smooth fMRI-to-Video Reconstruction
di: Gong, Zixuan, et al.
Pubblicazione: (2024)
di: Gong, Zixuan, et al.
Pubblicazione: (2024)
MindSimulator: Exploring Brain Concept Localization via Synthetic FMRI
di: Bao, Guangyin, et al.
Pubblicazione: (2025)
di: Bao, Guangyin, et al.
Pubblicazione: (2025)
Adaptive Visual Autoregressive Acceleration via Dual-Linkage Entropy Analysis
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
MLIP Benchmark
di: Maxson, Tristan, et al.
Pubblicazione: (2024)
di: Maxson, Tristan, et al.
Pubblicazione: (2024)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Swordsman: Entropy-Driven Adaptive Block Partition for Efficient Diffusion Language Models
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
Improving Prediction Certainty Estimation for Reliable Early Exiting via Null Space Projection
di: He, Jianing, et al.
Pubblicazione: (2025)
di: He, Jianing, et al.
Pubblicazione: (2025)
Bayesian Selection for Efficient MLIP Dataset Selection
di: Rocke, Thomas, et al.
Pubblicazione: (2025)
di: Rocke, Thomas, et al.
Pubblicazione: (2025)
FedMinds: Privacy-Preserving Personalized Brain Visual Decoding
di: Bao, Guangyin, et al.
Pubblicazione: (2024)
di: Bao, Guangyin, et al.
Pubblicazione: (2024)
DE$^3$-BERT: Distance-Enhanced Early Exiting for BERT based on Prototypical Networks
di: He, Jianing, et al.
Pubblicazione: (2024)
di: He, Jianing, et al.
Pubblicazione: (2024)
SAT Requires Exhaustive Search
di: Xu, Ke, et al.
Pubblicazione: (2023)
di: Xu, Ke, et al.
Pubblicazione: (2023)
Enhanced Spatiotemporal Consistency for Image-to-LiDAR Data Pretraining
di: Xu, Xiang, et al.
Pubblicazione: (2025)
di: Xu, Xiang, et al.
Pubblicazione: (2025)
Probabilistic interval prediction method based on shape‐adaptive quantile regression
di: Lin Li, et al.
Pubblicazione: (2024)
di: Lin Li, et al.
Pubblicazione: (2024)
Transformer-Based Person Search with High-Frequency Augmentation and Multi-Wave Mixing
di: Shu, Qilin, et al.
Pubblicazione: (2025)
di: Shu, Qilin, et al.
Pubblicazione: (2025)
Perception Activator: An intuitive and portable framework for brain cognitive exploration
di: Xu, Le, et al.
Pubblicazione: (2025)
di: Xu, Le, et al.
Pubblicazione: (2025)
IER3 Facilitates Tumor Progression and Aberrant Glycolysis via Activating wnt/β‐Catenin Pathway in Oral Squamous Cell Carcinoma
di: Changwei Yin, et al.
Pubblicazione: (2025)
di: Changwei Yin, et al.
Pubblicazione: (2025)
A Boundary-Aware Non-parametric Granular-Ball Classifier Based on Minimum Description Length
di: Xian, Zeqiang, et al.
Pubblicazione: (2026)
di: Xian, Zeqiang, et al.
Pubblicazione: (2026)
MDL-GBG: A Non-parametric and Interpretable Granular-Ball Generation Method for Clustering
di: Xian, Zeqiang, et al.
Pubblicazione: (2026)
di: Xian, Zeqiang, et al.
Pubblicazione: (2026)
COSEE: Consistency-Oriented Signal-Based Early Exiting via Calibrated Sample Weighting Mechanism
di: He, Jianing, et al.
Pubblicazione: (2024)
di: He, Jianing, et al.
Pubblicazione: (2024)
BabyVLM: Data-Efficient Pretraining of VLMs Inspired by Infant Learning
di: Wang, Shengao, et al.
Pubblicazione: (2025)
di: Wang, Shengao, et al.
Pubblicazione: (2025)
Adaptive Text Watermark for Large Language Models
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
UniVer: A Unified Perspective for Multi-step and Multi-draft Speculative Decoding
di: Weng, Yepeng, et al.
Pubblicazione: (2026)
di: Weng, Yepeng, et al.
Pubblicazione: (2026)
Further Explanations on "SAT Requires Exhaustive Search"
di: Dong, Qingxiu, et al.
Pubblicazione: (2024)
di: Dong, Qingxiu, et al.
Pubblicazione: (2024)
Image Difference Grounding with Natural Language
di: Wang, Wenxuan, et al.
Pubblicazione: (2025)
di: Wang, Wenxuan, et al.
Pubblicazione: (2025)
Rethinking the Zigzag Flattening for Image Reading
di: Zhao, Qingsong, et al.
Pubblicazione: (2022)
di: Zhao, Qingsong, et al.
Pubblicazione: (2022)
A note on the lower bounds of the first nonzero Steklov eigenvalue on compact manifolds
di: Liu, Yiwei, et al.
Pubblicazione: (2026)
di: Liu, Yiwei, et al.
Pubblicazione: (2026)
Quantum Encoding of Three-Dimensional Ligand Poses for Exhaustive Configuration Enumeration
di: Yang, Pei-Kun
Pubblicazione: (2025)
di: Yang, Pei-Kun
Pubblicazione: (2025)
Active Learning Methods for Efficient Data Utilization and Model Performance Enhancement
di: Tseng, Chiung-Yi, et al.
Pubblicazione: (2025)
di: Tseng, Chiung-Yi, et al.
Pubblicazione: (2025)
SmartLLMs Scheduler: A Framework for Cost-Effective LLMs Utilization
di: Liu, Yueyue, et al.
Pubblicazione: (2025)
di: Liu, Yueyue, et al.
Pubblicazione: (2025)
QuaDMix: Quality-Diversity Balanced Data Selection for Efficient LLM Pretraining
di: Liu, Fengze, et al.
Pubblicazione: (2025)
di: Liu, Fengze, et al.
Pubblicazione: (2025)
Mamba Retriever: Utilizing Mamba for Effective and Efficient Dense Retrieval
di: Zhang, Hanqi, et al.
Pubblicazione: (2024)
di: Zhang, Hanqi, et al.
Pubblicazione: (2024)
Data Darwinism Part II: DataEvolve -- AI can Autonomously Evolve Pretraining Data Curation
di: Mi, Tiantian, et al.
Pubblicazione: (2026)
di: Mi, Tiantian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Lite-Mind: Towards Efficient and Robust Brain Representation Network
di: Gong, Zixuan, et al.
Pubblicazione: (2023) -
Multimodal Federated Learning with Missing Modality via Prototype Mask and Contrast
di: Bao, Guangyin, et al.
Pubblicazione: (2023) -
Markovian Scale Prediction: A New Era of Visual Autoregressive Generation
di: Zhang, Yu, et al.
Pubblicazione: (2025) -
MindTuner: Cross-Subject Visual Decoding with Visual Fingerprint and Semantic Correction
di: Gong, Zixuan, et al.
Pubblicazione: (2024) -
Boosting Adversarial Transferability via Commonality-Oriented Gradient Optimization
di: Gao, Yanting, et al.
Pubblicazione: (2025)