From Perception to Punchline: Empowering VLM with the Art of In-the-wild Meme
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Xueyan, Xue, Yingyi, Jiang, Mengjie, Zhu, Qingzi, Niu, Yazhe |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Generative Multi-modal Feedback for Singing Voice Synthesis Evaluation
by: Li, Xueyan, et al.
Published: (2025)
by: Li, Xueyan, et al.
Published: (2025)
Empowering LLMs in Decision Games through Algorithmic Data Synthesis
by: Wang, Haolin, et al.
Published: (2025)
by: Wang, Haolin, et al.
Published: (2025)
PsyDI: Towards a Personalized and Progressively In-depth Chatbot for Psychological Measurements
by: Li, Xueyan, et al.
Published: (2024)
by: Li, Xueyan, et al.
Published: (2024)
OSPC: Artificial VLM Features for Hateful Meme Detection
by: Grönquist, Peter
Published: (2024)
by: Grönquist, Peter
Published: (2024)
What Makes a Meme a Meme? Identifying Memes for Memetics-Aware Dataset Creation
by: Hazman, Muzhaffar, et al.
Published: (2024)
by: Hazman, Muzhaffar, et al.
Published: (2024)
CleanS2S: Single-file Framework for Proactive Speech-to-Speech Interaction
by: Lu, Yudong, et al.
Published: (2025)
by: Lu, Yudong, et al.
Published: (2025)
PriorZero: Bridging Language Priors and World Models for Decision Making
by: Xiong, Junyu, et al.
Published: (2026)
by: Xiong, Junyu, et al.
Published: (2026)
Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective
by: Zhang, Jinouwen, et al.
Published: (2024)
by: Zhang, Jinouwen, et al.
Published: (2024)
One Model for All Tasks: Leveraging Efficient World Models in Multi-Task Planning
by: Pu, Yuan, et al.
Published: (2025)
by: Pu, Yuan, et al.
Published: (2025)
UniZero: Generalized and Efficient Planning with Scalable Latent World Models
by: Pu, Yuan, et al.
Published: (2024)
by: Pu, Yuan, et al.
Published: (2024)
Transformers for Supervised Online Continual Learning
by: Bornschein, Jorg, et al.
Published: (2024)
by: Bornschein, Jorg, et al.
Published: (2024)
MemeCLIP: Leveraging CLIP Representations for Multimodal Meme Classification
by: Shah, Siddhant Bikram, et al.
Published: (2024)
by: Shah, Siddhant Bikram, et al.
Published: (2024)
Beyond Scaling Laws: Understanding Transformer Performance with Associative Memory
by: Niu, Xueyan, et al.
Published: (2024)
by: Niu, Xueyan, et al.
Published: (2024)
Evaluating Representations with Readout Model Switching
by: Li, Yazhe, et al.
Published: (2023)
by: Li, Yazhe, et al.
Published: (2023)
Denoising Autoregressive Representation Learning
by: Li, Yazhe, et al.
Published: (2024)
by: Li, Yazhe, et al.
Published: (2024)
Pretrained Reversible Generation as Unsupervised Visual Representation Learning
by: Xue, Rongkun, et al.
Published: (2024)
by: Xue, Rongkun, et al.
Published: (2024)
Practical Kernel Tests of Conditional Independence
by: Pogodin, Roman, et al.
Published: (2024)
by: Pogodin, Roman, et al.
Published: (2024)
Meta-Learning Neural Procedural Biases
by: Raymond, Christian, et al.
Published: (2024)
by: Raymond, Christian, et al.
Published: (2024)
A Consistent Lebesgue Measure for Multi-label Learning
by: Demir, Kaan, et al.
Published: (2024)
by: Demir, Kaan, et al.
Published: (2024)
From Code to Action: Hierarchical Learning of Diffusion-VLM Policies
by: Peschl, Markus, et al.
Published: (2025)
by: Peschl, Markus, et al.
Published: (2025)
EvoTSC: Evolving Feature Learning Models for Time Series Classification via Genetic Programming
by: Yang, Xuanhao, et al.
Published: (2026)
by: Yang, Xuanhao, et al.
Published: (2026)
On the Non-decoupling of Supervised Fine-tuning and Reinforcement Learning in Post-training
by: Niu, Xueyan, et al.
Published: (2026)
by: Niu, Xueyan, et al.
Published: (2026)
Large Vision-Language Models for Knowledge-Grounded Data Annotation of Memes
by: Deng, Shiling, et al.
Published: (2025)
by: Deng, Shiling, et al.
Published: (2025)
PRoLoRA: Partial Rotation Empowers More Parameter-Efficient LoRA
by: Wang, Sheng, et al.
Published: (2024)
by: Wang, Sheng, et al.
Published: (2024)
From Foresight to Forethought: VLM-In-the-Loop Policy Steering via Latent Alignment
by: Wu, Yilin, et al.
Published: (2025)
by: Wu, Yilin, et al.
Published: (2025)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
by: Wu, Zhenkai, et al.
Published: (2025)
by: Wu, Zhenkai, et al.
Published: (2025)
VLM Q-Learning: Aligning Vision-Language Models for Interactive Decision-Making
by: Grigsby, Jake, et al.
Published: (2025)
by: Grigsby, Jake, et al.
Published: (2025)
Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling
by: Wang, Fei, et al.
Published: (2026)
by: Wang, Fei, et al.
Published: (2026)
From Power to Precision: Learning Fine-grained Dexterity for Multi-fingered Robotic Hands
by: Ye, Jianglong, et al.
Published: (2025)
by: Ye, Jianglong, et al.
Published: (2025)
Meta-Learning Adaptive Loss Functions
by: Raymond, Christian, et al.
Published: (2023)
by: Raymond, Christian, et al.
Published: (2023)
Disentangling Slow and Fast Temporal Dynamics in Degradation Inference with Hierarchical Differential Models
by: Zhao, Mengjie, et al.
Published: (2025)
by: Zhao, Mengjie, et al.
Published: (2025)
On the Hardness of Conditional Independence Testing In Practice
by: He, Zheng, et al.
Published: (2025)
by: He, Zheng, et al.
Published: (2025)
RELIEF: Reinforcement Learning Empowered Graph Feature Prompt Tuning
by: Zhu, Jiapeng, et al.
Published: (2024)
by: Zhu, Jiapeng, et al.
Published: (2024)
Sharpness-aware Second-order Latent Factor Model for High-dimensional and Incomplete Data
by: Wang, Jialiang, et al.
Published: (2025)
by: Wang, Jialiang, et al.
Published: (2025)
Learning Symbolic Model-Agnostic Loss Functions via Meta-Learning
by: Raymond, Christian, et al.
Published: (2022)
by: Raymond, Christian, et al.
Published: (2022)
Memes-as-Replies: Can Models Select Humorous Manga Panel Responses?
by: Kohita, Ryosuke, et al.
Published: (2026)
by: Kohita, Ryosuke, et al.
Published: (2026)
DocVLM: Make Your VLM an Efficient Reader
by: Nacson, Mor Shpigel, et al.
Published: (2024)
by: Nacson, Mor Shpigel, et al.
Published: (2024)
CropVLM: Learning to Zoom for Fine-Grained Vision-Language Perception
by: Carvalho, Miguel, et al.
Published: (2025)
by: Carvalho, Miguel, et al.
Published: (2025)
Preference VLM: Leveraging VLMs for Scalable Preference-Based Reinforcement Learning
by: Ghosh, Udita, et al.
Published: (2025)
by: Ghosh, Udita, et al.
Published: (2025)
From Masks to Pixels and Meaning: A New Taxonomy, Benchmark, and Metrics for VLM Image Tampering
by: Shang, Xinyi, et al.
Published: (2026)
by: Shang, Xinyi, et al.
Published: (2026)
Similar Items
-
Generative Multi-modal Feedback for Singing Voice Synthesis Evaluation
by: Li, Xueyan, et al.
Published: (2025) -
Empowering LLMs in Decision Games through Algorithmic Data Synthesis
by: Wang, Haolin, et al.
Published: (2025) -
PsyDI: Towards a Personalized and Progressively In-depth Chatbot for Psychological Measurements
by: Li, Xueyan, et al.
Published: (2024) -
OSPC: Artificial VLM Features for Hateful Meme Detection
by: Grönquist, Peter
Published: (2024) -
What Makes a Meme a Meme? Identifying Memes for Memetics-Aware Dataset Creation
by: Hazman, Muzhaffar, et al.
Published: (2024)