Small Cues, Big Consequences: Learning Pivotal Cues for Multimodal Meme Classification
cs.MM, cs.CL, cs.LG
Submitted: 2026-09-22
Updated: 2026-09-22
Code: https://github.com/AkshitSharma1/MemePIVOT
Terminology
Sources
- Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs
- Qwen3-VL Technical Report
- Qwen2.5-VL Technical Report
- Gemma 3 Technical Report
- DisinfoMeme: A Multimodal Dataset for Detecting Meme Intentionally Spreading Out Disinformation
Related papers
- ControlFoley: Unified and Controllable Video-to-Audio Generation with Cross-Modal Conflict Handling
- Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
- Mitigating GenAI-powered Evidence Pollution for Out-of-Context Multimodal Misinformation Detection
- A Rate-Distortion-Classification Approach for Lossy Image Compression