AdaBoosting Text Prompts for Vision-Language Models
cs.LG
Submitted: 2026-07-01
Updated: 2026-09-02
Project page: https://sung0503.github.io/TPB
Terminology
Sources
- PaLI: A Jointly-Scaled Multilingual Language-Image Model
- Meta CLIP 2: A Worldwide Scaling Recipe
- Data Filtering Networks
- Decoupled Weight Decay Regularization
- Fine-Grained Visual Classification of Aircraft
- Visual Classification via Description from Large Language Models
- An Emulator for Fine-Tuning Large Language Models using Small Language Models
- Transferable Model-agnostic Vision-Language Model Adaptation for Efficient Weak-to-Strong Generalization
- UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild
- EVA-CLIP: Improved Training Techniques for CLIP at Scale
- SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features
- GPT4Vis: What Can GPT-4 Do for Zero-shot Visual Recognition?
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks