@inproceedings{bb246400,
        AUTHOR = "Li, R. and Fischer, T. and Segu, M. and Pollefeys, M. and Van Gool, L.J. and Tombari, F.",
        TITLE = "Know Your Neighbors: Improving Single-View Reconstruction via Spatial
Vision-Language Reasoning",
        BOOKTITLE = CVPR24,
        YEAR = "2024",
        PAGES = "9848-9858",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241295"}

@inproceedings{bb246401,
        AUTHOR = "Zeng, Z. and Wang, D. and Yang, F.Y. and Park, H. and Soatto, S. and Lao, D. and Wong, A.",
        TITLE = "WorDepth: Variational Language Prior for Monocular Depth Estimation",
        BOOKTITLE = CVPR24,
        YEAR = "2024",
        PAGES = "9708-9719",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241296"}

@inproceedings{bb246402,
        AUTHOR = "Yang, C. and Xu, R. and Guo, Y. and Huang, P.X. and Chen, Y. and Ding, W. and Wang, Z.Y. and Zhou, H.",
        TITLE = "Improving Vision-and-Language Reasoning via Spatial Relations
Modeling",
        BOOKTITLE = WACV24,
        YEAR = "2024",
        PAGES = "758-767",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241297"}

@inproceedings{bb246403,
        AUTHOR = "Zhang, G.Y. and Zhang, Y.R. and Zhang, K. and Tresp, V.",
        TITLE = "Can Vision-Language Models be a Good Guesser? Exploring VLMs for
Times and Location Reasoning",
        BOOKTITLE = WACV24,
        YEAR = "2024",
        PAGES = "625-634",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241298"}

@inproceedings{bb246404,
        AUTHOR = "Ganz, R. and Nuriel, O. and Aberdam, A. and Kittenplon, Y. and Mazor, S. and Litman, R.",
        TITLE = "Towards Models that Can See and Read",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "21661-21671",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241299"}

@inproceedings{bb246405,
        AUTHOR = "Zhang, H. and Liu, D. and Lv, Z. and Su, B. and Tao, D.C.",
        TITLE = "Exploring Temporal Concurrency for Video-Language Representation
Learning",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15522-15532",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241300"}

@inproceedings{bb246406,
        AUTHOR = "Shukor, M. and Dancette, C. and Cord, M.",
        TITLE = "eP-ALM: Efficient Perceptual Augmentation of Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "21999-22012",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241301"}

@inproceedings{bb246407,
        AUTHOR = "Schulter, S. and Kumar, B.G.V. and Suh, Y.M. and Dafnis, K.M. and Zhang, Z.X. and Zhao, S.Y. and Metaxas, D.N.",
        TITLE = "OmniLabel: A Challenging Benchmark for Language-Based Object
Detection",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "11919-11928",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241302"}

@inproceedings{bb246408,
        AUTHOR = "Chen, Z.L. and Huang, X. and Guan, Q.L. and Lin, L. and Luo, W.Q.",
        TITLE = "A Retrospect to Multi-prompt Learning across Vision and Language",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "22133-22144",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241303"}

@inproceedings{bb246409,
        AUTHOR = "Derakhshani, M.M. and Sanchez, E. and Bulat, A. and da Costa, V.G.T. and Snoek, C.G.M. and Tzimiropoulos, G. and Martinez, B.",
        TITLE = "Bayesian Prompt Learning for Image-Language Model Generalization",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15191-15200",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241304"}

@inproceedings{bb246410,
        AUTHOR = "Cascante Bonilla, P. and Shehada, K. and Smith, J.S. and Doveh, S. and Kim, D.H. and Panda, R. and Varol, G. and Oliva, A. and Ordonez, V. and Feris, R.S. and Karlinsky, L.",
        TITLE = "Going Beyond Nouns With Vision & Language Models Using Synthetic
Data",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "20098-20108",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241305"}

@inproceedings{bb246411,
        AUTHOR = "Bitton Guetta, N. and Bitton, Y. and Hessel, J. and Schmidt, L. and Elovici, Y. and Stanovsky, G. and Schwartz, R.",
        TITLE = "Breaking Common Sense: WHOOPS! A Vision-and-Language Benchmark of
Synthetic and Compositional Images",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2616-2627",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241306"}

@inproceedings{bb246412,
        AUTHOR = "Slyman, E. and Kahng, M. and Lee, S.",
        TITLE = "VLSlice: Interactive Vision-and-Language Slice Discovery",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15245-15255",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241307"}

@inproceedings{bb246413,
        AUTHOR = "Najibi, M. and Ji, J.W. and Zhou, Y. and Qi, C.R. and Yan, X.C. and Ettinger, S. and Anguelov, D.",
        TITLE = "Unsupervised 3D Perception with 2D Vision-Language Distillation for
Autonomous Driving",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "8568-8578",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241308"}

@inproceedings{bb246414,
        AUTHOR = "Xu, H. and Xie, S. and Huang, P.Y. and Yu, L.C. and Howes, R. and Ghosh, G. and Zettlemoyer, L. and Feichtenhofer, C.",
        TITLE = "CiT: Curation in Training for Effective Vision-Language Data",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15134-15143",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241309"}

@inproceedings{bb246415,
        AUTHOR = "Trager, M. and Perera, P. and Zancato, L. and Achille, A. and Bhatia, P. and Soatto, S.",
        TITLE = "Linear Spaces of Meanings: Compositional Structures in
Vision-Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15349-15358",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241310"}

@inproceedings{bb246416,
        AUTHOR = "Chen, Y.S. and Song, Y.Z. and Yeo, C.Y. and Liu, B. and Fu, J.L. and Shuai, H.H.",
        TITLE = "SINC: Self-Supervised In-Context Learning for Vision-Language Tasks",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "15384-15396",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241311"}

@inproceedings{bb246417,
        AUTHOR = "Zhai, J.T. and Zhang, Q. and Wu, T. and Chen, X.Y. and Liu, J.J. and Cheng, M.M.",
        TITLE = "SLAN: Self-Locator Aided Network for Vision-Language Understanding",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "21892-21901",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241312"}

@inproceedings{bb246418,
        AUTHOR = "Long, S. and Zhao, Z. and Yuan, J. and Tan, Z.C. and Liu, J.J. and Zhou, L.P. and Wang, S.S. and Wang, J.D.",
        TITLE = "Task-Oriented Multi-Modal Mutual Learning for Vision-Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "21902-21912",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241313"}

@inproceedings{bb246419,
        AUTHOR = "Zhu, H.G. and Wei, Y.C. and Liang, X.D. and Zhang, C.J. and Zhao, Y.",
        TITLE = "CTP: Towards Vision-Language Continual Pretraining via Compatible
Momentum Contrast and Topology Preservation",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "22200-22210",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241314"}

@inproceedings{bb246420,
        AUTHOR = "Hall, M. and Gustafson, L. and Adcock, A. and Misra, I. and Ross, C.",
        TITLE = "Vision-Language Models Performing Zero-Shot Tasks Exhibit Disparities
Between Gender Groups",
        BOOKTITLE = CLVL23,
        YEAR = "2023",
        PAGES = "2770-2777",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241315"}

@inproceedings{bb246421,
        AUTHOR = "Agnolucci, L. and Baldrati, A. and Todino, F. and Becattini, F. and Bertini, M. and del Bimbo, A.",
        TITLE = "ECO: Ensembling Context Optimization for Vision-Language Models",
        BOOKTITLE = CLVL23,
        YEAR = "2023",
        PAGES = "2803-2807",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241316"}

@inproceedings{bb246422,
        AUTHOR = "Palit, V. and Pandey, R. and Arora, A. and Liang, P.P.",
        TITLE = "Towards Vision-Language Mechanistic Interpretability: A Causal
Tracing Tool for BLIP",
        BOOKTITLE = CLVL23,
        YEAR = "2023",
        PAGES = "2848-2853",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241317"}

@inproceedings{bb246423,
        AUTHOR = "Sammani, F. and Deligiannis, N.",
        TITLE = "Uni-NLX: Unifying Textual Explanations for Vision and Vision-Language
Tasks",
        BOOKTITLE = VLAR23,
        YEAR = "2023",
        PAGES = "4636-4641",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241318"}

@inproceedings{bb246424,
        AUTHOR = "Lee, D.J. and Song, S. and Suh, J. and Choi, J. and Lee, S. and Kim, H.W.J.",
        TITLE = "Read-only Prompt Optimization for Vision-Language Few-shot Learning",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "1401-1411",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241319"}

@inproceedings{bb246425,
        AUTHOR = "Li, X. and Fang, Y.H. and Liu, M.H. and Ling, Z. and Tu, Z.W. and Su, H.",
        TITLE = "Distilling Large Vision-Language Model with Out-of-Distribution
Generalizability",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2492-2503",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241320"}

@inproceedings{bb246426,
        AUTHOR = "Bi, J.Y. and Cheng, D. and Yao, P. and Pang, B. and Zhan, Y.F. and Yang, C.G. and Wang, Y.J. and Sun, H. and Deng, W.W. and Zhang, Q.",
        TITLE = "VL-Match: Enhancing Vision-Language Pretraining with Token-Level and
Instance-Level Matching",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2584-2593",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241321"}

@inproceedings{bb246427,
        AUTHOR = "Udandarao, V. and Gupta, A. and Albanie, S.",
        TITLE = "SuS-X: Training-Free Name-Only Transfer of Vision-Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2725-2736",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241322"}

@inproceedings{bb246428,
        AUTHOR = "Jiang, C.Y. and Xu, H.Y. and Ye, W. and Ye, Q.H. and Li, C.L. and Yan, M. and Bi, B. and Zhang, S.K. and Huang, F. and Huang, S.F.",
        TITLE = "BUS: Efficient and Effective Vision-language Pre-training with
Bottom-Up Patch Summarization",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2888-2898",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241323"}

@inproceedings{bb246429,
        AUTHOR = "Shi, C. and Yang, S.",
        TITLE = "LoGoPrompt: Synthetic Text Images Can Be Good Visual Prompts for
Vision-Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2920-2929",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241324"}

@inproceedings{bb246430,
        AUTHOR = "Wang, A.J.P. and Lin, K.Q.H. and Zhang, D.J.H. and Lei, S.W.X. and Shou, M.Z.",
        TITLE = "Too Large; Data Reduction for Vision-Language Pre-Training",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "3124-3134",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241325"}

@inproceedings{bb246431,
        AUTHOR = "Wang, W.H. and Yang, Z. and Xu, B. and Li, J.Z. and Sun, Y.K.",
        TITLE = "ViLTA: Enhancing Vision-Language Pre-training through Textual
Augmentation",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "3135-3146",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241326"}

@inproceedings{bb246432,
        AUTHOR = "Boecking, B. and Usuyama, N. and Bannur, S. and Castro, D.C. and Schwaighofer, A. and Hyland, S. and Wetscherek, M. and Naumann, T. and Nori, A. and Alvarez Valle, J. and Poon, H. and Oktay, O.",
        TITLE = "Making the Most of Text Semantics to Improve Biomedical Vision-Language
Processing",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XXXVI:1-21",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241327"}

@inproceedings{bb246433,
        AUTHOR = "Cui, Q. and Zhou, B. and Guo, Y. and Yin, W.D. and Wu, H. and Yoshie, O. and Chen, Y.",
        TITLE = "Contrastive Vision-Language Pre-training with Limited Resources",
        BOOKTITLE = ECCV22,
        YEAR = "2022",
        PAGES = "XXXVI:236-253",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241328"}

@inproceedings{bb246434,
        AUTHOR = "Hu, X.W. and Gan, Z. and Wang, J.F. and Yang, Z.Y. and Liu, Z.C. and Lu, Y. and Wang, L.J.",
        TITLE = "Scaling Up Vision-Language Pretraining for Image Captioning",
        BOOKTITLE = CVPR22,
        YEAR = "2022",
        PAGES = "17959-17968",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241329"}

@inproceedings{bb246435,
        AUTHOR = "Zhang, P.C. and Li, X.J. and Hu, X.W. and Yang, J.W. and Zhang, L. and Wang, L.J. and Choi, Y.J. and Gao, J.F.",
        TITLE = "VinVL: Revisiting Visual Representations in Vision-Language Models",
        BOOKTITLE = CVPR21,
        YEAR = "2021",
        PAGES = "5575-5584",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241330"}

@inproceedings{bb246436,
        AUTHOR = "Li, Z.W. and Stengel Eskin, E. and Zhang, Y.X. and Xie, C. and Tran, Q. and van Durme, B. and Yuille, A.L.",
        TITLE = "Calibrating Concepts and Operations:
Towards Symbolic Reasoning on Real Images",
        BOOKTITLE = ICCV21,
        YEAR = "2021",
        PAGES = "14890-14899",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241331"}

@inproceedings{bb246437,
        AUTHOR = "Yang, X. and Zhang, H.W. and Qi, G.J. and Cai, J.F.",
        TITLE = "Causal Attention for Vision-Language Tasks",
        BOOKTITLE = CVPR21,
        YEAR = "2021",
        PAGES = "9842-9852",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241332"}

@inproceedings{bb246438,
        AUTHOR = "Zheng, W.B. and Yan, L. and Gou, C. and Wang, F.Y.",
        TITLE = "Webly Supervised Knowledge Embedding Model for Visual Reasoning",
        BOOKTITLE = CVPR20,
        YEAR = "2020",
        PAGES = "12442-12451",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241333"}

@inproceedings{bb246439,
        AUTHOR = "Nguyen, D.K. and Okatani, T.",
        TITLE = "Multi-Task Learning of Hierarchical Vision-Language Representation",
        BOOKTITLE = CVPR19,
        YEAR = "2019",
        PAGES = "10484-10493",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241334"}

@inproceedings{bb246440,
        AUTHOR = "Gupta, T. and Shih, K.J. and Singh, S. and Hoiem, D.",
        TITLE = "Aligned Image-Word Representations Improve Inductive Transfer Across
Vision-Language Tasks",
        BOOKTITLE = ICCV17,
        YEAR = "2017",
        PAGES = "4223-4232",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vlm3.html#TT241335"}

@article{bb246441,
        AUTHOR = "Ming, Y.F. and Li, Y.X.",
        TITLE = "How Does Fine-Tuning Impact Out-of-Distribution Detection for
Vision-Language Models?",
        JOURNAL = IJCV,
        VOLUME = "132",
        YEAR = "2024",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "596-609",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241336"}

@article{bb246442,
        AUTHOR = "Zhao, C.R. and Wang, Y. and Jiang, X.Y. and Shen, Y.F. and Song, K. and Li, D.S. and Miao, D.Q.",
        TITLE = "Learning Domain Invariant Prompt for Vision-Language Models",
        JOURNAL = IP,
        VOLUME = "33",
        YEAR = "2024",
        PAGES = "1348-1360",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241337"}

@article{bb246443,
        AUTHOR = "Zhan, C.L. and Zhang, Y.F. and Lin, Y. and Wang, G.A. and Wang, H.W.",
        TITLE = "UniDCP: Unifying Multiple Medical Vision-Language Tasks via Dynamic
Cross-Modal Learnable Prompts",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "9736-9748",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241338"}

@article{bb246444,
        AUTHOR = "Dong, M.P. and Li, F. and Li, Z.B. and Liu, X.",
        TITLE = "Cluster prototype earth mover's distance adapters and
alignment-guided prompt learning for vision-language models",
        JOURNAL = PR,
        VOLUME = "156",
        YEAR = "2024",
        PAGES = "110861",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241339"}

@article{bb246445,
        AUTHOR = "Xuan, S.Y. and Yang, M. and Zhang, S.L.",
        TITLE = "Adapting Vision-Language Models via Learning to Inject Knowledge",
        JOURNAL = IP,
        VOLUME = "33",
        YEAR = "2024",
        PAGES = "5798-5809",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241340"}

@article{bb246446,
        AUTHOR = "Zhou, W. and Zhou, Z.H.",
        TITLE = "Unsupervised Domain Adaption Harnessing Vision-Language Pre-Training",
        JOURNAL = CirSysVideo,
        VOLUME = "34",
        YEAR = "2024",
        NUMBER = "9",
        MONTH = "September",
        PAGES = "8201-8214",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241341"}

@article{bb246447,
        AUTHOR = "Guo, M.H. and Zhang, Y. and Mu, T.J. and Huang, S.X. and Hu, S.M.",
        TITLE = "Tuning Vision-Language Models With Multiple Prototypes Clustering",
        JOURNAL = PAMI,
        VOLUME = "46",
        YEAR = "2024",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "11186-11199",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241342"}

@article{bb246448,
        AUTHOR = "Jiang, H.J. and Zhang, J.K. and Huang, R. and Ge, C.J. and Ni, Z. and Song, S. and Huang, G.",
        TITLE = "Cross-modal adapter for vision-language retrieval",
        JOURNAL = PR,
        VOLUME = "159",
        YEAR = "2025",
        PAGES = "111144",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241343"}

@article{bb246449,
        AUTHOR = "Yang, L.F. and Li, X. and Wang, Y.Z. and Wang, X.L. and Yang, J.",
        TITLE = "Fine-Grained Visual Text Prompting",
        JOURNAL = PAMI,
        VOLUME = "47",
        YEAR = "2025",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "1594-1609",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241344"}

@article{bb246450,
        AUTHOR = "Wang, F. and Han, Z.Y. and Liu, X. and Yin, Y.L. and Gao, X.",
        TITLE = "CTPT: Continual Test-time Prompt Tuning for vision-language models",
        JOURNAL = PR,
        VOLUME = "161",
        YEAR = "2025",
        PAGES = "111300",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241345"}

@article{bb246451,
        AUTHOR = "Liang, N. and Liu, Y.",
        TITLE = "DPO: Discrete Prompt Optimization for Vision-Language Models",
        JOURNAL = SPLetters,
        VOLUME = "32",
        YEAR = "2025",
        PAGES = "671-675",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241346"}

@article{bb246452,
        AUTHOR = "Xu, C. and Zhu, Y.H. and Shen, H.C. and Chen, B.H. and Liao, Y.X. and Chen, X.X. and Wang, L.M.",
        TITLE = "Progressive Visual Prompt Learning with Contrastive Feature
Re-formation",
        JOURNAL = IJCV,
        VOLUME = "133",
        YEAR = "2025",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "511-526",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241347"}

@article{bb246453,
        AUTHOR = "Yin, J.H. and Zhang, X.Y. and Wu, L. and Wang, X.J.",
        TITLE = "Context-aware prompt learning for test-time vision recognition with
frozen vision-language model",
        JOURNAL = PR,
        VOLUME = "162",
        YEAR = "2025",
        PAGES = "111359",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241348"}

@article{bb246454,
        AUTHOR = "Lu, Z. and Bai, J. and Li, X. and Xiao, Z. and Wang, X.C.",
        TITLE = "Task-to-Instance Prompt Learning for Vision-Language Models at Test
Time",
        JOURNAL = IP,
        VOLUME = "34",
        YEAR = "2025",
        PAGES = "1908-1920",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241349"}

@article{bb246455,
        AUTHOR = "Yao, H.T. and Zhang, R. and Lyu, H.H. and Zhang, Y.D. and Xu, C.S.",
        TITLE = "Bi-Modality Individual-Aware Prompt Tuning for Visual-Language Model",
        JOURNAL = PAMI,
        VOLUME = "47",
        YEAR = "2025",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "6352-6368",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241350"}

@inproceedings{bb246456,
        AUTHOR = "Yao, H.T. and Zhang, R. and Xu, C.S.",
        TITLE = "TCP: Textual-Based Class-Aware Prompt Tuning for Visual-Language
Model",
        BOOKTITLE = CVPR24,
        YEAR = "2024",
        PAGES = "23438-23448",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241351"}

@article{bb246457,
        AUTHOR = "Hao, Z.W. and Guo, J.Y. and Shen, L. and Luo, Y. and Hu, H. and Wen, Y.G.",
        TITLE = "ADEM-VL: Adaptive and Embedded Fusion for Efficient Vision-Language
Tuning",
        JOURNAL = IJCV,
        VOLUME = "133",
        YEAR = "2025",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "5527-5543",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241352"}

@article{bb246458,
        AUTHOR = "Gao, Y.S. and Zhu, Z.X. and Wang, S.S.",
        TITLE = "Mixture of coarse and fine-grained prompt tuning for vision-language
model",
        JOURNAL = PR,
        VOLUME = "170",
        YEAR = "2026",
        PAGES = "112074",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241353"}

@article{bb246459,
        AUTHOR = "Hao, F.S. and Liu, L. and Wu, F.X. and Zhang, Q.S. and Cheng, J.",
        TITLE = "Textual Embeddings are Good Class-Aware Visual Prompts for Adapting
Vision-Language Models",
        JOURNAL = SPLetters,
        VOLUME = "32",
        YEAR = "2025",
        PAGES = "2992-2996",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241354"}

@article{bb246460,
        AUTHOR = "Liu, J. and Lu, Z.Q. and Luo, H. and Lu, Z.M. and Zheng, Y.M.",
        TITLE = "Progressive Multi-Prompt Learning for Vision-Language Models",
        JOURNAL = CirSysVideo,
        VOLUME = "35",
        YEAR = "2025",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "9562-9574",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241355"}

@article{bb246461,
        AUTHOR = "Zhang, E. and Zhu, B. and Chen, Y.Y. and Miao, Q.H. and Tang, M. and Wang, J.Q.",
        TITLE = "Optimization of Prompt Learning via Multi-Knowledge Representation
for Vision-Language Models",
        JOURNAL = MultMed,
        VOLUME = "27",
        YEAR = "2025",
        PAGES = "7557-7569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241356"}

@article{bb246462,
        AUTHOR = "Li, J.C. and Gao, M. and Tang, S.L. and Wei, L.H. and Xiao, J. and Wu, F. and Hong, R.C. and Wang, M. and Tian, Q.",
        TITLE = "Structure-Induced Gradient Regulation for Generalizable
Vision-Language Models",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "1",
        MONTH = "January",
        PAGES = "219-235",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241357"}

@inproceedings{bb246463,
        AUTHOR = "Li, J.C. and Gao, M. and Wei, L.H. and Tang, S.L. and Zhang, W.Q. and Li, M.Z. and Ji, W. and Tian, Q. and Chua, T.S. and Zhuang, Y.T.",
        TITLE = "Gradient-Regulated Meta-Prompt Learning for Generalizable
Vision-Language Models",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2551-2562",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241358"}

@article{bb246464,
        AUTHOR = "Su, Y.L. and Liu, X.L. and Huang, Z. and Zhao, Y.W. and Hong, R.C. and Wang, M.",
        TITLE = "AttriPrompt: Class Attribute-Aware Prompt Tuning for Vision-Language
Model",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "1395-1407",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241359"}

@article{bb246465,
        AUTHOR = "Chen, Y. and Fu, S. and Zhang, Y.",
        TITLE = "MoPD: Mixture-of-Prompts Distillation for Vision-Language Models",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "1943-1954",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241360"}

@article{bb246466,
        AUTHOR = "Liu, X. and Lan, N. and Wei, M.J. and Xie, X.M. and Shi, G.M.",
        TITLE = "SceneReasoner: Sufficient Embodied Scene Understanding From Limited
Perception by Explicit Functional Association",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "5",
        MONTH = "May",
        PAGES = "6456-6471",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241361"}

@article{bb246467,
        AUTHOR = "Zhao, X.Y. and Li, X.T. and Duan, H.D. and Huang, H. and Li, Y. and Chen, K. and Yang, H.",
        TITLE = "MG-LLaVA: Toward Multi-Granularity Visual Instruction Tuning",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "4",
        MONTH = "April",
        PAGES = "4464-4478",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241362"}

@article{bb246468,
        AUTHOR = "Zhang, J.M. and Wang, X. and Ma, X.J. and Qiu, L.Y. and Jiang, Y.G. and Sang, J.",
        TITLE = "NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust
Vision-Language Models",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "6615-6627",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241363"}

@inproceedings{bb246469,
        AUTHOR = "Wang, X. and Chen, K. and Zhang, J.M. and Chen, J.J. and Ma, X.J.",
        TITLE = "TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in
Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "19910-19920",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241364"}

@article{bb246470,
        AUTHOR = "Wang, G.Q. and Zhao, P. and Wang, X. and Guo, H.R. and Qi, N. and Yang, S. and Guo, Q.H.",
        TITLE = "DHPT: Dual-Modality Heterogeneous Prompt Tuning for Online Test-Time
Adaption in Vision-Language Models",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "8590-8601",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241365"}

@article{bb246471,
        AUTHOR = "Wang, X.X. and Liu, M. and Jiang, B. and Tang, J. and Luo, B.",
        TITLE = "BHGraphAdapter: Parameter-Efficient VLMs Tuning Meets Hyper-Graph
Learning",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "9057-9071",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241366"}

@article{bb246472,
        AUTHOR = "Chung, S.Y. and Yu, Y.J. and Kim, S. and Chee, Y. and Ro, Y.M.",
        TITLE = "Enhanced Vision-Language Models for Diverse Sensor Understanding:
Cost-Efficient Optimization and Benchmarking",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "7444-7459",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241367"}

@article{bb246473,
        AUTHOR = "Zhao, R.F. and Zhou, L. and Shang, Z. and Liu, Y.W. and Zhang, Y. and Li, S. and Ning, J. and Ning, X.",
        TITLE = "ProMML for robust few-shot adaptation of vision-language models",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114160",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241368"}

@article{bb246474,
        AUTHOR = "Dong, C. and Zhang, T. and Zhang, F. and Hua, Q. and Zhu, J. and Zhang, Y.",
        TITLE = "Hierarchical intra-inter modal adaptation for vision-language models",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114200",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241369"}

@article{bb246475,
        AUTHOR = "Dong, H. and Sheng, L.J. and Liang, J. and He, R. and Chatzi, E. and Fink, O.",
        TITLE = "Adapting Vision-Language Models Without Labels: A Comprehensive Survey",
        JOURNAL = IJCV,
        VOLUME = "134",
        YEAR = "2026",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "389",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241370"}

@article{bb246476,
        AUTHOR = "Chen, Z. and Wang, W.Y. and Zhu, J.G. and Wang, W.H. and Liu, Y.Z. and Liu, Z.Y. and Luo, G. and Sun, P. and Su, W.J. and Tian, H. and Lu, L.W. and Zhu, X. and Lu, T. and Lin, D. and Qiao, Y. and Dai, J.F.",
        TITLE = "Revisiting InternVL: A Systematic Technical Framework for Building
Powerful Open-Source Vision-Language Models",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "12582-12600",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241371"}

@inproceedings{bb246477,
        AUTHOR = "Ali, E. and Silva, S. and Arora, C. and Khan, M.H.",
        TITLE = "Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment
Score",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "5875-5885",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241372"}

@inproceedings{bb246478,
        AUTHOR = "Mishra, U. and Shukla, V. and Hambarde, P. and Shukla, A.",
        TITLE = "Improvise, Adapt, Overcome: Telescopic Adapters for Efficient
Fine-tuning of Vision Language Models in Medical Imaging",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "7605-7615",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241373"}

@inproceedings{bb246479,
        AUTHOR = "Lin, X. and Li, W.X. and Guo, S. and Wang, L.H. and Huang, D.",
        TITLE = "GIP: Gated Interaction Prompt for Parameter Efficient Vision-Language
Fine-Tuning",
        BOOKTITLE = ICIP25,
        YEAR = "2025",
        PAGES = "617-622",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241374"}

@inproceedings{bb246480,
        AUTHOR = "Valois, P.H.V. and Satav, D. and de Campos, R.A.P. and Pratamasunu, G.Q.O. and Fukui, K.",
        TITLE = "Vision Language Model Interpretability with Concept Guided Decoding",
        BOOKTITLE = ICIP25,
        YEAR = "2025",
        PAGES = "397-402",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241375"}

@inproceedings{bb246481,
        AUTHOR = "Hao, F.S. and He, F.X. and Wu, F. and Wang, T. and Song, C.Q. and Cheng, J.",
        TITLE = "Task-Aware Clustering for Prompting Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14745-14755",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241376"}

@inproceedings{bb246482,
        AUTHOR = "Koleilat, T. and Asgariandehkordi, H. and Rivaz, H. and Xiao, Y.M.",
        TITLE = "BiomedCoOp: Learning to Prompt for Biomedical Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14766-14776",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241377"}

@inproceedings{bb246483,
        AUTHOR = "Yang, C.Y. and Dong, X. and Zhu, X.Z. and Su, W.J. and Wang, J.H. and Tian, H. and Chen, Z. and Wang, W.H. and Lu, L.W. and Dai, J.F.",
        TITLE = "PVC: Progressive Visual Token Compression for Unified Image and Video
Processing in Large Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24939-24949",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241378"}

@inproceedings{bb246484,
        AUTHOR = "Bhattacharjee, S.S. and Campbell, D. and Shome, R.",
        TITLE = "Believing is Seeing: Unobserved Object Detection using Generative
Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "19366-19377",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241379"}

@inproceedings{bb246485,
        AUTHOR = "Zhou, W.J. and Tao, M. and Zhao, C.Y. and Guo, H.Y. and Dong, H.H. and Tang, M. and Wang, J.Q.",
        TITLE = "PhysVLM: Enabling Visual Language Models to Understand Robotic
Physical Reachability",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "6940-6949",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241380"}

@inproceedings{bb246486,
        AUTHOR = "Chen, T.Y. and Fu, X.C. and Gao, Y. and Qian, H.D. and Wei, Y. and Yan, K. and Zhou, H.Y. and Li, J.X.",
        TITLE = "Galaxy Walker: Geometry-aware VLMs For Galaxy-scale Understanding",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4112-4121",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241381"}

@inproceedings{bb246487,
        AUTHOR = "Poppi, T. and Kasarla, T. and Mettes, P. and Baraldi, L. and Cucchiara, R.",
        TITLE = "Hyperbolic Safety-Aware Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4222-4232",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241382"}

@inproceedings{bb246488,
        AUTHOR = "Yu, C. and Chen, T. and Gan, Z.X.",
        TITLE = "Once-Tuning-Multiple-Variants: Tuning Once and Expanded as Multiple
Vision-Language Model Variants",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14712-14722",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241383"}

@inproceedings{bb246489,
        AUTHOR = "Chen, J.H. and Yang, J.W. and Wu, H.P. and Li, D.Q. and Gao, J.F. and Zhou, T.Y. and Xiao, B.",
        TITLE = "Florence-VL: Enhancing Vision-Language Models with Generative Vision
Encoder and Depth-Breadth Fusion",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24928-24938",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241384"}

@inproceedings{bb246490,
        AUTHOR = "Zhu, B. and Cui, J. and Zhang, H.W. and Zhang, C.",
        TITLE = "Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "25487-25496",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241385"}

@inproceedings{bb246491,
        AUTHOR = "Li, H.Y. and Wang, L. and Wang, C. and Jiang, J. and Peng, Y. and Long, G.D.",
        TITLE = "DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "25623-25632",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241386"}

@inproceedings{bb246492,
        AUTHOR = "Zhang, Y. and Deng, Y.X. and Guo, M.H. and Hu, S.M.",
        TITLE = "Adaptive Parameter Selection for Tuning Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4280-4290",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241387"}

@inproceedings{bb246493,
        AUTHOR = "Deitke, M. and Clark, C. and Lee, S.H. and Tripathi, R. and Yang, Y. and Park, J.S. and Salehi, M. and Muennighoff, N. and Lo, K. and Soldaini, L. and Lu, J. and Anderson, T. and Bransom, E. and Ehsani, K. and Ngo, H. and Chen, Y. and Patel, A. and Yatskar, M. and Callison Burch, C. and Head, A. and Hendrix, R. and Bastani, F. and VanderBilt, E. and Lambert, N. and Chou, Y. and Chheda, A. and Sparks, J. and Skjonsberg, S. and Schmitz, M. and Sarnat, A. and Bischoff, B. and Walsh, P. and Newell, C. and Wolters, P. and Gupta, T. and Zeng, K.H. and Borchardt, J. and Groeneveld, D. and Nam, C. and Lebrecht, S. and Wittlif, C. and Schoenick, C. and Michel, O. and Krishna, R. and Weihs, L. and Smith, N.A. and Hajishirzi, H. and Girshick, R. and Farhadi, A. and Kembhavi, A.",
        TITLE = "Molmo and PixMo: Open Weights and Open Data for State-of-the-Art
Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "91-104",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241388"}

@inproceedings{bb246494,
        AUTHOR = "Lee, B.K. and Hachiuma, R. and Wang, Y.C.A.F. and Ro, Y.M. and Wu, Y.H.",
        TITLE = "VLsI: Verbalized Layers-to-Interactions from Large to Small Vision
Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29545-29557",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241389"}

@inproceedings{bb246495,
        AUTHOR = "Sun, J.C. and Sharma, R. and Lokhande, V.S. and Chen, C.Y.",
        TITLE = "Cross-Modal Feature Alignment and MMD Improve Robustness of Prompt
Tuning",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "4714-4724",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241390"}

@inproceedings{bb246496,
        AUTHOR = "Imam, R. and Gani, H. and Huzaifa, M. and Nandakumar, K.",
        TITLE = "Test-Time Low Rank Adaptation via Confidence Maximization for
Zero-Shot Generalization of Vision-Language Models",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "5449-5459",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241391"}

@inproceedings{bb246497,
        AUTHOR = "Talemi, N.A. and Kashiani, H. and Afghah, F.",
        TITLE = "Style-Pro: Style-Guided Prompt Learning for Generalizable
Vision-Language Models",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "6207-6216",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241392"}

@inproceedings{bb246498,
        AUTHOR = "Westfechtel, T. and Zhang, D. and Harada, T.",
        TITLE = "Combining Inherent Knowledge of Vision-Language Models with
Unsupervised Domain Adaptation Through Strong-Weak Guidance",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "6528-6537",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241393"}

@inproceedings{bb246499,
        AUTHOR = "Ali, E. and Silva, S. and Khan, M.H.",
        TITLE = "DPA: Dual Prototypes Alignment for Unsupervised Adaptation of
Vision-Language Models",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "6083-6093",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241394"}

Last update:Sep 21, 2026 at 18:29:27