@article{bb244200,
        AUTHOR = "dos S Silva, F.H. and Bezerra, G.M. and Holanda, G.B. and de Souza, J.W.M. and Rego, P.A.L. and Lira Neto, A.V. and de Albuquerque, V.H.C. and Reboucas Filho, P.P.",
        TITLE = "A novel feature extractor for human action recognition in visual
question answering",
        JOURNAL = PRL,
        VOLUME = "147",
        YEAR = "2021",
        PAGES = "41-47",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239106"}

@article{bb244201,
        AUTHOR = "Guo, W. and Zhang, Y. and Yang, J.F. and Yuan, X.J.",
        TITLE = "Re-Attention for Visual Question Answering",
        JOURNAL = IP,
        VOLUME = "30",
        YEAR = "2021",
        PAGES = "6730-6743",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239107"}

@article{bb244202,
        AUTHOR = "Zhang, X. and Zhang, F.F. and Xu, C.S.",
        TITLE = "NExT-OOD: Overcoming Dual Multiple-Choice VQA Biases",
        JOURNAL = PAMI,
        VOLUME = "46",
        YEAR = "2024",
        NUMBER = "4",
        MONTH = "April",
        PAGES = "1913-1931",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239108"}

@article{bb244203,
        AUTHOR = "Barra, S. and Bisogni, C. and de Marsico, M. and Ricciardi, S.",
        TITLE = "Visual question answering: Which investigated applications?",
        JOURNAL = PRL,
        VOLUME = "151",
        YEAR = "2021",
        PAGES = "325-331",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239109"}

@article{bb244204,
        AUTHOR = "Manmadhan, S. and Kovoor, B.C.",
        TITLE = "Multi-Tier Attention Network using Term-weighted Question Features
for Visual Question Answering",
        JOURNAL = IVC,
        VOLUME = "115",
        YEAR = "2021",
        PAGES = "104291",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239110"}

@article{bb244205,
        AUTHOR = "Liu, A.A. and Lu, Z. and Xu, N. and Nie, W.Z. and Li, W.H.",
        TITLE = "Multi-type decision fusion network for visual Q&A",
        JOURNAL = IVC,
        VOLUME = "115",
        YEAR = "2021",
        PAGES = "104281",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239111"}

@article{bb244206,
        AUTHOR = "Patro, B.N. and Kurmi, V.K. and Kumar, S. and Namboodiri, V.P.",
        TITLE = "MUMC: Minimizing uncertainty of mixture of cues",
        JOURNAL = IVC,
        VOLUME = "115",
        YEAR = "2021",
        PAGES = "104280",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239112"}

@article{bb244207,
        AUTHOR = "Narayanan, A. and Rao, A. and Prasad, A. and Natarajan, S.",
        TITLE = "VQA as a factoid question answering problem: A novel approach for
knowledge-aware and explainable visual question answering",
        JOURNAL = IVC,
        VOLUME = "116",
        YEAR = "2021",
        PAGES = "104328",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239113"}

@article{bb244208,
        AUTHOR = "Guo, Y.Y. and Nie, L.Q. and Cheng, Z.Y. and Tian, Q. and Zhang, M.",
        TITLE = "Loss Re-Scaling VQA: Revisiting the Language Prior Problem From a
Class-Imbalance View",
        JOURNAL = IP,
        VOLUME = "31",
        YEAR = "2022",
        PAGES = "227-238",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239114"}

@article{bb244209,
        AUTHOR = "Manogaran, G. and Shakeel, P.M. and Burhanuddin, M.A. and Baskar, S. and Saravanan, V. and Crespo, R.G. and Martinez, O.S.",
        TITLE = "ADCCF: Adaptive deep concatenation coder framework for visual
question answering",
        JOURNAL = PRL,
        VOLUME = "152",
        YEAR = "2021",
        PAGES = "348-355",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239115"}

@article{bb244210,
        AUTHOR = "Zhou, Y.Y. and Ji, R.R. and Sun, X.S. and Su, J.S. and Meng, D.Y. and Gao, Y. and Shen, C.H.",
        TITLE = "Plenty is Plague: Fine-Grained Learning for Visual Question Answering",
        JOURNAL = PAMI,
        VOLUME = "44",
        YEAR = "2022",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "697-709",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239116"}

@article{bb244211,
        AUTHOR = "E, W.N. and Zhou, Y.J.",
        TITLE = "A Mathematical Model for Universal Semantics",
        JOURNAL = PAMI,
        VOLUME = "44",
        YEAR = "2022",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "1124-1132",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239117"}

@article{bb244212,
        AUTHOR = "Li, X.P. and Wu, B. and Song, J.K. and Gao, L.L. and Zeng, P.P. and Gan, C.",
        TITLE = "Text-instance graph: Exploring the relational semantics for
text-based visual question answering",
        JOURNAL = PR,
        VOLUME = "124",
        YEAR = "2022",
        PAGES = "108455",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239118"}

@article{bb244213,
        AUTHOR = "Shao, X.J. and Xiang, Z.L. and Li, Y.X.",
        TITLE = "Visual question answering with gated relation-aware auxiliary",
        JOURNAL = IET-IPR,
        VOLUME = "16",
        YEAR = "2022",
        NUMBER = "5",
        PAGES = "1424-1432",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239119"}

@article{bb244214,
        AUTHOR = "Liu, Y. and Zhang, X.M. and Zhao, Z.Y. and Zhang, B. and Cheng, L. and Li, Z.J.",
        TITLE = "ALSA: Adversarial Learning of Supervised Attentions for Visual
Question Answering",
        JOURNAL = Cyber,
        VOLUME = "52",
        YEAR = "2022",
        NUMBER = "6",
        MONTH = "June",
        PAGES = "4520-4533",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239120"}

@article{bb244215,
        AUTHOR = "Ouyang, N.L. and Huang, Q.B. and Li, P.J. and Cai, Y. and Liu, B. and Leung, H.F. and Li, Q.",
        TITLE = "Suppressing Biased Samples for Robust VQA",
        JOURNAL = MultMed,
        VOLUME = "24",
        YEAR = "2022",
        PAGES = "3405-3415",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239121"}

@article{bb244216,
        AUTHOR = "Gouthaman, K.V. and Mittal, A.",
        TITLE = "On the role of question encoder sequence model in robust visual
question answering",
        JOURNAL = PR,
        VOLUME = "131",
        YEAR = "2022",
        PAGES = "108883",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239122"}

@article{bb244217,
        AUTHOR = "Chen, C.Q. and Han, D.Z. and Chang, C.C.",
        TITLE = "CAAN: Context-Aware attention network for visual question answering",
        JOURNAL = PR,
        VOLUME = "132",
        YEAR = "2022",
        PAGES = "108980",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239123"}

@article{bb244218,
        AUTHOR = "Jin, Z.X. and Wu, H. and Yang, C. and Zhou, F. and Qin, J.Y. and Xiao, L. and Yin, X.C.",
        TITLE = "RUArt: A Novel Text-Centered Solution for Text-Based Visual Question
Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "1-12",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239124"}

@article{bb244219,
        AUTHOR = "Beckham, C. and Weiss, M. and Golemo, F. and Honari, S. and Nowrouzezahrai, D. and Pal, C.",
        TITLE = "Visual question answering from another perspective: CLEVR mental
rotation tests",
        JOURNAL = PR,
        VOLUME = "136",
        YEAR = "2023",
        PAGES = "109209",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239125"}

@article{bb244220,
        AUTHOR = "Zhang, H.N. and Zeng, P.P. and Hu, Y.X. and Qian, J. and Song, J.K. and Gao, L.",
        TITLE = "Learning visual question answering on controlled semantic noisy
labels",
        JOURNAL = PR,
        VOLUME = "138",
        YEAR = "2023",
        PAGES = "109339",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239126"}

@article{bb244221,
        AUTHOR = "Zeng, G.Y. and Zhang, Y. and Zhou, Y. and Yang, X.M. and Jiang, N. and Zhao, G.Q. and Wang, W.P. and Yin, X.C.",
        TITLE = "Beyond OCR + VQA: Towards end-to-end reading and reasoning for robust
and accurate textvqa",
        JOURNAL = PR,
        VOLUME = "138",
        YEAR = "2023",
        PAGES = "109337",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239127"}

@article{bb244222,
        AUTHOR = "Gao, D.F. and Wang, R.P. and Shan, S.G. and Chen, X.L.",
        TITLE = "CRIC: A VQA Dataset for Compositional Reasoning on Vision and
Commonsense",
        JOURNAL = PAMI,
        VOLUME = "45",
        YEAR = "2023",
        NUMBER = "5",
        MONTH = "May",
        PAGES = "5561-5578",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239128"}

@article{bb244223,
        AUTHOR = "Li, P.J. and Tan, Z.Y. and Bao, B.K.",
        TITLE = "Multiview Language Bias Reduction for Visual Question Answering",
        JOURNAL = MultMedMag,
        VOLUME = "30",
        YEAR = "2023",
        NUMBER = "1",
        MONTH = "January",
        PAGES = "91-99",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239129"}

@article{bb244224,
        AUTHOR = "Li, H.M. and Han, D.Z. and Chen, C.Q. and Chang, C.C. and Li, K.C. and Li, D.",
        TITLE = "A Visual Question Answering Network Merging High- and Low-Level
Semantic Information",
        JOURNAL = IEICE,
        VOLUME = "E106-D",
        YEAR = "2023",
        NUMBER = "5",
        MONTH = "May",
        PAGES = "581-589",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239130"}

@article{bb244225,
        AUTHOR = "Liu, B. and Zhan, L.M. and Xu, L. and Wu, X.M.",
        TITLE = "Medical Visual Question Answering via Conditional Reasoning and
Contrastive Learning",
        JOURNAL = MedImg,
        VOLUME = "42",
        YEAR = "2023",
        NUMBER = "5",
        MONTH = "May",
        PAGES = "1532-1545",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239131"}

@article{bb244226,
        AUTHOR = "Wu, J.M. and Ge, F. and Hong, H.Y. and Shi, Y. and Hao, Y.B. and Ma, L.",
        TITLE = "Question-aware dynamic scene graph of local semantic representation
learning for visual question answering",
        JOURNAL = PRL,
        VOLUME = "170",
        YEAR = "2023",
        PAGES = "93-99",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239132"}

@article{bb244227,
        AUTHOR = "Li, H. and Huang, J. and Jin, P. and Song, G. and Wu, Q. and Chen, J.",
        TITLE = "Weakly-Supervised 3D Spatial Reasoning for Text-Based Visual Question
Answering",
        JOURNAL = IP,
        VOLUME = "32",
        YEAR = "2023",
        PAGES = "3367-3382",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239133"}

@article{bb244228,
        AUTHOR = "Li, Z.Y. and Guo, Y.Y. and Wang, K. and Wei, Y.W. and Nie, L.Q. and Kankanhalli, M.",
        TITLE = "Joint Answering and Explanation for Visual Commonsense Reasoning",
        JOURNAL = IP,
        VOLUME = "32",
        YEAR = "2023",
        PAGES = "3836-3846",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239134"}

@article{bb244229,
        AUTHOR = "Yang, X.F. and Lv, F.M. and Liu, F. and Lin, G.S.",
        TITLE = "Self-Training Vision Language BERTs With a Unified Conditional Model",
        JOURNAL = CirSysVideo,
        VOLUME = "33",
        YEAR = "2023",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "3560-3569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239135"}

@article{bb244230,
        AUTHOR = "Chen, L. and Zheng, Y.H. and Niu, Y. and Zhang, H.W. and Xiao, J.",
        TITLE = "Counterfactual Samples Synthesizing and Training for Robust Visual
Question Answering",
        JOURNAL = PAMI,
        VOLUME = "45",
        YEAR = "2023",
        NUMBER = "11",
        MONTH = "November",
        PAGES = "13218-13234",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239136"}

@inproceedings{bb244231,
        AUTHOR = "Chen, L. and Yan, X. and Xiao, J. and Zhang, H.W. and Pu, S. and Zhuang, Y.",
        TITLE = "Counterfactual Samples Synthesizing for Robust Visual Question
Answering",
        BOOKTITLE = CVPR20,
        YEAR = "2020",
        PAGES = "10797-10806",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239137"}

@article{bb244232,
        AUTHOR = "Wang, B.Y. and Ma, Y.J. and Li, X.Y. and Liu, H. and Hu, Y.L. and Yin, B.C.",
        TITLE = "DSGEM: Dual scene graph enhancement module-based visual question
answering",
        JOURNAL = IET-CV,
        VOLUME = "17",
        YEAR = "2023",
        NUMBER = "6",
        PAGES = "638-651",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239138"}

@article{bb244233,
        AUTHOR = "Bi, Y.D. and Jiang, H. and Zhang, H. and Hu, Y.L. and Yin, B.C.",
        TITLE = "Self-supervised knowledge distillation in counterfactual learning for
VQA",
        JOURNAL = PRL,
        VOLUME = "177",
        YEAR = "2024",
        PAGES = "33-39",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239139"}

@article{bb244234,
        AUTHOR = "Tan, S. and Ge, M.M. and Guo, D. and Liu, H.P. and Sun, F.C.",
        TITLE = "Knowledge-Based Embodied Question Answering",
        JOURNAL = PAMI,
        VOLUME = "45",
        YEAR = "2023",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "11948-11960",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239140"}

@inproceedings{bb244235,
        AUTHOR = "Tan, S. and Xiang, W.L. and Liu, H.P. and Guo, D. and Sun, F.C.",
        TITLE = "Multi-agent Embodied Question Answering in Interactive Environments",
        BOOKTITLE = ECCV20,
        YEAR = "2020",
        PAGES = "XIII:663-678",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239141"}

@article{bb244236,
        AUTHOR = "Wang, Y.X. and Wei, B. and Liu, J. and Zhang, L.L. and Wang, J.X. and Wang, Q.Y.",
        TITLE = "DisAVR: Disentangled Adaptive Visual Reasoning Network for Diagram
Question Answering",
        JOURNAL = IP,
        VOLUME = "32",
        YEAR = "2023",
        PAGES = "4812-4827",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239142"}

@article{bb244237,
        AUTHOR = "Han, Y.D. and Yin, J.H. and Wu, J.L. and Wei, Y.W. and Nie, L.Q.",
        TITLE = "Semantic-Aware Modular Capsule Routing for Visual Question Answering",
        JOURNAL = IP,
        VOLUME = "32",
        YEAR = "2023",
        PAGES = "5537-5549",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239143"}

@article{bb244238,
        AUTHOR = "Qian, T.W. and Chen, J.J. and Chen, S.X. and Wu, B. and Jiang, Y.G.",
        TITLE = "Scene Graph Refinement Network for Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "3950-3961",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239144"}

@article{bb244239,
        AUTHOR = "Qin, B.S. and Hu, H.J. and Zhuang, Y.T.",
        TITLE = "Deep Residual Weight-Sharing Attention Network With Low-Rank
Attention for Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "4282-4295",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239145"}

@article{bb244240,
        AUTHOR = "Zhou, S. and Guo, D. and Li, J. and Yang, X. and Wang, M.",
        TITLE = "Exploring Sparse Spatial Relation in Graph Inference for Text-Based
VQA",
        JOURNAL = IP,
        VOLUME = "32",
        YEAR = "2023",
        PAGES = "5060-5074",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239146"}

@article{bb244241,
        AUTHOR = "Liu, Y.H. and Wei, W. and Peng, D. and Mao, X.L. and He, Z.Y. and Zhou, P.",
        TITLE = "Depth-Aware and Semantic Guided Relational Attention Network for
Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "5344-5357",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239147"}

@article{bb244242,
        AUTHOR = "Mao, A. and Yang, Z. and Lin, K. and Xuan, J. and Liu, Y.J.",
        TITLE = "Positional Attention Guided Transformer-Like Architecture for Visual
Question Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "6997-7009",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239148"}

@article{bb244243,
        AUTHOR = "Sun, H. and Wang, S. and Zhu, Y.Q. and Yuan, W. and Zou, Z.Q.",
        TITLE = "Question Classification for Intelligent Question Answering:
A Comprehensive Survey",
        JOURNAL = IJGI,
        VOLUME = "12",
        YEAR = "2023",
        NUMBER = "10",
        PAGES = "415",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239149"}

@article{bb244244,
        AUTHOR = "Cao, B.W. and Cao, J.X. and Gui, J. and Shen, J.Y. and Liu, B. and He, L. and Tang, Y.Y. and Kwok, J.T.Y.",
        TITLE = "AlignVE: Visual Entailment Recognition Based on Alignment Relations",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "7378-7387",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239150"}

@article{bb244245,
        AUTHOR = "Yu, Z. and Jin, Z. and Yu, J. and Xu, M.L. and Wang, H.B. and Fan, J.P.",
        TITLE = "Bilaterally Slimmable Transformer for Elastic and Efficient Visual
Question Answering",
        JOURNAL = MultMed,
        VOLUME = "25",
        YEAR = "2023",
        PAGES = "9543-9556",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239151"}

@article{bb244246,
        AUTHOR = "Huang, X.F. and Gong, H.F.",
        TITLE = "A Dual-Attention Learning Network With Word and Sentence Embedding
for Medical Visual Question Answering",
        JOURNAL = MedImg,
        VOLUME = "43",
        YEAR = "2024",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "832-845",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239152"}

@article{bb244247,
        AUTHOR = "Song, Y.G. and Yang, X.S. and Wang, Y.W. and Xu, C.S.",
        TITLE = "Recovering Generalization via Pre-Training-Like Knowledge
Distillation for Out-of-Distribution Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "837-851",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239153"}

@article{bb244248,
        AUTHOR = "Wu, S. and Zhao, G.S. and Qian, X.M.",
        TITLE = "Resolving Zero-Shot and Fact-Based Visual Question Answering via
Enhanced Fact Retrieval",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "1790-1800",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239154"}

@article{bb244249,
        AUTHOR = "Wen, Z.Q. and Niu, S.C. and Li, G. and Wu, Q.Y. and Tan, M.K. and Wu, Q.",
        TITLE = "Test-Time Model Adaptation for Visual Question Answering With
Debiased Self-Supervisions",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "2137-2147",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239155"}

@article{bb244250,
        AUTHOR = "Huai, T.Y. and Yang, S.W. and Zhang, J.H. and Zhao, J.B. and He, L.",
        TITLE = "Debiased Visual Question Answering via the perspective of question
types",
        JOURNAL = PRL,
        VOLUME = "178",
        YEAR = "2024",
        PAGES = "181-187",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239156"}

@article{bb244251,
        AUTHOR = "Xu, N. and Lu, Z. and Tian, H.S. and Kang, R.B. and Cao, J. and Zhang, Y.D. and Liu, A.A.",
        TITLE = "Learning to Supervise Knowledge Retrieval Over a Tree Structure for
Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "6689-6700",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239157"}

@article{bb244252,
        AUTHOR = "Pan, Y.H. and Liu, J. and Jin, L. and Li, Z.C.",
        TITLE = "Unbiased Visual Question Answering by Leveraging Instrumental
Variable",
        JOURNAL = MultMed,
        VOLUME = "26",
        YEAR = "2024",
        PAGES = "6648-6662",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239158"}

@article{bb244253,
        AUTHOR = "Wang, Q. and Liu, J. and Wu, W.J.",
        TITLE = "Coordinating explicit and implicit knowledge for knowledge-based VQA",
        JOURNAL = PR,
        VOLUME = "151",
        YEAR = "2024",
        PAGES = "110368",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239159"}

@article{bb244254,
        AUTHOR = "Wei, M. and Chen, L. and Ji, W. and Yue, X.Y. and Zimmermann, R.",
        TITLE = "In Defense of Clip-Based Video Relation Detection",
        JOURNAL = IP,
        VOLUME = "33",
        YEAR = "2024",
        PAGES = "2759-2769",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239160"}

@article{bb244255,
        AUTHOR = "Ma, J. and Liu, J. and Chai, Q. and Wang, P.H. and Tao, J.",
        TITLE = "Diagram Perception Networks for Textbook Question Answering via Joint
Optimization",
        JOURNAL = IJCV,
        VOLUME = "132",
        YEAR = "2024",
        NUMBER = "5",
        MONTH = "May",
        PAGES = "1578-1591",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239161"}

@article{bb244256,
        AUTHOR = "Li, L.J. and Jin, T. and Lin, W. and Jiang, H. and Pan, W.W. and Wang, J. and Xiao, S.W. and Xia, Y. and Jiang, W.H. and Zhao, Z.",
        TITLE = "Multi-Granularity Relational Attention Network for Audio-Visual
Question Answering",
        JOURNAL = CirSysVideo,
        VOLUME = "34",
        YEAR = "2024",
        NUMBER = "8",
        MONTH = "August",
        PAGES = "7080-7094",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239162"}

@article{bb244257,
        AUTHOR = "Bi, Y.D. and Jiang, H.J. and Hu, Y.L. and Sun, Y.F. and Yin, B.C.",
        TITLE = "Fair Attention Network for Robust Visual Question Answering",
        JOURNAL = CirSysVideo,
        VOLUME = "34",
        YEAR = "2024",
        NUMBER = "9",
        MONTH = "September",
        PAGES = "7870-7881",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239163"}

@article{bb244258,
        AUTHOR = "Xue, D. and Qian, S.S. and Xu, C.S.",
        TITLE = "Integrating Neural-Symbolic Reasoning With Variational Causal
Inference Network for Explanatory Visual Question Answering",
        JOURNAL = PAMI,
        VOLUME = "46",
        YEAR = "2024",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "7893-7908",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239164"}

@inproceedings{bb244259,
        AUTHOR = "Xue, D. and Qian, S.S. and Xu, C.S.",
        TITLE = "Variational Causal Inference Network for Explanatory Visual Question
Answering",
        BOOKTITLE = ICCV23,
        YEAR = "2023",
        PAGES = "2515-2525",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239165"}

@article{bb244260,
        AUTHOR = "Xue, D. and Qian, S.S. and Fang, Q. and Xu, C.S.",
        TITLE = "LININ: Logic Integrated Neural Inference Network for Explanatory
Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "27",
        YEAR = "2025",
        PAGES = "16-27",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239166"}

@article{bb244261,
        AUTHOR = "Shen, K. and Wu, L.F. and Tang, S.L. and Xu, F.L. and Long, B. and Zhuang, Y.T. and Pei, J.",
        TITLE = "Ask Questions With Double Hints: Visual Question Generation With
Answer-Awareness and Region-Reference",
        JOURNAL = PAMI,
        VOLUME = "46",
        YEAR = "2024",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "9648-9660",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239167"}

@article{bb244262,
        AUTHOR = "Yamada, M. and d'Amario, V. and Takemoto, K. and Boix, X. and Sasaki, T.",
        TITLE = "Transformer Module Networks for Systematic Generalization in Visual
Question Answering",
        JOURNAL = PAMI,
        VOLUME = "46",
        YEAR = "2024",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "10096-10105",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239168"}

@article{bb244263,
        AUTHOR = "Liu, J. and Xie, J. and Zhou, F.Y. and He, S.F.",
        TITLE = "Question Type-Aware Debiasing for Test-Time Visual Question Answering
Model Adaptation",
        JOURNAL = CirSysVideo,
        VOLUME = "34",
        YEAR = "2024",
        NUMBER = "11",
        MONTH = "November",
        PAGES = "10805-10816",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239169"}

@article{bb244264,
        AUTHOR = "Cao, R.L. and Li, Z.X. and Tang, Z.J. and Zhang, C.L. and Ma, H.F.",
        TITLE = "Enhancing robust VQA via contrastive and self-supervised learning",
        JOURNAL = PR,
        VOLUME = "159",
        YEAR = "2025",
        PAGES = "111129",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239170"}

@article{bb244265,
        AUTHOR = "Liu, F. and Dai, W.W. and Zhang, C.Y. and Zhu, J. and Yao, L. and Li, X.",
        TITLE = "Co-LLaVA: Efficient Remote Sensing Visual Question Answering via
Model Collaboration",
        JOURNAL = RS,
        VOLUME = "17",
        YEAR = "2025",
        NUMBER = "3",
        PAGES = "466",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239171"}

@article{bb244266,
        AUTHOR = "Gao, Y.Q. and Bai, Z.W. and Zhou, M.L. and Jia, B.L. and Gao, P.Q. and Zhu, R.",
        TITLE = "Adaptive Conditional Reasoning for Remote Sensing Visual Question
Answering",
        JOURNAL = RS,
        VOLUME = "17",
        YEAR = "2025",
        NUMBER = "8",
        PAGES = "1338",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239172"}

@article{bb244267,
        AUTHOR = "Lan, N. and Ou, B.S. and Xie, X.M. and Shi, G.M.",
        TITLE = "Visual Environment-Interactive Planning for Embodied Complex-Question
Answering",
        JOURNAL = CirSysVideo,
        VOLUME = "35",
        YEAR = "2025",
        NUMBER = "7",
        MONTH = "July",
        PAGES = "6481-6493",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239173"}

@article{bb244268,
        AUTHOR = "Welde, T.M. and Liao, L.",
        TITLE = "Counting in Visual Question Answering:
Methods, Datasets, and Future Work",
        JOURNAL = IJIG,
        VOLUME = "25",
        YEAR = "2025",
        NUMBER = "5",
        MONTH = "September",
        PAGES = "2550044",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239174"}

@article{bb244269,
        AUTHOR = "Bi, C. and Wang, S.H. and Li, N. and Huang, Q.M.",
        TITLE = "Inferential and Commonsense Visual Question Generation",
        JOURNAL = MultMed,
        VOLUME = "27",
        YEAR = "2025",
        PAGES = "7796-7809",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239175"}

@article{bb244270,
        AUTHOR = "Zhao, Z.C. and Zhou, C.F. and Zhang, Y. and Li, C.L. and Ma, X.L. and Tang, J.",
        TITLE = "Text-Guided Coarse-to-Fine Fusion Network for robust remote sensing
visual question answering",
        JOURNAL = PandRS,
        VOLUME = "230",
        YEAR = "2025",
        PAGES = "1-17",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239176"}

@article{bb244271,
        AUTHOR = "Lu, Z. and Zeng, Q.J. and Lu, M.K. and Chen, G. and Xia, Y.",
        TITLE = "Bridging the Semantic Gap in Medical Visual Question Answering with
Prompt Learning",
        JOURNAL = MedImg,
        VOLUME = "44",
        YEAR = "2025",
        NUMBER = "11",
        MONTH = "November",
        PAGES = "4605-4616",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239177"}

@article{bb244272,
        AUTHOR = "Du, Z. and Yuan, Z.Q. and Wu, X. and Xu, C.S.",
        TITLE = "Disentanglement-Based Equivariant Learning for Compositional VQA",
        JOURNAL = MultMed,
        VOLUME = "27",
        YEAR = "2025",
        PAGES = "8160-8173",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239178"}

@article{bb244273,
        AUTHOR = "Jin, Z.X. and Qin, P. and Lin, S. and Qin, J. and Zhai, S.J. and Zeng, J.C. and Yin, X.C.",
        TITLE = "Robust scene text understanding with OCR token and word alignment for
Text-VQA and text-caption",
        JOURNAL = PR,
        VOLUME = "172",
        YEAR = "2026",
        PAGES = "112362",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239179"}

@article{bb244274,
        AUTHOR = "Mao, A. and Wen, S.Y. and Chen, F. and Yi, R. and Liu, Y.J.",
        TITLE = "Robust 3D Visual Question Answering via Bias Learning",
        JOURNAL = CirSysVideo,
        VOLUME = "35",
        YEAR = "2025",
        NUMBER = "12",
        MONTH = "December",
        PAGES = "12492-12507",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239180"}

@article{bb244275,
        AUTHOR = "Liu, J. and Zhang, L.Z. and Mu, C. and Lu, G.X. and Zhang, B. and Li, J.S.",
        TITLE = "Question-Guided Multigranular Visual Augmentation for Knowledge-Based
Visual Question Answering",
        JOURNAL = CVIU,
        VOLUME = "263",
        YEAR = "2026",
        PAGES = "104569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239181"}

@article{bb244276,
        AUTHOR = "Zhang, X.Y. and Zhang, L.L. and Wu, Y.R. and Wang, S.W. and Wu, W.J. and Huang, M. and Wang, Q.Y. and Liu, J.",
        TITLE = "Memory-enriched thought-by-thought framework for complex Diagram
Question Answering",
        JOURNAL = CVIU,
        VOLUME = "264",
        YEAR = "2026",
        PAGES = "104608",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239182"}

@article{bb244277,
        AUTHOR = "Chen, T.Y. and Liu, H.B. and Wang, Y. and Chen, Y.H. and He, T.Y. and Gan, C.F. and He, H.Y. and Lin, W.Y.",
        TITLE = "MECD+: Unlocking Event-Level Causal Graph Discovery for Video
Reasoning",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "3",
        MONTH = "March",
        PAGES = "2628-2645",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239183"}

@article{bb244278,
        AUTHOR = "Liang, J.F. and Jiang, S.X. and Tang, W. and Wang, N. and Wang, Z.K. and Mao, X. and Lv, K. and Liu, M. and Qin, B.",
        TITLE = "APSam: An Aggregating-Then-Pruning Sampler for Question-Conditional
Denoising",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "2",
        MONTH = "February",
        PAGES = "1754-1765",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239184"}

@article{bb244279,
        AUTHOR = "Wang, F.J. and Liu, J.Y. and Zhang, R.N. and Li, Z.X. and Zhang, F. and An, G.Y.",
        TITLE = "CKCR: Context-aware knowledge construction and retrieval for
knowledge-based visual question answering",
        JOURNAL = JVCIR,
        VOLUME = "116",
        YEAR = "2026",
        PAGES = "104711",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239185"}

@article{bb244280,
        AUTHOR = "Lu, J.H. and You, S. and Bao, B.K.",
        TITLE = "Question Understanding and Temporality Guiding for Video Question
Answering",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "2772-2783",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239186"}

@article{bb244281,
        AUTHOR = "Li, Z.F. and Qiu, F. and Wang, Y.R. and Xia, Y.J. and Xiao, K. and Zhang, M. and Zhang, Y.",
        TITLE = "Integrating Object Interaction Self-Attention and GAN-Based Debiasing
for Visual Question Answering",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "3228-3241",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239187"}

@article{bb244282,
        AUTHOR = "Xu, Q.X. and Zhou, L. and Zhong, X. and Zhang, F.F. and Tian, J. and Yu, X.H. and Huang, R.",
        TITLE = "Refined generation-based framework for consistent and reliable visual
question answering",
        JOURNAL = PR,
        VOLUME = "178",
        YEAR = "2026",
        PAGES = "113421",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239188"}

@article{bb244283,
        AUTHOR = "Xu, P.F. and Yan, F.",
        TITLE = "RSSR: Efficient knowledge transfer and deep spatial modeling for
remote sensing visual question answering",
        JOURNAL = CVIU,
        VOLUME = "268",
        YEAR = "2026",
        PAGES = "104753",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239189"}

@article{bb244284,
        AUTHOR = "Zhu, L. and Ying, M.X. and Zhang, C.Y. and Liu, D. and Wu, L.Y.B. and Zhang, S.C. and Li, X.L.",
        TITLE = "Multi-Modal Refined Prompting for Advancing Knowledge-Based Visual
Question Answering",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "3444-3457",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239190"}

@article{bb244285,
        AUTHOR = "Suo, W. and Ma, J. and Sun, M.Y. and Zhang, H.W. and Wang, P. and Zhang, Y.N. and Wu, Q.",
        TITLE = "Semi-Supervised VQA Multi-Modal Explanation via Self-Critical
Learning",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "7",
        MONTH = "July",
        PAGES = "8361-8377",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239191"}

@inproceedings{bb244286,
        AUTHOR = "Suo, W. and Sun, M.Y. and Liu, W.S. and Gao, Y.Q. and Wang, P. and Zhang, Y.N. and Wu, Q.",
        TITLE = "S3C: Semi-Supervised VQA Natural Language Explanation via
Self-Critical Learning",
        BOOKTITLE = CVPR23,
        YEAR = "2023",
        PAGES = "2646-2656",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239192"}

@article{bb244287,
        AUTHOR = "Fang, C.Y. and Wan, X. and Jiang, W.H. and Fang, Y.M. and Tang, Z.",
        TITLE = "DSRAS: Dual-Stage Reasoning and Answer Selection for Video-Text
Visual Question Answering",
        JOURNAL = SPLetters,
        VOLUME = "33",
        YEAR = "2026",
        PAGES = "2270-2274",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239193"}

@article{bb244288,
        AUTHOR = "Huang, Q. and He, P.H. and Li, P. and Lu, X.C. and Tian, Y. and Cai, Y. and Li, Q.",
        TITLE = "Metaphorical Visual Question Answering: Benchmark and
Knowledge-Enhanced Metaphor Understanding Method",
        JOURNAL = MultMed,
        VOLUME = "28",
        YEAR = "2026",
        PAGES = "4904-4916",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239194"}

@article{bb244289,
        AUTHOR = "Zhang, C.L. and Deng, J.Q. and Zhang, H. and Li, L.B. and Sun, L. and Ma, X.",
        TITLE = "GeoIR-Compiler: A Geospatial Intermediate Representation and
Compilation Framework for Chinese Urban Spatial Question Answering",
        JOURNAL = IJGI,
        VOLUME = "15",
        YEAR = "2026",
        NUMBER = "7",
        PAGES = "310",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239195"}

@inproceedings{bb244290,
        AUTHOR = "Ren, H.Y. and Chen, W. and Liu, C.P. and Ji, Y. and Li, Y.",
        TITLE = "MedKI: Knowledge Dual Injections for Medical Visual Question
Answering",
        BOOKTITLE = ICIP25,
        YEAR = "2025",
        PAGES = "79-84",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239196"}

@inproceedings{bb244291,
        AUTHOR = "Shah, K. and J, S. and Bhutani, G. and Singh, K. and Singh, S.",
        TITLE = "Visual Prompting Through Image Mines",
        BOOKTITLE = ICIP25,
        YEAR = "2025",
        PAGES = "713-718",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239197"}

@inproceedings{bb244292,
        AUTHOR = "He, Z.L. and Pan, Y.J. and Li, H. and Ma, F.P. and Peng, Y.S. and Wu, S.Y. and Sun, X.Y.",
        TITLE = "Enhancing Visual Question Answering Via Clustered In-Context Sequence
Configuration",
        BOOKTITLE = ICIP25,
        YEAR = "2025",
        PAGES = "935-940",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239198"}

@inproceedings{bb244293,
        AUTHOR = "Mijiyawa, A. and Sadat, F.",
        TITLE = "Visual Question Answering Using Multimodal Data Augmentation for
Hausa",
        BOOKTITLE = IVCNZ25,
        YEAR = "2025",
        PAGES = "1-6",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239199"}

@inproceedings{bb244294,
        AUTHOR = "Cheng, Y. and Goel, A. and Bilen, H.",
        TITLE = "Visually Interpretable Subtask Reasoning for Visual Question
Answering",
        BOOKTITLE = XAI4CV25,
        YEAR = "2025",
        PAGES = "2751-2771",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239200"}

@inproceedings{bb244295,
        AUTHOR = "Jang, Y. and Kong, H. and Kim, G. and Lee, Y. and Choi, J. and Bae, K.",
        TITLE = "ICT-QA: Question Answering Over Multi-Modal Contexts Including Image,
Chart, and Text Modalities",
        BOOKTITLE = "MULA25",
        YEAR = "2025",
        PAGES = "138-148",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239201"}

@inproceedings{bb244296,
        AUTHOR = "Li, K. and Vosselman, G. and Yang, M.Y.",
        TITLE = "Multimodal Rationales for Explainable Visual Question Answering",
        BOOKTITLE = "MULA25",
        YEAR = "2025",
        PAGES = "191-201",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239202"}

@inproceedings{bb244297,
        AUTHOR = "Zou, Y.H. and Yin, Z.Z.",
        TITLE = "MVCM: Enhancing Multi-View and Cross-Modality Alignment for Medical
Visual Question Answering and Medical Image-Text Retrieval",
        BOOKTITLE = "MULA25",
        YEAR = "2025",
        PAGES = "180-190",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239203"}

@inproceedings{bb244298,
        AUTHOR = "Luo, J.Z. and Liu, Y. and Chen, W.X. and Li, Z. and Wang, Y.W. and Li, G.B. and Lin, L.",
        TITLE = "DSPNet: Dual-vision Scene Perception for Robust 3D Question Answering",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14169-14178",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239204"}

@inproceedings{bb244299,
        AUTHOR = "Zou, Y.H. and Yin, Z.Z.",
        TITLE = "Alignment, Mining and Fusion: Representation Alignment with Hard
Negative Mining and Selective Knowledge Fusion for Medical Visual
Question Answering",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29623-29633",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803vqa1.html#TT239205"}

Last update:Aug 19, 2026 at 13:26:35