@article{bb247500,
        AUTHOR = "Han, H.C. and Wang, A.J.P. and Liu, F.M. and Zhu, J.",
        TITLE = "Negation-Aware Test-Time Adaptation for Vision-Language Models",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "12906-12919",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242393"}

@article{bb247501,
        AUTHOR = "Yang, X. and Pan, H.W. and Wang, X.Z. and Cao, Y.X. and Li, J.Z. and Wang, M.",
        TITLE = "FiNE: Fine-Grained Neuron-Level Model Editing for Reliable and Safe
LLMs",
        JOURNAL = PAMI,
        VOLUME = "48",
        YEAR = "2026",
        NUMBER = "10",
        MONTH = "October",
        PAGES = "12181-12195",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242394"}

@article{bb247502,
        AUTHOR = "Yang, X. and Tilwani, D. and O'Reilly, C. and Shinkareva, S.V.",
        TITLE = "Evaluating Large Language Models as Substitutes for Human Affective
Ratings in Naturalistic Paradigms",
        JOURNAL = AffCom,
        VOLUME = "17",
        YEAR = "2026",
        NUMBER = "3",
        MONTH = "July",
        PAGES = "2868-2879",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242395"}

@article{bb247503,
        AUTHOR = "Fang, Z. and Du, S. and Wu, Z.H. and Cai, Z.L. and Tan, Y.C. and Wang, S.P. and Lin, Z.C.",
        TITLE = "Harnessing noisy LLM annotations: Confidence-calibrated node
selection on text-attributed graphs",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114379",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242396"}

@article{bb247504,
        AUTHOR = "Cong, J.",
        TITLE = "Sinkhorn-Regularized Uncertainty Quantification for LLMs via entropic
optimal transport",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114377",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242397"}

@article{bb247505,
        AUTHOR = "Chen, X. and Zhang, J.M. and Long, Y.F. and Jin, P. and Su, N. and Dai, X.Y. and Chen, J.J.",
        TITLE = "Multi-view auxiliary modeling for stable LLM adaptation under view
disagreement",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242398"}

@article{bb247506,
        AUTHOR = "Liu, J.M. and Wei, Y.T. and Lin, J. and Sun, H.M. and Zhao, S.Y. and Chen, Z.B. and Zeng, W.J. and Jin, X.",
        TITLE = "Semantics Disentanglement and Composition for Universal Image Coding
With Efficiently LLM Reasoning and Generative Diffusion",
        JOURNAL = CirSysVideo,
        VOLUME = "36",
        YEAR = "2026",
        NUMBER = "9",
        MONTH = "September",
        PAGES = "14142-14155",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242399"}

@article{bb247507,
        AUTHOR = "Wu, Y.L. and Li, Z.L. and Wang, Y.X. and Liu, A. and Qi, S.H. and Chen, B. and Wang, X.",
        TITLE = "Query-based model extraction attack: A survey",
        JOURNAL = PR,
        VOLUME = "180",
        YEAR = "2026",
        PAGES = "114523",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242400"}

@article{bb247508,
        AUTHOR = "Mao, Y.D. and Chen, P.L. and Luo, H. and Zhu, L.Y. and Li, Y.H. and Wang, S.Q.",
        TITLE = "Optimizing Fidelity-Perception Tradeoff via Large Vision-Language
Model Prior for Image Compression",
        JOURNAL = IP,
        VOLUME = "35",
        YEAR = "2026",
        PAGES = "8966-8979",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242401"}

@inproceedings{bb247509,
        AUTHOR = "Chou, S.H. and Chandhok, S. and Little, J.J. and Sigal, L.",
        TITLE = "Test-Time Consistency in Vision Language Models",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "7789-7798",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242402"}

@inproceedings{bb247510,
        AUTHOR = "Hu, X.Y. and Yan, X.H. and Wang, N. and Wei, G. and Wang, Z.C.",
        TITLE = "HOLO: Holistic Lightweight Optimization for Scene Understanding with
Auto-Annotation and Multimodal Learning",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "7719-7729",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242403"}

@inproceedings{bb247511,
        AUTHOR = "Latif, S.S. and Shiper, S. and Kiran, K.M.R. and Ishmam, M.F. and Hossain, M.A. and Kamal, A.R.M. and Ashmafee, M.H.",
        TITLE = "Enhancing Vision Language Corruption Robustness using
Cross-Distribution & Prompted Denoisers",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "5754-5765",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242404"}

@inproceedings{bb247512,
        AUTHOR = "Chee, E. and Lee, M.L. and Hsu, W.",
        TITLE = "DREAM: Dynamic Prompts and GuidedMix for Efficient Continual
Adaptation of Visual-Language Models",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "5853-5863",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242405"}

@inproceedings{bb247513,
        AUTHOR = "He, L. and Zeng, X. and Song, Y.Z. and Chen, A.Y.C. and Xia, L. and Verma, S. and Dayal, S. and Sun, M. and Kuo, C.H. and Aliaga, D.",
        TITLE = "Advancing Multimodal LLMs by Large-Scale 3D Visual Instruction
Dataset Generation",
        BOOKTITLE = WACV26,
        YEAR = "2026",
        PAGES = "5886-5897",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242406"}

@inproceedings{bb247514,
        AUTHOR = "Liu, Z.X. and Jiang, G.K. and Khajavi, S.",
        TITLE = "LLaVA-SCo: Teach Vision Language Models to Self-Correct",
        BOOKTITLE = WiCV25,
        YEAR = "2025",
        PAGES = "3406-3415",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242407"}

@inproceedings{bb247515,
        AUTHOR = "Khattak, M.U. and Naeem, M.F. and Hassan, J. and Naseer, M. and Tombari, F. and Khan, F.S. and Khan, S.",
        TITLE = "How Good is my Video-LMM? Complex Video Reasoning and Robustness
Evaluation Suite for Video-LMMs",
        BOOKTITLE = WhatNext25,
        YEAR = "2025",
        PAGES = "3642-3651",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242408"}

@inproceedings{bb247516,
        AUTHOR = "Pham, C. and Phan, H. and Doermann, D. and Tian, Y.J.",
        TITLE = "PLVM: A Tuning-Free Approach for Personalized Large Vision-Language
Model",
        BOOKTITLE = WhatNext25,
        YEAR = "2025",
        PAGES = "3632-3641",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242409"}

@inproceedings{bb247517,
        AUTHOR = "Xie, H.C. and Ma, R. and Zhu, J.G. and Mai, Z. and Abd Almageed, W. and Abraham, Z.",
        TITLE = "Efficiently Mitigating Video Content Misalignment on Large Vision
Model with Time-Series Data Alignment",
        BOOKTITLE = LargeVM25,
        YEAR = "2025",
        PAGES = "3292-3298",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242410"}

@inproceedings{bb247518,
        AUTHOR = "Li, Y.F. and Bao, W.T. and Ye, B.T. and Tan, Z. and Chen, T.L. and Liu, H. and Kong, Y.",
        TITLE = "Window Token Concatenation for Efficient Visual Large Language Models",
        BOOKTITLE = LargeVM25,
        YEAR = "2025",
        PAGES = "3178-3188",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242411"}

@inproceedings{bb247519,
        AUTHOR = "Huang, Y.Q. and Qi, H. and Chen, Z. and Zhang, H.P. and Yu, H.C. and Zhao, Z.",
        TITLE = "Autonomous Multimodal Reasoning via Implicit Chain-of-Vision",
        BOOKTITLE = Reasoning25,
        YEAR = "2025",
        PAGES = "2954-2963",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242412"}

@inproceedings{bb247520,
        AUTHOR = "Mushtaq, E. and Fabian, Z. and Bakman, Y.F. and Ramakrishna, A. and Soltanolkotabi, M. and Avestimehr, S.",
        TITLE = "HARMONY: Hidden Activation Representations and Model Output-Aware
Uncertainty Estimation for Vision-Language Models",
        BOOKTITLE = TrustworthyOpen25,
        YEAR = "2025",
        PAGES = "1654-1659",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242413"}

@inproceedings{bb247521,
        AUTHOR = "Wang, Z. and Lo, F.P.W. and Chen, Q. and Zhang, Y.Q. and Lin, C. and Chen, X. and Yu, Z.H. and Thompson, A.J. and Yeatman, E.M. and Lo, B.P.L.",
        TITLE = "An LLM-Enabled Multi-Agent Autonomous Mechatronics Design Framework",
        BOOKTITLE = MultiEmbodied25,
        YEAR = "2025",
        PAGES = "4205-4215",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242414"}

@inproceedings{bb247522,
        AUTHOR = "Chen, J.H. and Yang, Z.Q. and Xu, H.Y.G. and Zhang, D.D. and Mylonas, G.",
        TITLE = "Multi-Agent Systems for Robotic Autonomy with LLMs",
        BOOKTITLE = MultiEmbodied25,
        YEAR = "2025",
        PAGES = "4194-4204",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242415"}

@inproceedings{bb247523,
        AUTHOR = "Singh, K. and Singh, S. and Khanna, M.",
        TITLE = "Trishul: Towards Region Identification and Screen Hierarchy
Understanding for Large VLM Based GUI Agents",
        BOOKTITLE = "MULA25",
        YEAR = "2025",
        PAGES = "170-179",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242416"}

@inproceedings{bb247524,
        AUTHOR = "Ardakani, M. and Malekar, J. and Zand, R.",
        TITLE = "LLMPi: Optimizing LLMs for High-Throughput on Raspberry Pi",
        BOOKTITLE = EDGE25,
        YEAR = "2025",
        PAGES = "6369-6378",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242417"}

@inproceedings{bb247525,
        AUTHOR = "Villa, A. and Alcazar, J.L. and Soto, A. and Ghanem, B.",
        TITLE = "Behind the Magic, MERLIM: Multi-Modal Evaluation Benchmark for Large
Image-Language Models",
        BOOKTITLE = "AIBench25",
        YEAR = "2025",
        PAGES = "492-502",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242418"}

@inproceedings{bb247526,
        AUTHOR = "Mei, G.F. and Lin, W. and Riz, L. and Wu, Y.J. and Poiesi, F. and Wang, Y.M.",
        TITLE = "PerLA: Perceptive 3D language assistant",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14369-14379",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242419"}

@inproceedings{bb247527,
        AUTHOR = "Han, Y.D. and Guo, Q.P. and Pan, L.Y. and Liu, L. and Guan, Y. and Yang, M.",
        TITLE = "DynFocus: Dynamic Cooperative Network Empowers LLMs with Video
Understanding",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "8512-8522",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242420"}

@inproceedings{bb247528,
        AUTHOR = "Liu, Y. and Liang, Z.Y. and Wang, Y.Z. and Wu, X.F. and Tang, F.L. and He, M. and Li, J. and Liu, Z. and Yang, H. and Lim, S. and Zhao, B.",
        TITLE = "Unveiling the Ignorance of MLLMs: Seeing Clearly, Answering
Incorrectly",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "9087-9097",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242421"}

@inproceedings{bb247529,
        AUTHOR = "Wang, Z.T. and Hu, S.M. and Zhao, S.Y. and Lin, X.W. and Juefei Xu, F. and Li, Z. and Han, L. and Subramanyam, H. and Chen, L. and Chen, J.F. and Jiang, N. and Lyu, L.J. and Ma, S.Q. and Metaxas, D.N. and Jain, A.",
        TITLE = "MLLM-as-a-Judge for Image Safety without Human Labeling",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14657-14666",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242422"}

@inproceedings{bb247530,
        AUTHOR = "Zhu, M. and Tian, Y.Z. and Chen, H. and Zhou, C.L. and Guo, Q.P. and Liu, Y. and Yang, M. and Shen, C.H.",
        TITLE = "SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by
Imitating Human Annotator Trajectories",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "3686-3696",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242423"}

@inproceedings{bb247531,
        AUTHOR = "Zhu, L. and Chen, T.R. and Xu, Q.X. and Liu, X. and Ji, D. and Wu, H.Y. and Soh, D.W. and Liu, J.",
        TITLE = "POPEN: Preference-Based Optimization and Ensemble for LVLM-Based
Reasoning Segmentation",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "30231-30240",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242424"}

@inproceedings{bb247532,
        AUTHOR = "Niu, J. and Li, Y.F. and Miao, Z.Y. and Ge, C.J. and Zhou, Y.H. and He, Q.H. and Dong, X.Y. and Duan, H.D. and Ding, S.R. and Qian, R. and Zhang, P. and Zang, Y.H. and Cao, Y.H. and He, C.H. and Wang, J.Q.",
        TITLE = "OVO-Bench: How Far is Your Video-LLMs from Real-World Online Video
Understanding?",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "18902-18913",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242425"}

@inproceedings{bb247533,
        AUTHOR = "Xue, X.Y. and Lu, Z. and Huang, D. and Wang, Z.D. and Ouyang, W.L. and Bai, L.",
        TITLE = "ComfyBench: Benchmarking LLM-based Agents in ComfyUI for Autonomously
Designing Collaborative AI Systems",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24614-24624",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242426"}

@inproceedings{bb247534,
        AUTHOR = "Zhao, Z. and Huo, Y.Q. and Yue, T.T. and Guo, L.T. and Lu, H.Y. and Wang, B.N. and Chen, W.P. and Liu, J.",
        TITLE = "Efficient Motion-Aware Video MLLM",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24159-24168",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242427"}

@inproceedings{bb247535,
        AUTHOR = "Wu, R.H. and Su, W. and Liao, J.",
        TITLE = "Chat2SVG: Vector Graphics Generation with Large Language Models and
Image Diffusion Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "23690-23700",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242428"}

@inproceedings{bb247536,
        AUTHOR = "Yang, S.Q. and Chen, Y. and Tian, Z. and Wang, C.Y. and Li, J.Y. and Yu, B. and Jia, J.Y.",
        TITLE = "VisionZip: Longer is Better but Not Necessary in Vision Language
Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "19792-19802",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242429"}

@inproceedings{bb247537,
        AUTHOR = "Xie, J.Y. and Yang, J.T. and Luo, Z. and Cao, Y. and Gao, Q. and Zhang, M.Y. and Hu, W.P.",
        TITLE = "AdaDARE-y: Balancing Stability and Plasticity in Multi-modal LLMs
through Efficient Adaptation",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "19758-19768",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242430"}

@inproceedings{bb247538,
        AUTHOR = "Tao, K. and Qin, C. and You, H.X. and Sui, Y. and Wang, H.",
        TITLE = "DyCoke: Dynamic Compression of Tokens for Fast Video Large Language
Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "18992-19001",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242431"}

@inproceedings{bb247539,
        AUTHOR = "Tao, C.X. and Su, S.Q. and Zhu, X.Z. and Zhang, C.Y. and Chen, Z. and Liu, J. and Wang, W.H. and Lu, L.W. and Huang, G. and Qiao, Y. and Dai, J.F.",
        TITLE = "HoVLE: Unleashing the Power of Monolithic Vision-Language Models with
Holistic Vision-Language Embedding",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "14559-14569",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242432"}

@inproceedings{bb247540,
        AUTHOR = "Yin, H. and Si, G.Z. and Wang, Z.",
        TITLE = "Lifting the Veil on Visual Information Flow in MLLMs: Unlocking
Pathways to Faster Inference",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "9382-9391",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242433"}

@inproceedings{bb247541,
        AUTHOR = "Yang, L.R. and Shen, D. and Cai, C.X. and Chen, K.B. and Yang, F. and Gao, T.T. and Zhang, D. and Li, X.",
        TITLE = "Libra-Merging: Importance-Redundancy and Pruning-Merging Trade-Off
for Acceleration Plug-In in Large Vision-Language Model",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "9402-9412",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242434"}

@inproceedings{bb247542,
        AUTHOR = "Liang, Y. and Wang, Z.W. and Xu, X.W. and Zhou, J. and Lu, J.W.",
        TITLE = "EfficientLLaVA: Generalizable Auto-Pruning for Large Vision-language
Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "9445-9454",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242435"}

@inproceedings{bb247543,
        AUTHOR = "Heo, M. and Chen, M.H. and Huang, D.A. and Liu, S. and Radhakrishnan, S. and Kim, S.J. and Wang, Y.C.A.F. and Hachiuma, R.",
        TITLE = "Omni-RGPT: Unifying Image and Video Region-level Understanding via
Token Marks",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "3919-3930",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242436"}

@inproceedings{bb247544,
        AUTHOR = "Ouali, Y. and Bulat, A. and Xenos, A. and Zaganidis, A. and Metaxas, I.M. and Martinez, B. and Tzimiropoulos, G.",
        TITLE = "VladVA: Discriminative Fine-tuning of LVLMs",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4101-4111",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242437"}

@inproceedings{bb247545,
        AUTHOR = "Schnaus, D. and Araslanov, N. and Cremers, D.",
        TITLE = "It's a (Blind) Match! Towards Vision-Language Correspondence without
Parallel Data",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24983-24992",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242438"}

@inproceedings{bb247546,
        AUTHOR = "Zhao, Y.Q. and Yin, Y.Y. and Li, L. and Lin, M. and Huang, V.S.J. and Chen, S.W. and Chen, W.P. and Yin, B. and Zhou, Z. and Zhang, W.T.",
        TITLE = "Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual
Knowledge",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "24950-24959",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242439"}

@inproceedings{bb247547,
        AUTHOR = "Ye, X. and Gan, Y. and Huang, X. and Ge, Y.X. and Tang, Y.S.",
        TITLE = "VoCo-LLaMA: Towards Vision Compression with Large Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29836-29846",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242440"}

@inproceedings{bb247548,
        AUTHOR = "Hu, Y. and Song, Z.K. and Feng, N. and Luo, Y.W. and Yu, J.Q. and Chen, Y.P.P. and Yang, W.",
        TITLE = "SF2T: Self-supervised Fragment Finetuning of Video-LLMs for
Fine-Grained Understanding",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29108-29117",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242441"}

@inproceedings{bb247549,
        AUTHOR = "Chen, J. and Zeng, Z.Y. and Lin, Y.Q. and Li, W. and Ma, Z. and Shou, M.Z.",
        TITLE = "Live: Learning Video LLM with Streaming Speech Transcription at Scale",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29083-29095",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242442"}

@inproceedings{bb247550,
        AUTHOR = "Wang, Z.W. and Chen, W.Z. and Yang, L. and Zhou, S. and Zhao, S. and Zhan, H. and Jin, J.C. and Li, L.C. and Shao, Z. and Bu, J.J.",
        TITLE = "MP-GUI: Modality Perception with MLLMs for GUI Understanding",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "29711-29721",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242443"}

@inproceedings{bb247551,
        AUTHOR = "Vayani, A. and Dissanayake, D. and Watawana, H. and Ahsan, N. and Sasikumar, N. and Thawakar, O. and Ademtew, H.B. and Hmaiti, Y. and Kumar, A. and Kuckreja, K. and Maslych, M. and Ghallabi, W.A. and Mihaylov, M. and Qin, C. and Shaker, A.M. and Zhang, M. and Ihsani, M.K. and Esplana, A. and Gokani, M. and Mirkin, S. and Singh, H. and Srivastava, A. and Hamerlik, E. and Izzati, F.A. and Maani, F.A. and Cavada, S. and Chim, J. and Gupta, R. and Manjunath, S. and Zhumakhanova, K. and Rabevohitra, F.H. and Amirudin, A. and Ridzuan, M. and Kareem, D. and More, K. and Li, K. and Shakya, P. and Saad, M. and Ghasemaghaei, A. and Djanibekov, A. and Azizov, D. and Jankovic, B. and Bhatia, N. and Cabrera, A. and Obando Ceron, J. and Otieno, O. and Farestam, F. and Rabbani, M. and Baliah, S. and Sanjeev, S. and Shtanchaev, A. and Fatima, M. and Nguyen, T. and Kareem, A. and Aremu, T. and Xavier, N. and Bhatkal, A. and Toyin, H. and Chadha, A. and Cholakkal, H. and Anwer, R.M. and Felsberg, M. and Laaksonen, J. and Solorio, T. and Choudhury, M. and Laptev, I. and Shah, M. and Khan, S. and Khan, F.S.",
        TITLE = "All Languages Matter: Evaluating LMMs on Culturally Diverse 100
Languages",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "19565-19575",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242444"}

@inproceedings{bb247552,
        AUTHOR = "Cao, A. and Wei, X. and Ma, Z.H.",
        TITLE = "FLAME: Frozen Large Language Models Enable Data-Efficient
Language-Image Pre-training",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4080-4090",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242445"}

@inproceedings{bb247553,
        AUTHOR = "Bi, J. and Guo, J.J. and Tang, Y.L. and Wen, L.G.B. and Liu, Z. and Wang, B.J. and Xu, C.L.",
        TITLE = "Unveiling Visual Perception in Language Models: An Attention Head
Analysis Approach",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4135-4144",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242446"}

@inproceedings{bb247554,
        AUTHOR = "Li, S. and Hu, Y.C. and Ning, X.F. and Liu, X.H. and Hong, K. and Jia, X.T. and Li, X. and Yan, Y.Q. and Ran, P. and Dai, G.H. and Yan, S. and Yang, H.Z. and Wang, Y.",
        TITLE = "MBQ: Modality-Balanced Quantization for Large Vision-Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "4167-4177",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242447"}

@inproceedings{bb247555,
        AUTHOR = "Liu, Z. and Li, Y.Q. and Nguyen, K.D. and Zhong, Y. and Li, Y.",
        TITLE = "PAVE: Patching and Adapting Video Large Language Models",
        BOOKTITLE = CVPR25,
        YEAR = "2025",
        PAGES = "3306-3317",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242448"}

@inproceedings{bb247556,
        AUTHOR = "Malakouti, S. and Aghazadeh, A. and Khandelwal, A. and Kovashka, A.",
        TITLE = "Benchmarking VLMs' Reasoning About Persuasive Atypical Images",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "4788-4798",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242449"}

@inproceedings{bb247557,
        AUTHOR = "Lee, H. and Seo, G. and Choi, W. and Jung, G. and Song, K. and Jung, J.Y.",
        TITLE = "Enhancing Visual Classification Using Comparative Descriptors",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "5274-5283",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242450"}

@inproceedings{bb247558,
        AUTHOR = "Ee, Y.K. and Zhang, H. and Matyasko, A. and Fernando, B.",
        TITLE = "Deduce and Select Evidences with Language Models for Training-Free
Video Goal Inference",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "5937-5947",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242451"}

@inproceedings{bb247559,
        AUTHOR = "Fu, R. and Liu, J.Y. and Chen, X. and Nie, Y.X. and Xiong, W.H.",
        TITLE = "Scene-LLM: Extending Language Model for 3D Visual Reasoning",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "2195-2206",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242452"}

@inproceedings{bb247560,
        AUTHOR = "Awais, M. and Alharthi, A.H.S.A. and Kumar, A. and Cholakkal, H. and Anwer, R.M.",
        TITLE = "AgroGPT: Efficient Agricultural Vision-Language Model with Expert
Tuning",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "5687-5696",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242453"}

@inproceedings{bb247561,
        AUTHOR = "Kruzhkov, E. and Behnke, S.",
        TITLE = "LiLMaps: Learnable Implicit Language Maps",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "7711-7720",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242454"}

@inproceedings{bb247562,
        AUTHOR = "Singh, C.K. and Kumar, D. and Sanap, V. and Sinha, R.",
        TITLE = "LLM-RSPF: Large Language Model-Based Robotic System Planning
Framework for Domain Specific Use-cases",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "7277-7286",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242455"}

@inproceedings{bb247563,
        AUTHOR = "Sun, L. and Ahuja, C. and Chen, P. and D'Zmura, M. and Batmanghelich, K. and Bontrager, P.",
        TITLE = "Multi-Modal Large Language Models are Effective Vision Learners",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "8617-8626",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242456"}

@inproceedings{bb247564,
        AUTHOR = "Tateno, M. and Yagi, T. and Furuta, R. and Sato, Y.",
        TITLE = "Learning Multiple Object States from Actions via Large Language
Models",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "9555-9565",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242457"}

@inproceedings{bb247565,
        AUTHOR = "Bahadir, C.D. and Akar, G.B. and Sabuncu, M.R.",
        TITLE = "LLM-Generated Rewrite and Context Modulation for Enhanced Vision
Language Models in Digital Pathology",
        BOOKTITLE = WACV25,
        YEAR = "2025",
        PAGES = "327-336",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242458"}

@inproceedings{bb247566,
        AUTHOR = "Chu, X.X. and Su, J.L. and Zhang, B. and Shen, C.H.",
        TITLE = "VisionlLaMA: A Unified LLaMA Backbone for Vision Tasks",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "LXVI: 1-18",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242459"}

@inproceedings{bb247567,
        AUTHOR = "Long, F.C. and Qiu, Z.F. and Yao, T. and Mei, T.",
        TITLE = "VideoStudio: Generating Consistent-content and Multi-scene Videos",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "LX: 468-485",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242460"}

@inproceedings{bb247568,
        AUTHOR = "Kong, X.H. and Chen, J. and Wang, W.G. and Su, H. and Hu, X.L. and Yang, Y. and Liu, S.",
        TITLE = "Controllable Navigation Instruction Generation with Chain of Thought
Prompting",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXIX: 37-54",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242461"}

@inproceedings{bb247569,
        AUTHOR = "Zhu, W.Y.C. and Ye, K. and Ke, J.J. and Yu, J.H. and Guibas, L.J. and Milanfar, P. and Yang, F.",
        TITLE = "ARTVLM: Attribute Recognition Through Vision-based Prefix Language
Modeling",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXVII: 127-145",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242462"}

@inproceedings{bb247570,
        AUTHOR = "Kim, D. and Cho, S. and Kim, S. and Luo, C. and Hong, S.",
        TITLE = "Chameleon: A Data-efficient Generalist for Dense Visual Prediction in
the Wild",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXIII: 422-441",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242463"}

@inproceedings{bb247571,
        AUTHOR = "Ke, F. and Cai, Z.X. and Jahangard, S. and Wang, W.Q. and Haghighi, P.D. and Rezatofighi, H.",
        TITLE = "Hydra: A Hyper Agent for Dynamic Compositional Visual Reasoning",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XX: 132-149",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242464"}

@inproceedings{bb247572,
        AUTHOR = "Bao, X.Y. and Sun, S.Y. and Ma, S.L. and Zheng, K.C. and Guo, Y.X. and Zhao, G.S. and Zheng, Y. and Wang, X.G.",
        TITLE = "Cores: Orchestrating the Dance of Reasoning and Segmentation",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XVIII: 187-204",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242465"}

@inproceedings{bb247573,
        AUTHOR = "Liu, Z. and Liu, B. and Wang, J.H. and Dong, Y.H. and Chen, G.Y. and Rao, Y.M. and Krishna, R. and Lu, J.W.",
        TITLE = "Efficient Inference of Vision Instruction-following Models with Elastic
Cache",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XVII: 54-69",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242466"}

@inproceedings{bb247574,
        AUTHOR = "Alaluf, Y. and Richardson, E. and Tulyakov, S. and Aberman, K. and Cohen Or, D.",
        TITLE = "MYVLM: Personalizing VLMS for User-specific Queries",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XIII: 73-91",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242467"}

@inproceedings{bb247575,
        AUTHOR = "Ma, Z.X. and Huang, W. and Zhang, J. and Gupta, T. and Krishna, R.",
        TITLE = "m&m's: A Benchmark to Evaluate Tool-use for multi-step multi-modal
Tasks",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "X: 18-34",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242468"}

@inproceedings{bb247576,
        AUTHOR = "Miao, Y. and Engelmann, F. and Vysotska, O. and Zhao, Z.H. and Chai, W.H. and Wang, X. and Li, B. and Hao, S.Y. and Cao, S.D. and Ye, T. and Wang, G.A.",
        TITLE = "See and Think: Embodied Agent in Virtual Environment",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "VIII: 187-204",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242469"}

@inproceedings{bb247577,
        AUTHOR = "Liu, Y. and Duan, H.D. and Zhang, Y.H. and Li, B. and Zhang, S.Y. and Zhao, W. and Yuan, Y. and Wang, J.Q. and He, C.H. and Liu, Z.W. and Chen, K. and Lin, D.",
        TITLE = "MMBENCH: Is Your Multi-Modal Model an All-Around Player?",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "VI: 216-233",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242470"}

@inproceedings{bb247578,
        AUTHOR = "Liu, Y. and Ding, P.X. and Huang, S. and Zhang, M. and Zhao, H. and Wang, D.L.",
        TITLE = "PITE: Pixel-Temporal Alignment for Large Video-Language Model",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "V: 160-176",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242471"}

@inproceedings{bb247579,
        AUTHOR = "Panagopoulou, A. and Xue, L. and Yu, N. and Li, J. and Li, D.X. and Joty, S. and Xu, R. and Savarese, S. and Xiong, C.M. and Niebles, J.C.",
        TITLE = "X-instructblip: A Framework for Aligning Image, 3d, Audio, Video to
LLMs and its Emergent Cross-modal Reasoning",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLV: 177-197",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242472"}

@inproceedings{bb247580,
        AUTHOR = "Mirza, M.J. and Karlinsky, L. and Lin, W. and Doveh, S. and Micorek, J. and Kozinski, M. and Kuehne, H. and Possegger, H.",
        TITLE = "Meta-prompting for Automating Zero-shot Visual Recognition with LLMs",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "II: 370-387",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242473"}

@inproceedings{bb247581,
        AUTHOR = "Liu, Z.Y. and Lai, Z.Q. and Gao, Z.W. and Cui, E. and Li, Z.H. and Zhu, X.Z. and Lu, L.W. and Chen, Q.F. and Qiao, Y. and Dai, J.F. and Wang, W.H.",
        TITLE = "ControlLLM: Augment Language Models with Tools by Searching on Graphs",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XII: 89-105",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242474"}

@inproceedings{bb247582,
        AUTHOR = "Yao, Y. and Hsu, C.F. and Lin, J.H. and Xie, H.X. and Lin, T. and Huang, Y.N. and Shuai, H.H. and Cheng, W.H.",
        TITLE = "The Fabrication of Reality and Fantasy: Scene Generation with
LLM-assisted Prompt Interpretation",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXII: 422-438",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242475"}

@inproceedings{bb247583,
        AUTHOR = "Wu, Y.X. and Wang, Y.Z. and Tang, S.X. and Wu, W.H. and He, T. and Ouyang, W.L. and Torr, P.H.S. and Wu, J.",
        TITLE = "Dettoolchain: A New Prompting Paradigm to Unleash Detection Ability of
MLLM",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXXII: 164-182",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242476"}

@inproceedings{bb247584,
        AUTHOR = "Wang, H. and Ye, Y.J. and Wang, Y.J. and Nie, Y.X. and Huang, C.",
        TITLE = "Elysium: Exploring Object-level Perception in Videos via MLLM",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXII: 166-185",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242477"}

@inproceedings{bb247585,
        AUTHOR = "Guo, Z.H. and Xu, R. and Yao, Y. and Cui, J. and Ni, Z. and Ge, C.J. and Chua, T.S. and Liu, Z.Y. and Huang, G.",
        TITLE = "LLAVA-UHD: An LMM Perceiving Any Aspect Ratio and High-resolution
Images",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "LXXXIII: 390-406",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242478"}

@inproceedings{bb247586,
        AUTHOR = "Zhou, G.Z. and Hong, Y.C. and Wang, Z. and Wang, X.E. and Wu, Q.",
        TITLE = "NAVGPT-2: Unleashing Navigational Reasoning Capability for Large
Vision-language Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "VII: 260-278",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242479"}

@inproceedings{bb247587,
        AUTHOR = "Wei, H.R. and Kong, L.Y. and Chen, J.Y. and Zhao, L. and Ge, Z. and Wei, J.R.Y.H.R. and Wang, T. and Ge, Z. and Zhang, X.Y. and Tao, W.B.",
        TITLE = "Vary: Scaling up the Vision Vocabulary for Large Vision-language Model",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "IV: 408-424",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242480"}

@inproceedings{bb247588,
        AUTHOR = "He, S.T. and Ding, H.H. and Jiang, X.D. and Wen, B.",
        TITLE = "Segpoint: Segment Any Point Cloud via Large Language Model",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXII: 349-367",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242481"}

@inproceedings{bb247589,
        AUTHOR = "Murugesan, B. and Silva Rodriguez, J. and Ben Ayed, I. and Dolz, J.",
        TITLE = "Robust Calibration of Large Vision-language Adapters",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXIV: 147-165",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242482"}

@inproceedings{bb247590,
        AUTHOR = "Xu, R. and Wang, X.L. and Wang, T. and Chen, Y.L. and Pang, J.M. and Lin, D.",
        TITLE = "Pointllm: Empowering Large Language Models to Understand Point Clouds",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXV: 131-147",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242483"}

@inproceedings{bb247591,
        AUTHOR = "Cai, K.W. and Duan, Z.K. and Liu, G. and Fleming, C. and Lu, C.X.X.",
        TITLE = "Self-adapting Large Visual-language Models to Edge Devices Across
Visual Modalities",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXVIII: 301-318",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242484"}

@inproceedings{bb247592,
        AUTHOR = "Yu, R. and Yu, W.H. and Wang, X.C.",
        TITLE = "Attention Prompting on Image for Large Vision-language Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXX: 251-268",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242485"}

@inproceedings{bb247593,
        AUTHOR = "Luo, Y.L. and An, R.C. and Zou, B.C. and Tang, Y.M. and Liu, J.M. and Zhang, S.H.",
        TITLE = "Llm as Dataset Analyst: Subpopulation Structure Discovery with Large
Language Model",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXXIII: 235-252",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242486"}

@inproceedings{bb247594,
        AUTHOR = "Huang, Z.J. and Tang, T. and Chen, S.X. and Lin, S. and Jie, Z.Q. and Ma, L. and Wang, G. and Liang, X.D.",
        TITLE = "Making Large Language Models Better Planners with Reasoning-decision
Alignment",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XXXVI: 73-90",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242487"}

@inproceedings{bb247595,
        AUTHOR = "Zhan, Y.F. and Zhu, Y. and Chen, Z.Y. and Yang, F. and Tang, M. and Wang, J.Q.",
        TITLE = "Griffon: Spelling Out All Object Locations at Any Granularity with
Large Language Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLII: 405-422",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242488"}

@inproceedings{bb247596,
        AUTHOR = "Li, Y.W. and Wang, C.Y. and Jia, J.Y.",
        TITLE = "Llama-vid: An Image is Worth 2 Tokens in Large Language Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLVI: 323-340",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242489"}

@inproceedings{bb247597,
        AUTHOR = "Ju, C. and Wang, H.C. and Cheng, H.Z. and Chen, X. and Zhai, Z.H. and Huang, W.L. and Lan, J.S. and Xiao, S. and Zheng, B.",
        TITLE = "Turbo: Informativity-driven Acceleration Plug-in for Vision-language
Large Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLVI: 436-455",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242490"}

@inproceedings{bb247598,
        AUTHOR = "Zhao, Q. and Xu, M. and Gupta, K. and Asthana, A. and Zheng, L. and Gould, S.",
        TITLE = "The First to Know: How Token Distributions Reveal Hidden Knowledge in
Large Vision-language Models?",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLVIII: 127-142",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242491"}

@inproceedings{bb247599,
        AUTHOR = "Lee, B.K. and Park, B. and Kim, C.W. and Ro, Y.M.",
        TITLE = "Moai: Mixture of All Intelligence for Large Language and Vision Models",
        BOOKTITLE = ECCV24,
        YEAR = "2024",
        PAGES = "XLIX: 273-302",
        BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT242492"}

Last update:Sep 30, 2026 at 11:45:00