@inproceedings{bb246500,
AUTHOR = "Zhang, C. and Stepputtis, S. and Sycara, K. and Xie, Y.Q.",
TITLE = "Enhancing Vision-Language Few-Shot Adaptation with Negative Learning",
BOOKTITLE = WACV25,
YEAR = "2025",
PAGES = "5905-5915",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241395"}
@inproceedings{bb246501,
AUTHOR = "Yang, Y.T. and Chen, M.H. and Qiu, Q. and Wu, J.H. and Wang, W.X. and Lin, B.B. and Guan, Z.Y. and He, X.F.",
TITLE = "Adapt2reward: Adapting Video-language Models to Generalizable Robotic
Rewards via Failure Prompts",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LVII: 163-180",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241396"}
@inproceedings{bb246502,
AUTHOR = "Adhikari, R. and Thapaliya, S. and Dhakal, M. and Khanal, B.",
TITLE = "Tunevlseg: Prompt Tuning Benchmark for Vision-language Segmentation
Models",
BOOKTITLE = ACCV24,
YEAR = "2024",
PAGES = "III: 44-62",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241397"}
@inproceedings{bb246503,
AUTHOR = "Zhang, J.M. and Ma, X.J. and Wang, X. and Qiu, L.Y. and Wang, J.Q. and Jiang, Y.G. and Sang, J.",
TITLE = "Adversarial Prompt Tuning for Vision-language Models",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XLV: 56-72",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241398"}
@inproceedings{bb246504,
AUTHOR = "Wu, G. and Zhang, X. and Li, Z. and Chen, Z.W. and Liang, J.J. and Yang, J. and Li, X.",
TITLE = "Cascade Prompt Learning for Vision-language Model Adaptation",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "L: 304-321",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241399"}
@inproceedings{bb246505,
AUTHOR = "Han, J. and Lin, Z.W. and Sun, Z.Y. and Gao, Y.G. and Yan, K. and Ding, S.H. and Gao, Y. and Xia, G.S.",
TITLE = "Anchor-based Robust Finetuning of Vision-Language Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "26909-26918",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241400"}
@inproceedings{bb246506,
AUTHOR = "Wu, T.Y. and Ho, C.H. and Vasconcelos, N.M.",
TITLE = "ProTeCt: Prompt Tuning for Taxonomic Open Set Classification",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "16531-16540",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241401"}
@inproceedings{bb246507,
AUTHOR = "Zhang, Y.B. and Zhu, W.J. and Tang, H. and Ma, Z.Y. and Zhou, K.Y. and Zhang, L.",
TITLE = "Dual Memory Networks: A Versatile Adaptation Approach for
Vision-Language Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "28718-28728",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241402"}
@inproceedings{bb246508,
AUTHOR = "Guo, Y.C. and Gu, X.D.",
TITLE = "JoAPR: Cleaning the Lens of Prompt Learning for Vision-Language
Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "28695-28705",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241403"}
@inproceedings{bb246509,
AUTHOR = "Cao, Q.L. and Zheng Qin, X. and Chen, Y.T. and Chao, M. and Yang, X.K.",
TITLE = "Domain Prompt Learning with Quaternion Networks",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "26627-26636",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241404"}
@inproceedings{bb246510,
AUTHOR = "Zanella, M. and Fuchs, C. and de Vleeschouwer, C. and Ayed, I.B.",
TITLE = "Realistic Test-Time Adaptation of Vision-Language Models",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "25103-25112",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241405"}
@inproceedings{bb246511,
AUTHOR = "Fuchs, C. and Zanella, M. and de Vleeschouwer, C.",
TITLE = "Online Gaussian Test-Time Adaptation of Vision-Language Models",
BOOKTITLE = "MULA25",
YEAR = "2025",
PAGES = "128-137",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241406"}
@inproceedings{bb246512,
AUTHOR = "Zanella, M. and Ayed, I.B.",
TITLE = "On the Test-Time Zero-Shot Generalization of Vision-Language Models:
Do we Really need Prompt Learning?",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "23783-23793",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241407"}
@inproceedings{bb246513,
AUTHOR = "Yang, S.Q. and Tian, Z.T. and Jiang, L. and Jia, J.Y.",
TITLE = "Unified Language-Driven Zero-Shot Domain Adaptation",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "23407-23415",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241408"}
@inproceedings{bb246514,
AUTHOR = "Chen, Y.F. and Chen, D.P. and Liu, R.J. and Zhou, S. and Xue, W.Y. and Peng, W.",
TITLE = "Align Before Adapt: Leveraging Entity-to-Region Alignments for
Generalizable Video Action Recognition",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "18688-18698",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241409"}
@inproceedings{bb246515,
AUTHOR = "Kahatapitiya, K. and Arnab, A. and Nagran, A. and Ryoo, M.S.",
TITLE = "VicTR: Video-conditioned Text Representations for Activity
Recognition",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "18547-18558",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241410"}
@inproceedings{bb246516,
AUTHOR = "Huang, C.Q. and Jiang, A. and Feng, J.H. and Zhang, Y. and Wang, X.C. and Wang, Y.F.",
TITLE = "Adapting Visual-Language Models for Generalizable Anomaly Detection
in Medical Images",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "11375-11385",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241411"}
@inproceedings{bb246517,
AUTHOR = "Bang, J. and Ahn, S. and Lee, J.G.",
TITLE = "Active Prompt Learning in Vision Language Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "26994-27004",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241412"}
@inproceedings{bb246518,
AUTHOR = "Khandelwal, A.",
TITLE = "PromptSync: Bridging Domain Gaps in Vision-Language Models through
Class-Aware Prototype Alignment and Discrimination",
BOOKTITLE = ZeroShot24,
YEAR = "2024",
PAGES = "7819-7828",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241413"}
@inproceedings{bb246519,
AUTHOR = "Hirohashi, Y. and Hirakawa, T. and Yamashita, T. and Fujiyoshi, H.",
TITLE = "Prompt Learning with One-Shot Setting based Feature Space Analysis in
Vision-and-Language Models",
BOOKTITLE = ZeroShot24,
YEAR = "2024",
PAGES = "7761-7770",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241414"}
@inproceedings{bb246520,
AUTHOR = "Karmanov, A. and Guan, D. and Lu, S.J. and El Saddik, A. and Xing, E.",
TITLE = "Efficient Test-Time Adaptation of Vision-Language Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "14162-14171",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241415"}
@inproceedings{bb246521,
AUTHOR = "Zhao, Y. and Zhao, L. and Zhou, X.Y. and Wu, J.L. and Chu, C.T. and Miao, H. and Schroff, F. and Adam, H. and Liu, T. and Gong, B.Q. and Krahenbuhl, P. and Yuan, L.Z.",
TITLE = "Distilling Vision-Language Models on Millions of Videos",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "13106-13116",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241416"}
@inproceedings{bb246522,
AUTHOR = "Hu, Y.S. and Stretcu, O. and Lu, C.T. and Viswanathan, K. and Hata, K. and Luo, E. and Krishna, R. and Fuxman, A.",
TITLE = "Visual Program Distillation: Distilling Tools and Programmatic
Reasoning into Vision-Language Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "9590-9601",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241417"}
@inproceedings{bb246523,
AUTHOR = "Zanella, M. and Fuchs, C. and Ben Ayed, I. and de Vleeschouwer, C.",
TITLE = "Vocabulary-Free Few-Shot Learning for Vision-Language Models",
BOOKTITLE = "MULA25",
YEAR = "2025",
PAGES = "149-158",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241418"}
@inproceedings{bb246524,
AUTHOR = "Silva Rodriguez, J. and Hajimiri, S. and Ben Ayed, I. and Dolz, J.",
TITLE = "A Closer Look at the Few-Shot Adaptation of Large Vision-Language
Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "23681-23690",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241419"}
@inproceedings{bb246525,
AUTHOR = "Zanella, M. and Ben Ayed, I.",
TITLE = "Low-Rank Few-Shot Adaptation of Vision-Language Models",
BOOKTITLE = Prompting24,
YEAR = "2024",
PAGES = "1593-1603",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241420"}
@inproceedings{bb246526,
AUTHOR = "Shen, S. and Yang, S. and Zhang, T.J. and Zhai, B. and Gonzalez, J.E. and Keutzer, K. and Darrell, T.J.",
TITLE = "Multitask Vision-Language Prompt Tuning",
BOOKTITLE = WACV24,
YEAR = "2024",
PAGES = "5644-5655",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241421"}
@inproceedings{bb246527,
AUTHOR = "Lin, W. and Mirza, M.J. and Doveh, S. and Feris, R. and Giryes, R. and Hochreiter, S. and Karlinsky, L.",
TITLE = "Comparison Visual Instruction Tuning",
BOOKTITLE = Reasoning25,
YEAR = "2025",
PAGES = "2964-2974",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241422"}
@inproceedings{bb246528,
AUTHOR = "Hu, Z.Y. and Li, Y.Y. and Lyu, M.R. and Wang, L.W.",
TITLE = "VL-PET: Vision-and-Language Parameter-Efficient Tuning via
Granularity Control",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "2998-3008",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241423"}
@inproceedings{bb246529,
AUTHOR = "Wu, C.E. and Tian, Y. and Yu, H.C. and Wang, H. and Morgado, P. and Hu, Y.H. and Yang, L.J.",
TITLE = "Why Is Prompt Tuning for Vision-Language Models Robust to Noisy
Labels?",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "15442-15451",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241424"}
@inproceedings{bb246530,
AUTHOR = "Ouali, Y. and Bulat, A. and Matinez, B. and Tzimiropoulos, G.",
TITLE = "Black Box Few-Shot Adaptation for Vision-Language models",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "15488-15500",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241425"}
@inproceedings{bb246531,
AUTHOR = "Kan, B. and Wang, T. and Lu, W.P. and Zhen, X.T. and Guan, W. and Zheng, F.",
TITLE = "Knowledge-Aware Prompt Tuning for Generalizable Vision-Language
Models",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "15624-15634",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241426"}
@inproceedings{bb246532,
AUTHOR = "Cho, E. and Kim, J. and Kim, H.W.J.",
TITLE = "Distribution-Aware Prompt Tuning for Vision-Language Models",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "21947-21956",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241427"}
@inproceedings{bb246533,
AUTHOR = "Varma, M. and Delbrouck, J.B. and Hooper, S. and Chaudhari, A. and Langlotz, C.",
TITLE = "ViLLA: Fine-Grained Vision-Language Representation Learning from
Real-World Data",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "22168-22178",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241428"}
@inproceedings{bb246534,
AUTHOR = "Upadhyay, U. and Karthik, S. and Mancini, M. and Akata, Z.",
TITLE = "ProbVLM: Probabilistic Adapter for Frozen Vison-Language Models",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "1899-1910",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803tunvlm5.html#TT241429"}
@article{bb246535,
AUTHOR = "Liang, J.W. and Liang, S.Y. and Liu, A.S. and Cao, X.C.",
TITLE = "VL-Trojan: Multimodal Instruction Backdoor Attacks against
Autoregressive Visual Language Models",
JOURNAL = IJCV,
VOLUME = "133",
YEAR = "2025",
NUMBER = "7",
MONTH = "July",
PAGES = "3994-4013",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241430"}
@article{bb246536,
AUTHOR = "Fu, T.C. and Zhang, J.H. and Li, F.X. and Wei, P. and Zeng, X.L. and Zhou, W.",
TITLE = "Multimodal alignment augmentation transferable attack on
vision-language pre-training models",
JOURNAL = PRL,
VOLUME = "191",
YEAR = "2025",
PAGES = "131-137",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241431"}
@article{bb246537,
AUTHOR = "Jia, X.J. and Gao, S.S. and Guo, Q. and Qin, S. and Ma, K. and Huang, Y.H. and Liu, Y. and Tsang, I.W. and Cao, X.C.",
TITLE = "Semantic-Aligned Adversarial Evolution Triangle for
High-Transferability Vision-Language Attack",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "10",
MONTH = "October",
PAGES = "8489-8505",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241432"}
@article{bb246538,
AUTHOR = "Qian, Y.G. and Kong, Y.X. and Bao, Q.Q. and Gu, Z.Q. and Wang, B. and Ji, S. and Zhang, J.P. and Lei, Z.",
TITLE = "Individual and Common Attack: Enhancing Transferability in VLP Models
Through Modal Feature Exploitation",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "1082-1095",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241433"}
@article{bb246539,
AUTHOR = "Kuurila Zhang, H. and Chen, H.Y. and Zhao, G.Y.",
TITLE = "Evaluating the Adversarial Robustness of Vision-Language Models for
Facial Expression Recognition",
JOURNAL = IEEE_Int_Sys,
VOLUME = "41",
YEAR = "2026",
NUMBER = "1",
MONTH = "January",
PAGES = "105-112",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241434"}
@article{bb246540,
AUTHOR = "Liu, C.H. and Wang, Y. and Cao, H.Y. and Liu, B. and Jiang, D.Q.",
TITLE = "Evaluating the Adversarial Robustness of Vision-Language Models via
Internal Feature Perturbations",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "3938-3950",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241435"}
@article{bb246541,
AUTHOR = "Lu, Z. and Xu, N. and Tian, H. and Wang, L.J. and Liu, A.A.",
TITLE = "Medical VLP Model Is Vulnerable: Toward Multimodal Adversarial Attack
on Large Medical Vision-Language Models",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "2",
MONTH = "February",
PAGES = "2478-2491",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241436"}
@article{bb246542,
AUTHOR = "Wang, B. and Qian, S.S. and Xu, C.S.",
TITLE = "Invisible Backdoor Attack With Siamese Tuning on Pre-Trained
Vision-Language Models",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "1663-1676",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241437"}
@article{bb246543,
AUTHOR = "Liu, D.Z. and Liu, W.Q. and Cai, X.W. and Zhou, P. and Guan, R.W. and Qu, X.Y. and Du, B.",
TITLE = "Generating transferable attacks across large vision-language models
using adversarial deformation learning",
JOURNAL = PR,
VOLUME = "176",
YEAR = "2026",
PAGES = "113194",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241438"}
@inproceedings{bb246544,
AUTHOR = "Cao, Y. and Xing, Y. and Zhang, J. and Lin, D. and Zhang, T.W. and Tsang, I. and Liu, Y. and Guo, Q.",
TITLE = "SceneTAP: Scene-Coherent Typographic Adversarial Planner against
Vision-Language Models in Real-World Environments",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "25050-25059",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241439"}
@inproceedings{bb246545,
AUTHOR = "Xie, P. and Bie, Y. and Mao, J. and Song, Y.Q. and Wang, Y. and Chen, H. and Chen, K.",
TITLE = "Chain of Attack: On the Robustness of Vision-Language Models Against
Transfer-Based Adversarial Attacks",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "14679-14689",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241440"}
@inproceedings{bb246546,
AUTHOR = "Zhang, J.M. and Ye, J. and Ma, X. and Li, Y. and Yang, Y.F. and Chen, Y.H. and Sang, J. and Yeung, D.Y.",
TITLE = "Anyattack: Towards Large-scale Self-supervised Adversarial Attacks on
Vision-language Models",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "19900-19909",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241441"}
@inproceedings{bb246547,
AUTHOR = "Liang, S.Y. and Liang, J.W. and Pang, T.Y. and Du, C. and Liu, A. and Zhu, M.L. and Cao, X.C. and Tao, D.C.",
TITLE = "Revisiting Backdoor Attacks against Large Vision-Language Models from
Domain Shift",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "9477-9486",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241442"}
@inproceedings{bb246548,
AUTHOR = "Fime, A.A. and Hossain, M.Z. and Zaman, S. and Shahid, A.R. and Imteaj, A.",
TITLE = "Towards Trustworthy Autonomous Vehicles with Vision-Language Models
under Targeted and Untargeted Adversarial Attacks",
BOOKTITLE = "FaDE-TCV25",
YEAR = "2025",
PAGES = "619-628",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241443"}
@inproceedings{bb246549,
AUTHOR = "Chen, L. and Chen, Y.L. and Luo, Y. and Dou, H. and Zhong, X.Y.",
TITLE = "Attention-Guided Hierarchical Defense for Multimodal Attacks in
Vision-Language Models",
BOOKTITLE = TrustworthyOpen25,
YEAR = "2025",
PAGES = "1598-1608",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241444"}
@inproceedings{bb246550,
AUTHOR = "Xing, S.L. and Zhao, Z.Y. and Sebe, N.",
TITLE = "CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards
Zero-shot Adversarial Robustness of CLIP",
BOOKTITLE = CVPR25,
YEAR = "2025",
PAGES = "15172-15182",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241445"}
@inproceedings{bb246551,
AUTHOR = "Ishmam, A.M. and Thomas, C.",
TITLE = "Semantic Shield: Defending Vision-Language Models Against Backdooring
and Poisoning via Fine-Grained Knowledge Alignment",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "24820-24830",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241446"}
@inproceedings{bb246552,
AUTHOR = "Wang, Y. and Liu, X.G. and Li, Y. and Chen, M. and Xiao, C.W.",
TITLE = "Adashield: Safeguarding Multimodal Large Language Models from
Structure-based Attack via Adaptive Shield Prompting",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "XX: 77-94",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241447"}
@inproceedings{bb246553,
AUTHOR = "Gao, S. and Jia, X.J. and Ren, X.H. and Tsang, I. and Guo, Q.",
TITLE = "Boosting Transferability in Vision-language Attacks via Diversification
Along the Intersection Region of Adversarial Trajectory",
BOOKTITLE = ECCV24,
YEAR = "2024",
PAGES = "LVII: 442-460",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241448"}
@inproceedings{bb246554,
AUTHOR = "Bai, J. and Gao, K. and Min, S.B. and Xia, S.T. and Li, Z.F. and Liu, W.",
TITLE = "BadCLIP: Trigger-Aware Prompt Learning for Backdoor Attacks on CLIP",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "24239-24250",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241449"}
@inproceedings{bb246555,
AUTHOR = "Liang, S.Y. and Zhu, M.L. and Liu, A. and Wu, B.Y. and Cao, X.C. and Chang, E.C.",
TITLE = "BadCLIP: Dual-Embedding Guided Backdoor Attack on Multimodal
Contrastive Learning",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "24645-24654",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241450"}
@inproceedings{bb246556,
AUTHOR = "Lu, D. and Wang, Z.Q. and Wang, T. and Guan, W. and Gao, H.C. and Zheng, F.",
TITLE = "Set-level Guidance Attack: Boosting Adversarial Transferability of
Vision-Language Pre-training Models",
BOOKTITLE = ICCV23,
YEAR = "2023",
PAGES = "102-111",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803atkvlm4.html#TT241451"}
@article{bb246557,
AUTHOR = "Zhao, Z. and Wang, S. and Gu, J. and Zhu, Y. and Mei, L. and Zhuang, Z.X. and Cui, Z.M. and Wang, Q. and Shen, D.G.",
TITLE = "ChatCAD+: Toward a Universal and Reliable Interactive CAD Using LLMs",
JOURNAL = MedImg,
VOLUME = "43",
YEAR = "2024",
NUMBER = "11",
MONTH = "November",
PAGES = "3755-3766",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241452"}
@article{bb246558,
AUTHOR = "Luo, H.N. and Zeng, Y.J. and Yang, L. and Chen, K. and Shen, Z.X. and Lv, F.M.",
TITLE = "VLAI: Exploration and Exploitation based on Visual-Language Aligned
Information for Robotic Object Goal Navigation",
JOURNAL = IVC,
VOLUME = "151",
YEAR = "2024",
PAGES = "105259",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241453"}
@article{bb246559,
AUTHOR = "Mansourian, A. and Oucheikh, R.",
TITLE = "ChatGeoAI: Enabling Geospatial Analysis for Public through Natural
Language, with Large Language Models",
JOURNAL = IJGI,
VOLUME = "13",
YEAR = "2024",
NUMBER = "10",
PAGES = "348",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241454"}
@article{bb246560,
AUTHOR = "Li, D. and Zhao, Y. and Wang, Z.F. and Jung, C. and Zhang, Z.",
TITLE = "Large Language Model-Driven Structured Output: A Comprehensive
Benchmark and Spatial Data Generation Framework",
JOURNAL = IJGI,
VOLUME = "13",
YEAR = "2024",
NUMBER = "11",
PAGES = "405",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241455"}
@article{bb246561,
AUTHOR = "Li, Y.X. and Hu, B.T. and Chen, X.Y. and Ma, L. and Xu, Y. and Zhang, M.",
TITLE = "LMEye: An Interactive Perception Network for Large Language Models",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "10952-10964",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241456"}
@article{bb246562,
AUTHOR = "Shao, R. and Zhang, Z.Y. and Tao, C. and Zhang, Y.S. and Peng, C.L. and Li, H.F.",
TITLE = "Homogeneous tokenizer matters: Homogeneous visual tokenizer for
remote sensing image understanding",
JOURNAL = PandRS,
VOLUME = "218",
YEAR = "2024",
PAGES = "294-310",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241457"}
@article{bb246563,
AUTHOR = "Wang, Z.H. and Luo, T. and Liu, C. and Liu, W.C. and Goh, R.S.M. and Wong, W.F.",
TITLE = "Enabling Energy-Efficient Deployment of Large Language Models on
Memristor Crossbar: A Synergy of Large and Small",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "2",
MONTH = "February",
PAGES = "916-933",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241458"}
@article{bb246564,
AUTHOR = "Zhan, Y. and Xiong, Z. and Yuan, Y.",
TITLE = "SkyEyeGPT: Unifying remote sensing vision-language tasks via
instruction tuning with large language model",
JOURNAL = PandRS,
VOLUME = "221",
YEAR = "2025",
PAGES = "64-77",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241459"}
@article{bb246565,
AUTHOR = "Zhu, Y. and Wen, Z.Y. and Li, X. and Shi, X.F. and Wu, X. and Dong, H. and Chen, J.M.",
TITLE = "ChatNav: Leveraging LLM to Zero-Shot Semantic Reasoning in Object
Navigation",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "3",
MONTH = "March",
PAGES = "2369-2381",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241460"}
@article{bb246566,
AUTHOR = "Marasco, E. and Bourlai, T.",
TITLE = "Enhancing trust in Large Language Models for streamlined
decision-making in military operations",
JOURNAL = IVC,
VOLUME = "158",
YEAR = "2025",
PAGES = "105489",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241461"}
@article{bb246567,
AUTHOR = "Qiao, D. and Ao, X. and Liu, Y. and Chen, X.T. and Song, F.Y. and Qin, Z. and Jin, W.Q.",
TITLE = "Tri-AFLLM: Resource-Efficient Adaptive Asynchronous Accelerated
Federated LLMs",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "5",
MONTH = "May",
PAGES = "4198-4211",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241462"}
@article{bb246568,
AUTHOR = "Zhang, Y.X. and Liu, C.B. and Liu, Y.Z. and Gao, Y.F. and Lu, Z.Y. and Xie, H.T. and Zhang, Y.D.",
TITLE = "Leveraging Concise Concepts With Probabilistic Modeling for
Interpretable Visual Recognition",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "3117-3131",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241463"}
@article{bb246569,
AUTHOR = "Chen, L.F. and Hu, P. and Pan, Z.L. and Liu, Q. and Zhang, S.H. and Liu, Z.",
TITLE = "Large Language Models Can Achieve Explainable and Training-Free
One-Shot HRRP ATR",
JOURNAL = SPLetters,
VOLUME = "32",
YEAR = "2025",
PAGES = "3395-3399",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241464"}
@article{bb246570,
AUTHOR = "Yang, S.Y. and Yu, W.J. and Yang, W.J. and Liu, X.W. and Tan, H.B. and Lan, L. and Xiao, N.",
TITLE = "WildVideo: Benchmarking LMMs for Understanding Video-Language
Interaction",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "10",
MONTH = "October",
PAGES = "9330-9344",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241465"}
@article{bb246571,
AUTHOR = "Chen, G. and Jiao, H.Y. and Hou, S.Y. and Liu, Z.Q. and Xie, L. and Wu, S. and Wu, H.Y. and Guan, X.F. and Gui, Z.P.",
TITLE = "GeoJSEval: An Automated Evaluation Framework for Large Language
Models on JavaScript-Based Geospatial Computation and Visualization
Code Generation",
JOURNAL = IJGI,
VOLUME = "14",
YEAR = "2025",
NUMBER = "10",
PAGES = "382",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241466"}
@article{bb246572,
AUTHOR = "Zhang, H.J. and Dong, L. and Liu, Y. and Huang, Y.F. and Wang, Y.L. and Wang, L.M. and Qiao, Y.",
TITLE = "LvBench: A Benchmark for Long-form Video Understanding with Versatile
Multi-modal Question Answering",
JOURNAL = IJCV,
VOLUME = "133",
YEAR = "2025",
NUMBER = "11",
MONTH = "November",
PAGES = "7726-7747",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241467"}
@inproceedings{bb246573,
AUTHOR = "Li, K.C. and Wang, Y. and He, Y. and Li, Y.Z. and Wang, Y. and Liu, Y. and Wang, Z. and Xu, J. and Chen, G. and Lou, P. and Wang, L.M. and Qiao, Y.",
TITLE = "MVBench: A Comprehensive Multi-modal Video Understanding Benchmark",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "22195-22206",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241468"}
@article{bb246574,
AUTHOR = "Wang, X.R. and Zhang, H. and Li, B. and Liang, K.M. and Sun, H. and He, Z.J. and Ma, Z.Y. and Guo, J.",
TITLE = "Detailed Object Description With Controllable Dimensions",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "8474-8485",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241469"}
@article{bb246575,
AUTHOR = "Peng, Z.R. and Liu, X.M. and Yang, G. and Liu, J. and Peng, X.P. and Long, Y.",
TITLE = "The uncertainty advantage: Enhancing large language models'
reliability through chain of uncertainty reasoning",
JOURNAL = PRL,
VOLUME = "200",
YEAR = "2026",
PAGES = "30-36",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241470"}
@article{bb246576,
AUTHOR = "Li, Y.X. and Liu, Z.Y. and Hu, B. and Wang, W. and Ding, Y.X. and Cao, X.C. and Zhang, M.",
TITLE = "Vision Enhancing LLMs: Empowering Multimodal Knowledge Storage and
Sharing in LLMs",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "858-871",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241471"}
@article{bb246577,
AUTHOR = "Shi, Y.Q. and Yang, R. and Yin, C.S. and Lu, Y.W. and Huang, B. and Tao, Y. and Zhong, Y.H.",
TITLE = "Two-Stage Fine-Tuning of Large Vision-Language Models with
Hierarchical Prompting for Few-Shot Object Detection in Remote
Sensing Images",
JOURNAL = RS,
VOLUME = "18",
YEAR = "2026",
NUMBER = "2",
PAGES = "266",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241472"}
@article{bb246578,
AUTHOR = "Li, Q.Y. and Ma, S. and Luo, J.W. and Yu, Y. and Zhou, Y. and Wang, F.X. and Lu, X.D. and Wang, X.X. and He, X. and Chen, Y.S. and Yang, X.",
TITLE = "Co-Training Vision-Language Models for Remote Sensing Multi-Task
Learning",
JOURNAL = RS,
VOLUME = "18",
YEAR = "2026",
NUMBER = "2",
PAGES = "222",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241473"}
@article{bb246579,
AUTHOR = "Zhang, D. and Li, Z.Z. and Zhang, M.L. and Zhang, J.X. and Liu, Z.Y. and Yao, Y.X. and Xu, H.T. and Zheng, J.H. and Chen, X. and Zhang, Y.Y. and Yin, F. and Dong, J.H. and Guo, Z.J. and Song, L. and Liu, C.L.",
TITLE = "From System 1 to System 2: A Survey of Reasoning Large Language
Models",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "3335-3354",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241474"}
@article{bb246580,
AUTHOR = "Musacchio, E. and Siciliani, L. and Basile, P. and Semeraro, G.",
TITLE = "Extending Large Language Models to multimodality for non-English
languages",
JOURNAL = CVIU,
VOLUME = "264",
YEAR = "2026",
PAGES = "104618",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241475"}
@article{bb246581,
AUTHOR = "Wang, X. and Pan, Z. and Chen, H. and Zhu, W.W.",
TITLE = "DiViCo: Disentangled Visual Token Compression for Efficient Large
Vision-Language Model",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "2",
MONTH = "February",
PAGES = "1392-1405",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241476"}
@article{bb246582,
AUTHOR = "Liu, Z.Y. and Sun, Z.Y. and Zang, Y.H. and Li, W. and Zhang, P. and Dong, X.Y. and Xiong, Y.J. and Lin, D. and Wang, J.Q.",
TITLE = "RAR: Retrieving and Ranking Augmented MLLMs for Visual Recognition",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "388-401",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241477"}
@article{bb246583,
AUTHOR = "Zhao, H.B. and Zhu, F. and Ni, B.L. and Zhu, F. and Meng, G.F. and Zhang, Z.X.",
TITLE = "Practical Continual Forgetting for Pre-Trained Vision Models",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "5",
MONTH = "May",
PAGES = "5928-5944",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241478"}
@inproceedings{bb246584,
AUTHOR = "Zhao, H.B. and Ni, B.L. and Fan, J.S. and Wang, Y.X. and Chen, Y.T. and Meng, G.F. and Zhang, Z.X.",
TITLE = "Continual Forgetting for Pre-Trained Vision Models",
BOOKTITLE = CVPR24,
YEAR = "2024",
PAGES = "28631-28642",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241479"}
@article{bb246585,
AUTHOR = "Cao, J.J. and Yu, C. and Ye, P. and Chen, T.",
TITLE = "MADTP++: Bridge the Gap Between Token and Weight Pruning for
Accelerating VLTs",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "5",
MONTH = "May",
PAGES = "5180-5194",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241480"}
@article{bb246586,
AUTHOR = "Wang, Y.X. and Wei, B. and Ma, Y.H. and Zhang, L.L. and Jiang, X.D. and Ding, H.H. and Liu, J.",
TITLE = "GeoTree: A Dynamic Tree-Based Geometry Problem Solver Through
LLM-Symbolic Reasoning",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "2876-2887",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241481"}
@article{bb246587,
AUTHOR = "Hong, W.J. and Wu, C.",
TITLE = "Learning Domain-Invariant Prompts and Visual Representations for
Cross-Domain Scene Classification",
JOURNAL = RS,
VOLUME = "18",
YEAR = "2026",
NUMBER = "8",
PAGES = "1132",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241482"}
@article{bb246588,
AUTHOR = "Xiao, H.J. and Li, X. and Wang, R. and Wang, H. and Wang, Y. and Zhang, L.F. and Zhang, Y.",
TITLE = "M2DE: A multi-stressor multi-dimensional dynamic evaluation framework
for the trustworthiness of LLMs",
JOURNAL = PR,
VOLUME = "178",
YEAR = "2026",
PAGES = "113428",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241483"}
@article{bb246589,
AUTHOR = "Wang, Z. and Zheng, X.T. and Peng, Y.X.",
TITLE = "FinePruner: Unbiased Attention-Head-Level Fine-Grained Token
Reduction for Efficient Inference of Large Vision-Language Models",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "4907-4920",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241484"}
@article{bb246590,
AUTHOR = "Peng, F. and Yang, X.S. and Wang, Y.W. and Xu, C.S.",
TITLE = "Group-Relative Visual Discrimination Enhancement for Unlocking
Intrinsic Capability of MLLMs",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "5",
MONTH = "May",
PAGES = "5865-5876",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241485"}
@article{bb246591,
AUTHOR = "Li, X.D. and Tian, G.H. and Cui, Y.C.",
TITLE = "Semantically Guided Task Planning: Supervised Vision-Language-Action
Model by Large Language Models",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "5",
MONTH = "May",
PAGES = "7411-7425",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241486"}
@article{bb246592,
AUTHOR = "Liang, Y.X. and Li, X. and Chen, X.L. and Chen, H.T. and Zheng, Y. and Liu, Z. and Zhu, R. and Li, B. and Xue, X.Y.",
TITLE = "Pyramid Token Pruning for High-Resolution Large Vision-Language
Models via Region, Token, and Instruction-Guided Importance",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "6",
MONTH = "June",
PAGES = "8372-8384",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241487"}
@article{bb246593,
AUTHOR = "Liu, X. and Lian, Z.H.",
TITLE = "RSUniVLM: A unified vision-language model for remote sensing via
Granularity-oriented MoE",
JOURNAL = PR,
VOLUME = "179",
YEAR = "2026",
PAGES = "113717",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241488"}
@article{bb246594,
AUTHOR = "Yan, B. and Zhang, J. and Chen, Z.Y. and Shan, S.G. and Chen, X.L.",
TITLE = "MM-MoralBench: A multimodal moral evaluation benchmark for large
vision-language models",
JOURNAL = PR,
VOLUME = "179",
YEAR = "2026",
PAGES = "113624",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241489"}
@article{bb246595,
AUTHOR = "Huang, W.Y. and Xin, G. and Gu, B. and Qu, Y.Y. and Gao, L.X.",
TITLE = "Structure prediction and opportunity-cost scheduler for LLM inference",
JOURNAL = PR,
VOLUME = "179",
YEAR = "2026",
PAGES = "113599",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241490"}
@article{bb246596,
AUTHOR = "Huang, H.F. and Chen, Y.L. and Wang, Z. and Pang, J.M. and Zhao, Z.",
TITLE = "Chat-Scene++: Exploiting Context-Rich Object Identification for 3D
LLM",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "8",
MONTH = "August",
PAGES = "9813-9825",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241491"}
@article{bb246597,
AUTHOR = "Wang, C.Y. and He, Q.D. and Yang, Y.F. and Pei, J. and Xia, L.J. and Liu, J. and Li, B.Q. and Di, X.H.",
TITLE = "OCC-MLLM-V2: Joint understanding and generation for occluded objects
via multi-modal token learning",
JOURNAL = JVCIR,
VOLUME = "119",
YEAR = "2026",
PAGES = "104887",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241492"}
@article{bb246598,
AUTHOR = "Feng, X. and Feng, M.F. and Zhang, N. and Gu, T.L. and Chang, L. and Bin, C.Z.",
TITLE = "A hierarchical evaluation framework for security and trustworthiness
in Large Vision-Language Models",
JOURNAL = PR,
VOLUME = "180",
YEAR = "2026",
PAGES = "114161",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241493"}
@article{bb246599,
AUTHOR = "Wu, K. and Li, F.C. and Liu, W. and Liu, Q. and Yang, Y.",
TITLE = "Corrupted bitstream semantic understanding by adaptive-modal large
language models",
JOURNAL = PR,
VOLUME = "180",
YEAR = "2026",
PAGES = "114151",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat803llm4.html#TT241494"}
Last update:Sep 21, 2026 at 18:29:27