@article{bb254600,
AUTHOR = "Xu, X. and Lin, K.Y. and Yang, Y. and Hanjalic, A. and Shen, H.T.",
TITLE = "Joint Feature Synthesis and Embedding:
Adversarial Cross-Modal Retrieval Revisited",
JOURNAL = PAMI,
VOLUME = "44",
YEAR = "2022",
NUMBER = "6",
MONTH = "June",
PAGES = "3030-3047",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249426"}
@article{bb254601,
AUTHOR = "Hamroun, M. and Tamine, K. and Crespin, B.",
TITLE = "Multimodal Video Indexing (MVI): A New Method Based on Machine Learning
and Semi-Automatic Annotation on Large Video Collections",
JOURNAL = IJIG,
VOLUME = "22",
YEAR = "2022",
NUMBER = "2",
MONTH = "April",
PAGES = "2250022",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249427"}
@article{bb254602,
AUTHOR = "Parida, K.K. and Sharma, G.",
TITLE = "Discriminative semantic transitive consistency for cross-modal
learning",
JOURNAL = CVIU,
VOLUME = "219",
YEAR = "2022",
PAGES = "103404",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249428"}
@article{bb254603,
AUTHOR = "Song, X. and Chen, J.J. and Wu, Z.X. and Jiang, Y.G.",
TITLE = "Spatial-Temporal Graphs for Cross-Modal Text2Video Retrieval",
JOURNAL = MultMed,
VOLUME = "24",
YEAR = "2022",
PAGES = "2914-2923",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249429"}
@article{bb254604,
AUTHOR = "Ma, X.H. and Yang, X.S. and Gao, J.Y. and Xu, C.S.",
TITLE = "The Model May Fit You: User-Generalized Cross-Modal Retrieval",
JOURNAL = MultMed,
VOLUME = "24",
YEAR = "2022",
PAGES = "2998-3012",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249430"}
@article{bb254605,
AUTHOR = "Shan, W. and Huang, D. and Wang, J.T. and Zou, F. and Li, S.",
TITLE = "Self-Attention based fine-grained cross-media hybrid network",
JOURNAL = PR,
VOLUME = "130",
YEAR = "2022",
PAGES = "108748",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249431"}
@article{bb254606,
AUTHOR = "Qian, S.S. and Xue, D.Z. and Fang, Q. and Xu, C.S.",
TITLE = "Adaptive Label-Aware Graph Convolutional Networks for Cross-Modal
Retrieval",
JOURNAL = MultMed,
VOLUME = "24",
YEAR = "2022",
PAGES = "3520-3532",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249432"}
@article{bb254607,
AUTHOR = "Wang, Y. and Peng, Y.X.",
TITLE = "MARS: Learning Modality-Agnostic Representation for Scalable
Cross-Media Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "32",
YEAR = "2022",
NUMBER = "7",
MONTH = "July",
PAGES = "4765-4777",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249433"}
@article{bb254608,
AUTHOR = "Liu, G.H. and Li, Z.Y. and Yang, J.Y. and Zhang, D.",
TITLE = "Exploiting sublimated deep features for image retrieval",
JOURNAL = PR,
VOLUME = "147",
YEAR = "2024",
PAGES = "110076",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249434"}
@article{bb254609,
AUTHOR = "Liu, G.H. and Li, Z.Y. and Zhang, D.",
TITLE = "Exploiting Hu invariant moments and deep features for image retrieval",
JOURNAL = PR,
VOLUME = "173",
YEAR = "2026",
PAGES = "112801",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249435"}
@article{bb254610,
AUTHOR = "Liu, Z. and Zhao, F.Y. and Zhang, M.M.",
TITLE = "An Efficient Multimodal Aggregation Network for Video-Text Retrieval",
JOURNAL = IEICE,
VOLUME = "E105-D",
YEAR = "2022",
NUMBER = "10",
MONTH = "October",
PAGES = "1825-1828",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249436"}
@article{bb254611,
AUTHOR = "Guo, D.J. and Su, X.M. and Lian, Y. and Liu, L.M. and Wang, H.B.",
TITLE = "Two-stage partial image-text clustering (TPIT-C)",
JOURNAL = IET-CV,
VOLUME = "16",
YEAR = "2022",
NUMBER = "8",
PAGES = "694-708",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249437"}
@article{bb254612,
AUTHOR = "Jin, M. and Zhang, H.X. and Zhu, L. and Sun, J.D. and Liu, L.",
TITLE = "Video Sampled Frame Category Aggregation and Consistent
Representation for Cross-Modal Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "33",
YEAR = "2023",
NUMBER = "2",
MONTH = "February",
PAGES = "909-919",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249438"}
@article{bb254613,
AUTHOR = "Liao, L. and Yang, M. and Zhang, B.",
TITLE = "Deep Supervised Dual Cycle Adversarial Network for Cross-Modal
Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "33",
YEAR = "2023",
NUMBER = "2",
MONTH = "February",
PAGES = "920-934",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249439"}
@article{bb254614,
AUTHOR = "Gong, Y. and Cosma, G.",
TITLE = "Improving visual-semantic embeddings by learning
semantically-enhanced hard negatives for cross-modal information
retrieval",
JOURNAL = PR,
VOLUME = "137",
YEAR = "2023",
PAGES = "109272",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249440"}
@article{bb254615,
AUTHOR = "Li, W.H. and Wang, Y. and Su, Y.T. and Li, X.Y. and Liu, A.A. and Zhang, Y.D.",
TITLE = "Multi-Scale Fine-Grained Alignments for Image and Sentence Matching",
JOURNAL = MultMed,
VOLUME = "25",
YEAR = "2023",
PAGES = "543-556",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249441"}
@article{bb254616,
AUTHOR = "Hu, P. and Huang, Z.Y. and Peng, D.Z. and Wang, X. and Peng, X.",
TITLE = "Cross-Modal Retrieval With Partially Mismatched Pairs",
JOURNAL = PAMI,
VOLUME = "45",
YEAR = "2023",
NUMBER = "8",
MONTH = "August",
PAGES = "9595-9610",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249442"}
@article{bb254617,
AUTHOR = "Liu, Y.X. and Wu, J.L. and Qu, L. and Gan, T. and Yin, J.H. and Nie, L.Q.",
TITLE = "Self-Supervised Correlation Learning for Cross-Modal Retrieval",
JOURNAL = MultMed,
VOLUME = "25",
YEAR = "2023",
PAGES = "2851-2863",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249443"}
@article{bb254618,
AUTHOR = "Sun, C. and Zhang, H.X. and Liu, L. and Liu, D.M. and Wang, L.",
TITLE = "Multi-Label Adversarial Fine-Grained Cross-Modal Retrieval",
JOURNAL = SP:IC,
VOLUME = "117",
YEAR = "2023",
PAGES = "117018",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249444"}
@article{bb254619,
AUTHOR = "Guo, S.T. and Zhang, H.X. and Liu, L. and Liu, D.M. and Lu, X. and Li, L.J.",
TITLE = "Hypergraph clustering based multi-label cross-modal retrieval",
JOURNAL = JVCIR,
VOLUME = "103",
YEAR = "2024",
PAGES = "104258",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249445"}
@article{bb254620,
AUTHOR = "Song, D. and Ling, Y.T. and Li, T. and Wang, T. and Li, X.Y.",
TITLE = "Hierarchical deep semantic alignment for cross-domain 3D model
retrieval",
JOURNAL = JVCIR,
VOLUME = "95",
YEAR = "2023",
PAGES = "103895",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249446"}
@article{bb254621,
AUTHOR = "Li, T.B. and Liu, A.A. and Song, D. and Li, W.H. and Li, X.Y. and Su, Y.T.",
TITLE = "Focus on Hard Samples: Hierarchical Unbiased Constraints for
Cross-Domain 3D Model Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "33",
YEAR = "2023",
NUMBER = "11",
MONTH = "November",
PAGES = "7036-7049",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249447"}
@article{bb254622,
AUTHOR = "Dong, X. and Zhan, X.L. and Wei, Y.C. and Wei, X.Y. and Wang, Y.W. and Lu, M.L. and Cao, X.C. and Liang, X.D.",
TITLE = "Entity-Graph Enhanced Cross-Modal Pretraining for Instance-Level
Product Retrieval",
JOURNAL = PAMI,
VOLUME = "45",
YEAR = "2023",
NUMBER = "11",
MONTH = "November",
PAGES = "13117-13133",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249448"}
@inproceedings{bb254623,
AUTHOR = "Zhan, X.L. and Wu, Y.X. and Dong, X. and Wei, Y.C. and Lu, M.L. and Zhang, Y.C. and Xu, H. and Liang, X.D.",
TITLE = "Product1M: Towards Weakly Supervised Instance-Level Product Retrieval
via Cross-Modal Pretraining",
BOOKTITLE = ICCV21,
YEAR = "2021",
PAGES = "11762-11771",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249449"}
@article{bb254624,
AUTHOR = "Zhang, X. and Li, W.P. and Wang, X. and Wang, L. and Zheng, F.Z. and Wang, L. and Zhang, H.",
TITLE = "A Fusion Encoder with Multi-Task Guidance for Cross-Modal Text-Image
Retrieval in Remote Sensing",
JOURNAL = RS,
VOLUME = "15",
YEAR = "2023",
NUMBER = "18",
PAGES = "4637",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249450"}
@article{bb254625,
AUTHOR = "Xu, L.X. and Wang, L. and Zhang, J.Z. and Ha, D. and Zhang, H.",
TITLE = "A Review of Cross-Modal Image-Text Retrieval in Remote Sensing",
JOURNAL = RS,
VOLUME = "17",
YEAR = "2025",
NUMBER = "24",
PAGES = "3995",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249451"}
@article{bb254626,
AUTHOR = "Ye, Z.S. and Yao, L. and Zhang, Y. and Gustin, S.",
TITLE = "Self-supervised cross-modal visual retrieval from brain activities",
JOURNAL = PR,
VOLUME = "145",
YEAR = "2024",
PAGES = "109915",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249452"}
@article{bb254627,
AUTHOR = "Chen, Z.J. and Zhang, Y. and Mi, S.",
TITLE = "Assisting Multimodal Named Entity Recognition by cross-modal
auxiliary tasks",
JOURNAL = PRL,
VOLUME = "175",
YEAR = "2023",
PAGES = "52-58",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249453"}
@article{bb254628,
AUTHOR = "Li, Z.X. and Zhao, W.Z. and Du, X.Y. and Zhou, G.Y. and Zhang, S.L.",
TITLE = "Cross-Modal Retrieval and Semantic Refinement for Remote Sensing
Image Captioning",
JOURNAL = RS,
VOLUME = "16",
YEAR = "2024",
NUMBER = "1",
PAGES = "xx-yy",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249454"}
@article{bb254629,
AUTHOR = "Xu, R.Q. and Mayer, W. and Chu, H.L. and Zhang, Y. and Zhang, H.Y. and Wang, Y.L. and Liu, Y. and Feng, Z.",
TITLE = "Automatic semantic modeling of structured data sources with
cross-modal retrieval",
JOURNAL = PRL,
VOLUME = "177",
YEAR = "2024",
PAGES = "7-14",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249455"}
@article{bb254630,
AUTHOR = "Okamura, D. and Harakawa, R. and Iwahashi, M.",
TITLE = "LCNME: Label Correction Using Network Prediction Based on
Memorization Effects for Cross-Modal Retrieval With Noisy Labels",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "1",
MONTH = "January",
PAGES = "590-602",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249456"}
@article{bb254631,
AUTHOR = "Zhang, L. and Chen, L. and Zhou, C. and Li, X. and Yang, F. and Yi, Z.",
TITLE = "Weighted Graph-Structured Semantics Constraint Network for
Cross-Modal Retrieval",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "1551-1564",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249457"}
@article{bb254632,
AUTHOR = "Wang, Y.B. and Wang, S.H. and Luo, H. and Dong, J.F. and Wang, F. and Han, M. and Wang, X. and Wang, M.",
TITLE = "Dual-View Curricular Optimal Transport for Cross-Lingual Cross-Modal
Retrieval",
JOURNAL = IP,
VOLUME = "33",
YEAR = "2024",
PAGES = "1522-1533",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249458"}
@article{bb254633,
AUTHOR = "Zhang, H. and Li, Y.D. and Li, X.L.",
TITLE = "Constrained Bipartite Graph Learning for Imbalanced Multi-Modal
Retrieval",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "4502-4514",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249459"}
@article{bb254634,
AUTHOR = "Wang, Z. and Xu, X. and Wei, J. and Xie, N. and Yang, Y. and Shen, H.T.",
TITLE = "Semantics Disentangling for Cross-Modal Retrieval",
JOURNAL = IP,
VOLUME = "33",
YEAR = "2024",
PAGES = "2226-2237",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249460"}
@article{bb254635,
AUTHOR = "Ma, X.R. and Yang, M.X. and Li, Y.F. and Hu, P. and Lv, J.C. and Peng, X.",
TITLE = "Cross-Modal Retrieval With Noisy Correspondence via Consistency
Refining and Mining",
JOURNAL = IP,
VOLUME = "33",
YEAR = "2024",
PAGES = "2587-2598",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249461"}
@article{bb254636,
AUTHOR = "Liu, X.L. and Pu, R.T. and Sun, Y. and Chen, Y.K. and Huang, S.D. and Peng, D.Z. and Sang, Y.S. and Wang, Z.M.",
TITLE = "Optimal transport filtering for robust cross-modal retrieval with
open-set noisy labels",
JOURNAL = PR,
VOLUME = "178",
YEAR = "2026",
PAGES = "113377",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249462"}
@inproceedings{bb254637,
AUTHOR = "Feng, Y.L. and Zhu, H.Y. and Peng, D.Z. and Peng, X. and Hu, P.",
TITLE = "RONO: Robust Discriminative Learning with Noisy Labels for 2D-3D
Cross-Modal Retrieval",
BOOKTITLE = CVPR23,
YEAR = "2023",
PAGES = "11610-11619",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249463"}
@inproceedings{bb254638,
AUTHOR = "Hu, P. and Peng, X. and Zhu, H.Y. and Zhen, L.L. and Lin, J.",
TITLE = "Learning Cross-Modal Retrieval with Noisy Labels",
BOOKTITLE = CVPR21,
YEAR = "2021",
PAGES = "5399-5409",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249464"}
@article{bb254639,
AUTHOR = "Ji, Z. and Lin, Z.G. and Wang, H.R. and Pang, Y.W. and Li, X.L.",
TITLE = "Multi-task hierarchical convolutional network for visual-semantic
cross-modal retrieval",
JOURNAL = PR,
VOLUME = "151",
YEAR = "2024",
PAGES = "110398",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249465"}
@article{bb254640,
AUTHOR = "Ji, Z. and Li, Z.H. and Zhang, Y. and Pang, Y.W. and Li, X.L.",
TITLE = "Visual Semantic Contextualization Network for Multi-Query Image
Retrieval",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "7067-7080",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249466"}
@article{bb254641,
AUTHOR = "Pang, S.M. and Zeng, Y.Y. and Zhao, J.W. and Xue, J.R.",
TITLE = "A Mutually Textual and Visual Refinement Network for Image-Text
Matching",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "7555-7566",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249467"}
@article{bb254642,
AUTHOR = "Yang, D.K. and Kuang, H.P. and Yang, K. and Li, M.C. and Zhang, L.H.",
TITLE = "Towards Asynchronous Multimodal Signal Interaction and Fusion via
Tailored Transformers",
JOURNAL = SPLetters,
VOLUME = "31",
YEAR = "2024",
PAGES = "1550-1554",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249468"}
@article{bb254643,
AUTHOR = "Hou, Y.L. and Zhong, X.J. and Cao, H. and Zhu, Z. and Zhou, Y.F. and Zhang, J.",
TITLE = "A shared-private sentiment analysis approach based on cross-modal
information interaction",
JOURNAL = PRL,
VOLUME = "183",
YEAR = "2024",
PAGES = "140-146",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249469"}
@article{bb254644,
AUTHOR = "Chen, S.W. and Liu, S. and Liu, J.",
TITLE = "Type-Specific Modality Alignment for Multi-Modal Information
Extraction",
JOURNAL = SPLetters,
VOLUME = "31",
YEAR = "2024",
PAGES = "1525-1529",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249470"}
@article{bb254645,
AUTHOR = "Zheng, Z.Q. and Ren, H. and Wu, Y. and Zhang, W.C. and Lu, H. and Yang, Y. and Shen, H.T.",
TITLE = "Fully Unsupervised Domain-Agnostic Image Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "6",
MONTH = "June",
PAGES = "5077-5090",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249471"}
@article{bb254646,
AUTHOR = "Zhang, J.Z. and Wang, L. and Zheng, F.Z. and Wang, X. and Zhang, H.",
TITLE = "An Enhanced Feature Extraction Framework for Cross-Modal Image-Text
Retrieval",
JOURNAL = RS,
VOLUME = "16",
YEAR = "2024",
NUMBER = "12",
PAGES = "2201",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249472"}
@article{bb254647,
AUTHOR = "Cheng, Q.R. and Tan, Z.S. and Wen, K.Y. and Chen, C. and Gu, X.D.",
TITLE = "Semantic Pre-Alignment and Ranking Learning With Unified Framework
for Cross-Modal Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "7",
MONTH = "July",
PAGES = "6503-6516",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249473"}
@article{bb254648,
AUTHOR = "Xue, P. and Niu, S.",
TITLE = "A novel active contour model based on features for image segmentation",
JOURNAL = PR,
VOLUME = "155",
YEAR = "2024",
PAGES = "110673",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249474"}
@article{bb254649,
AUTHOR = "Yan, J. and Deng, C. and Huang, H. and Liu, W.",
TITLE = "Causality-Invariant Interactive Mining for Cross-Modal Similarity
Learning",
JOURNAL = PAMI,
VOLUME = "46",
YEAR = "2024",
NUMBER = "9",
MONTH = "September",
PAGES = "6216-6230",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249475"}
@article{bb254650,
AUTHOR = "Wu, W.J. and Zhao, Y.Z. and Li, Z. and Li, J.H. and Zhou, H. and Shou, M.Z. and Bai, X.",
TITLE = "A large cross-modal video retrieval dataset with reading
comprehension",
JOURNAL = PR,
VOLUME = "157",
YEAR = "2025",
PAGES = "110818",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249476"}
@article{bb254651,
AUTHOR = "Yuan, Z. and Wu, D. and Zhou, L.",
TITLE = "Achieving the Optimum Rate for Cross-Modal Source Coding",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "9722-9735",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249477"}
@article{bb254652,
AUTHOR = "Chen, R. and Tan, J.P. and Yang, Z.J. and Yang, X.J. and Dai, Q.Y. and Cheng, Y.Q. and Lin, L.",
TITLE = "DPHANet: Discriminative Parallel and Hierarchical Attention Network
for Natural Language Video Localization",
JOURNAL = MultMed,
VOLUME = "26",
YEAR = "2024",
PAGES = "9575-9590",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249478"}
@article{bb254653,
AUTHOR = "Zheng, A. and Yuan, F. and Zhang, H.C. and Wang, J.X. and Tang, C. and Li, C.L.",
TITLE = "Public-Private Attributes-Based Variational Adversarial Network for
Audio-Visual Cross-Modal Matching",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "9",
MONTH = "September",
PAGES = "8698-8709",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249479"}
@article{bb254654,
AUTHOR = "Li, D. and Du, S.L.",
TITLE = "ContextMatcher: Detector-Free Feature Matching With Cross-Modality
Context",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "9",
MONTH = "September",
PAGES = "7922-7934",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249480"}
@article{bb254655,
AUTHOR = "Zhang, F. and Zhou, H. and Hua, X.S. and Chen, C. and Luo, X.",
TITLE = "HOPE: A Hierarchical Perspective for Semi-Supervised 2D-3D
Cross-Modal Retrieval",
JOURNAL = PAMI,
VOLUME = "46",
YEAR = "2024",
NUMBER = "12",
MONTH = "December",
PAGES = "8976-8993",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249481"}
@article{bb254656,
AUTHOR = "Zhu, Y. and Wu, Y. and Sebe, N. and Yan, Y.",
TITLE = "Vision + X: A Survey on Multimodal Learning in the Light of Data",
JOURNAL = PAMI,
VOLUME = "46",
YEAR = "2024",
NUMBER = "12",
MONTH = "December",
PAGES = "9102-9122",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249482"}
@article{bb254657,
AUTHOR = "Li, Z. and Guo, C. and Wang, X. and Zhang, H. and Hu, L.",
TITLE = "Multi-View Visual Semantic Embedding for Cross-Modal Image-Text
Retrieval",
JOURNAL = PR,
VOLUME = "159",
YEAR = "2025",
PAGES = "111088",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249483"}
@article{bb254658,
AUTHOR = "Jin, M. and Hu, W.B. and Zhu, L. and Wang, X. and Hong, R.C.",
TITLE = "Based on Spatial and Temporal Implicit Semantic Relational Inference
for Cross-Modal Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "34",
YEAR = "2024",
NUMBER = "11",
MONTH = "November",
PAGES = "11286-11298",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249484"}
@article{bb254659,
AUTHOR = "Croitoru, I. and Bogolin, S.V. and Leordeanu, M. and Jin, H.L. and Zisserman, A. and Liu, Y. and Albanie, S.",
TITLE = "TeachText: CrossModal text-video retrieval through generalized
distillation",
JOURNAL = AI,
VOLUME = "338",
YEAR = "2025",
PAGES = "104235",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249485"}
@inproceedings{bb254660,
AUTHOR = "Croitoru, I. and Bogolin, S.V. and Leordeanu, M. and Jin, H.L. and Zisserman, A. and Albanie, S. and Liu, Y.",
TITLE = "TeachText:
CrossModal Generalized Distillation for Text-Video Retrieval",
BOOKTITLE = ICCV21,
YEAR = "2021",
PAGES = "11563-11573",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249486"}
@article{bb254661,
AUTHOR = "Wang, T.S. and Li, F.L. and Zhu, L. and Li, J.J. and Zhang, Z. and Shen, H.T.",
TITLE = "Cross-Modal Retrieval: A Systematic Review of Methods and Future
Directions",
JOURNAL = PIEEE,
VOLUME = "112",
YEAR = "2024",
NUMBER = "11",
MONTH = "November",
PAGES = "1716-1754",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249487"}
@article{bb254662,
AUTHOR = "Luo, J.Y. and Zhao, Y.S. and Luo, X. and Xiao, Z.P. and Ju, W. and Shen, L. and Tao, D.C. and Zhang, M.",
TITLE = "Cross-Domain Diffusion With Progressive Alignment for Efficient
Adaptive Retrieval",
JOURNAL = IP,
VOLUME = "34",
YEAR = "2025",
PAGES = "1820-1834",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249488"}
@article{bb254663,
AUTHOR = "Zhang, H.W. and Yang, Y. and Qi, F. and Qian, S.S. and Xu, C.S.",
TITLE = "Active Supervised Cross-Modal Retrieval",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "6",
MONTH = "June",
PAGES = "5112-5126",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249489"}
@article{bb254664,
AUTHOR = "Dang, Z.H. and Luo, M. and Wang, J.H. and Jia, C.Y. and Han, H.C. and Wan, H. and Dai, G. and Chang, X.J. and Wang, J.D.",
TITLE = "Disentangled Noisy Correspondence Learning",
JOURNAL = IP,
VOLUME = "34",
YEAR = "2025",
PAGES = "2602-2615",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249490"}
@article{bb254665,
AUTHOR = "Si, L. and Guo, C. and Li, Z. and Yang, Y.",
TITLE = "A unified framework of data augmentation using large language models
for text-based cross-modal retrieval",
JOURNAL = PR,
VOLUME = "167",
YEAR = "2025",
PAGES = "111755",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249491"}
@article{bb254666,
AUTHOR = "Jin, M. and Hu, W.B. and Hong, R.C. and Zhu, L.",
TITLE = "Revealing Security Flaws in Cross-Modal Retrieval Models Through
Video Poisoning",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "6",
MONTH = "June",
PAGES = "6184-6194",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249492"}
@article{bb254667,
AUTHOR = "Li, Y. and Deng, S. and Guan, C.M. and Gao, J.",
TITLE = "Complementary two-branch Transformer for multi-label image retrieval",
JOURNAL = PR,
VOLUME = "168",
YEAR = "2025",
PAGES = "111806",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249493"}
@article{bb254668,
AUTHOR = "Zheng, C.Y. and Li, X. and Liang, X.Y. and Huang, L. and Du, S. and Nie, J. and Dong, J.Y.",
TITLE = "Cross-Modal Progressive Perspective Matching Network for Remote
Sensing Image-Text Retrieval",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "3966-3978",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249494"}
@article{bb254669,
AUTHOR = "Pu, R.T. and Qin, Y. and Peng, D.Z. and Song, X.M. and Zheng, H.M.",
TITLE = "Deep Reversible Consistency Learning for Cross-Modal Retrieval",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "4095-4106",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249495"}
@article{bb254670,
AUTHOR = "Xu, Y. and Feng, Y.F. and Zhong, X. and Gao, Y. and Wu, Z.Z.",
TITLE = "Hypergraph-Based Remaining Prototype Alignment for Open-Set
Cross-Domain Image Retrieval",
JOURNAL = MultMed,
VOLUME = "27",
YEAR = "2025",
PAGES = "4627-4642",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249496"}
@article{bb254671,
AUTHOR = "Jiang, C. and Wang, Y.P. and Xiong, B.P.",
TITLE = "Dual similarity enhanced hybrid orthogonal fusion for multimodal
named entity recognition",
JOURNAL = PR,
VOLUME = "169",
YEAR = "2026",
PAGES = "111940",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249497"}
@article{bb254672,
AUTHOR = "Wang, Z. and Zhu, X.Z. and Yang, X. and Luo, G. and Li, H. and Tian, C.Y. and Dou, W.H. and Ge, J.Q. and Lu, L.W. and Qiao, Y. and Dai, J.F.",
TITLE = "Parameter-Inverted Image Pyramid Networks for Visual Perception and
Multimodal Understanding",
JOURNAL = PAMI,
VOLUME = "47",
YEAR = "2025",
NUMBER = "11",
MONTH = "November",
PAGES = "10142-10159",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249498"}
@article{bb254673,
AUTHOR = "Jin, M. and Zhu, L. and Hong, R.C.",
TITLE = "BiSeR-LMA: A Bidirectional Semantic Reasoning and Large Model
Enhancement Approach for Text-Video Cross-Modal Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "11",
MONTH = "November",
PAGES = "11655-11666",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249499"}
@article{bb254674,
AUTHOR = "Jin, M. and Zhang, H.X. and Zhu, L. and Sun, J. and Liu, L.",
TITLE = "Video and text semantic center alignment for text-video cross-modal
retrieval",
JOURNAL = SP:IC,
VOLUME = "140",
YEAR = "2026",
PAGES = "117413",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249500"}
@article{bb254675,
AUTHOR = "Li, F.L. and Wang, Z.Q. and Wang, T.S. and Zhu, L. and Chang, X.J.",
TITLE = "Generative Augmentation Hashing for Few-Shot Cross-Modal Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "12",
MONTH = "December",
PAGES = "12861-12873",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249501"}
@article{bb254676,
AUTHOR = "Gu, L.C. and Shen, X.J. and Sun, J. and Liu, Y. and Li, J. and Li, Z.H. and Cheung, S.C.S. and Wan, W.B.",
TITLE = "Dual Prototypes-Based Personalized Federated Adversarial Cross-Modal
Hashing",
JOURNAL = CirSysVideo,
VOLUME = "35",
YEAR = "2025",
NUMBER = "12",
MONTH = "December",
PAGES = "12846-12860",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249502"}
@article{bb254677,
AUTHOR = "Ma, Q. and Jiang, Y. and Bai, C.",
TITLE = "Boundary mutual information hashing for cross-modal retrieval",
JOURNAL = PR,
VOLUME = "172",
YEAR = "2026",
PAGES = "112658",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249503"}
@article{bb254678,
AUTHOR = "Wei, Y.H. and An, J.F.",
TITLE = "Flexible Dual Multi-Modal Hashing for Incomplete Multi-Modal Retrieval",
JOURNAL = IJIG,
VOLUME = "26",
YEAR = "2026",
NUMBER = "3",
MONTH = "May",
PAGES = "2650021",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249504"}
@article{bb254679,
AUTHOR = "Debnath, A. and Rao, K.S. and Das, P.P.",
TITLE = "Multi-Similarity Checking-Based Spoken Content Video Retrieval Using
Enhanced Mayfly Optimization-Based Weighted Feature Selection",
JOURNAL = IJIG,
VOLUME = "26",
YEAR = "2026",
NUMBER = "3",
MONTH = "May",
PAGES = "2650017",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249505"}
@article{bb254680,
AUTHOR = "Tang, L. and Wang, L. and Wang, G. and Sun, M.Y. and Yan, F.",
TITLE = "Feature Fusion Mamba Hashing via Decoupling for Cross-Modal Retrieval",
JOURNAL = SPLetters,
VOLUME = "33",
YEAR = "2026",
PAGES = "609-613",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249506"}
@article{bb254681,
AUTHOR = "Tan, W.T. and Li, F.L. and Zhu, L. and Guan, W. and Li, J.J. and Cheng, Z.Y. and Shen, H.T.",
TITLE = "Dynamic Bit-Wise Semantic Transformer Hashing for Multi-Modal
Retrieval",
JOURNAL = PAMI,
VOLUME = "48",
YEAR = "2026",
NUMBER = "3",
MONTH = "March",
PAGES = "2954-2969",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249507"}
@article{bb254682,
AUTHOR = "Li, H.F. and Zhao, J. and Zhang, Y.F. and Wen, J.",
TITLE = "Bidirectional Cross-Modal Collaborative Alignment via Semantic-Guided
Visual Embeddings for Partially Relevant Video Retrieval",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "1423-1435",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249508"}
@article{bb254683,
AUTHOR = "Jin, M. and Hong, R.C.",
TITLE = "MDA-MAA: A Collaborative Augmentation Approach for Generalizing
Cross-Domain Retrieval",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "1595-1606",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249509"}
@article{bb254684,
AUTHOR = "Ibrahim, M.I.M.A. and Niu, D. and Cai, T. and Li, L. and Ahmad, B.",
TITLE = "DSAC-Hash: Distribution-Similarity-Aware Cross-modal Hashing",
JOURNAL = IVC,
VOLUME = "168",
YEAR = "2026",
PAGES = "105926",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249510"}
@article{bb254685,
AUTHOR = "Shu, X. and Guo, Y.K. and Ren, S.G.",
TITLE = "Adversarial supervised contrastive feature learning for cross-modal
retrieval",
JOURNAL = PR,
VOLUME = "176",
YEAR = "2026",
PAGES = "113256",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249511"}
@article{bb254686,
AUTHOR = "Shu, Z.Q. and Zhang, J. and Yu, Z.T.",
TITLE = "Adaptive centroid guided hashing for cross-modal retrieval",
JOURNAL = PR,
VOLUME = "176",
YEAR = "2026",
PAGES = "113186",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249512"}
@article{bb254687,
AUTHOR = "Shi, D. and Li, Z.C. and Zhu, L. and Tang, J.H.",
TITLE = "Pseudo-Text Guided Robust Learning for Noisy Correspondence in
Cross-Modal Retrieval",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "3299-3310",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249513"}
@article{bb254688,
AUTHOR = "Li, F.L. and Liu, W.H. and Wang, T.S. and Zhu, L. and Chang, X.J.",
TITLE = "PIC-CMH: Efficient Prompt-Infused Continual Cross-Modal Hashing",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "2654-2667",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249514"}
@article{bb254689,
AUTHOR = "Liu, W.H. and Wang, T.S. and Li, F.L. and Li, J.J. and Zhu, L.",
TITLE = "Prompt-Driven Bit Extension Hashing for Continual Cross-Modal
Retrieval",
JOURNAL = CirSysVideo,
VOLUME = "36",
YEAR = "2026",
NUMBER = "5",
MONTH = "May",
PAGES = "7125-7139",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249515"}
@article{bb254690,
AUTHOR = "Li, B. and Li, Z.X.",
TITLE = "Causality-Inspired Graph Neural Networks for Cross-Modal Retrieval",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "2497-2509",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249516"}
@article{bb254691,
AUTHOR = "Peng, J.T. and Xiang, X. and Qin, J. and Tan, Y.",
TITLE = "PPDSA: Privacy-Preserving Cross-Modal Retrieval With Disentangled
Soft-Label Alignment",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "2643-2653",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249517"}
@article{bb254692,
AUTHOR = "Gao, L. and Wang, Z. and Wang, X.Z. and Zheng, Z. and Yang, M.Z.",
TITLE = "Semantic similarity guided contrastive hashing for unsupervised
cross-modal retrieval",
JOURNAL = JVCIR,
VOLUME = "117",
YEAR = "2026",
PAGES = "104747",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249518"}
@article{bb254693,
AUTHOR = "Guo, J. and Wang, W.W. and Jing, H.Y. and Song, B. and Wang, M.H.",
TITLE = "TextBridge: A Text-Centered Framework for Enhanced Multimodal
Integration and Retrieval",
JOURNAL = MultMed,
VOLUME = "28",
YEAR = "2026",
PAGES = "3781-3791",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249519"}
@article{bb254694,
AUTHOR = "Fang, J. and Zhu, D.",
TITLE = "An Efficient Remote Sensing Cross-Modal Retrieval Method Based on
Hashing Contrastive Learning",
JOURNAL = RS,
VOLUME = "18",
YEAR = "2026",
NUMBER = "10",
PAGES = "1630",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249520"}
@article{bb254695,
AUTHOR = "Chen, D. and Wang, Y.T. and Xie, Y.Z. and Tan, X. and Li, X. and Tang, M. and Fang, M. and Zhang, W.",
TITLE = "F3-SD: Focal feature fusion with self-distillation on large
vision-language models for cross-modal retrieval",
JOURNAL = PR,
VOLUME = "179",
YEAR = "2026",
PAGES = "113664",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249521"}
@article{bb254696,
AUTHOR = "Huang, Q.H. and Lu, J.H. and Wu, F. and Peng, G.C. and Gao, G.W. and Jing, X.Y.",
TITLE = "Cross-modal hashing under the federated learning framework",
JOURNAL = JVCIR,
VOLUME = "118",
YEAR = "2026",
PAGES = "104833",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249522"}
@article{bb254697,
AUTHOR = "Li, Z.X. and Hu, Y.P. and Chen, Z.W. and Wen, H. and Song, X.M. and Nie, L.Q.",
TITLE = "COMBINER: Composed Image Retrieval Guided by Attribute-Based Neighbor
Relations",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "5377-5392",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249523"}
@article{bb254698,
AUTHOR = "Pu, R.T. and Su, C. and Hu, P. and Ren, Z.W. and Peng, D.Z. and Sun, Y.",
TITLE = "NOTO: Noise-Tolerate Evidential Learning for Open-Set Cross-Modal
Retrieval",
JOURNAL = IP,
VOLUME = "35",
YEAR = "2026",
PAGES = "6237-6247",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249524"}
@article{bb254699,
AUTHOR = "Sun, S.T. and Li, Q. and Gong, S.G. and Cai, W.T. and Torr, P. and Gu, J.D.",
TITLE = "BenchCIR: Benchmarking robustness in composed image retrieval across
modalities",
JOURNAL = PR,
VOLUME = "179",
YEAR = "2026",
PAGES = "113724",
BIBSOURCE = "http://www.visionbib.com/bibliography/applicat830cm1.html#TT249525"}
Last update:Aug 19, 2026 at 13:26:35