原文信息:
Doi: https://doi.org/10.1016/j.vrih.2024.08.002.
Keywords: Image caption; Causal inference; Fashion caption
Cite: Peng T, Yin W, Liu J, et al. Deconfounded fashion image captioning with transformer and multimodal retrieval[J]. Virtual Reality & Intelligent Hardware, 2025, 7(2): 127-138.
阅读下载全文:
https://www.sciencedirect.com/science/article/pii/S2096579624000494