深度学习技术的引入使得多模态信息处理领域取得了巨大的突破。本书在介绍多模态信息处理的基础概念和典型任务的基础上,重点介绍 通用、 基础的基于深度学习的多模态信息处理技术。本书内容包括初识多模态信息处理、单模态深度学习表示技术、多模态深度学习基础技术、多模态预训练技术4部分:初识多模态信息处理部分介绍多模态信息处理的基础概念和典型任务;单模态深度学习表示技术部分介绍多模态深度学习模型中常用的文本表示和图像表示技术;多模态深度学习基础技术部分介绍多模态表示、对齐、融合和转换这4种技术;多模态预训练技术部分介绍多模态预训练技术。此外,为了让读者 好地理解理论的细节并实践这些多模态深度学习技术,本书提供了4个可运行的完整的实战案例,分别对应多模态表示、对齐、融合和转换这4种技术。本书既可作为多模态信息处理、多模态深度学习等相关课程的教学参考书,适用于高等院校智能科学与技术和人工智能等专业的本科生、研究生,同时可供为对多模态深度学习技术感兴趣的工程师和研究人员参考。