# 多模态算法岗面试路线 > 路线定位:面向视觉语言模型、多模态对齐、图文理解和多模态生成岗位。重点是把模态编码、融合、训练和评测讲成一条线。 [返回热门AI学习核心课程与教程总览](README.md) | [返回项目主页](../README.md) ## 先抓主线 多模态岗位不是“会几个模型名字”,而是要能回答:图像、视频、文本分别怎么表示,如何对齐,如何训练,如何评测,如何落到业务里。 ## 推荐顺序 1. 先看多模态总入口和理论知识。 2. 再看编码器、映射器和主流模型。 3. 最后把图像、视频和训练评测串成面试表达。 ## 核心跳转 - [AI 多模态基础总入口](<../AI多模态基础/README.md>) - [多模态基础总页](<../AI多模态基础/AI多模态基础.md>) - [多模态理论知识](<../AI多模态基础/多模态-理论知识.md>) - [多模态核心模型](<../AI多模态基础/多模态-核心模型.md>) - [模态编码器](<../AI多模态基础/多模态-模态编码器.md>) - [输入映射器](<../AI多模态基础/多模态-输入映射器.md>) - [输出映射器](<../AI多模态基础/多模态-输出映射器.md>) - [多模态训练与微调](<../AI多模态基础/多模态-训练与微调.md>) - [Qwen-VL 系列模型核心考点](<../AI多模态基础/Qwen-VL系列模型核心考点.md>) - [Intern-VL 系列模型核心考点](<../AI多模态基础/Intern-VL系列模型核心考点.md>) - [GLM-V 系列模型核心考点](<../AI多模态基础/GLM-V系列模型核心考点.md>) - [AIGC 图像创作 & AI 绘画基础总入口](<../AIGC图像创作&AI绘画基础/README.md>) - [AI 视频基础总入口](<../AI视频基础/readme.md>) ## 本页产出 - 一张多模态系统图。 - 10 道主流多模态题的口述答案。 - 一个能讲清训练与评测边界的项目说明。 ## 验收清单 - [ ] 我能解释输入映射器和输出映射器各自解决什么问题。 - [ ] 我能区分图像理解、图文检索、视频理解和多模态生成。 - [ ] 我能把多模态系统讲成可落地方案,而不是模型名清单。 [返回热门AI学习核心课程与教程总览](README.md) | [返回项目主页](../README.md)