# 多模态算法岗 30 天复习路线 > 路线定位:面向准备多模态算法岗、视觉语言模型岗位、图文理解与多模态生成岗位的候选人。建议 30 天完成一轮“基础主干 + 典型模型 + 面试表达”冲刺。 [返回热门AI学习核心课程与教程总览](README.md) | [返回项目主页](../README.md) ## 这条路线怎么学 多模态面试的关键不是把模型名记全,而是把**模态编码、对齐、融合、生成、评测**这五步讲清楚。先学共同骨架,再把图像、视频和主流 VLM 串起来。 ## 推荐顺序 1. 先看多模态总入口,理解整个领域怎么拆分。 2. 再学模态编码器、输入映射器和输出映射器,弄清图像/文本/视频为什么能进同一套系统。 3. 最后把图像生成、视频理解与多模态训练微调补齐,形成岗位表达。 ## 核心跳转 - [AI 多模态基础总入口](<../AI多模态基础/README.md>) - [多模态理论知识](<../AI多模态基础/多模态-理论知识.md>) - [多模态核心模型](<../AI多模态基础/多模态-核心模型.md>) - [模态编码器](<../AI多模态基础/多模态-模态编码器.md>) - [输入映射器](<../AI多模态基础/多模态-输入映射器.md>) - [输出映射器](<../AI多模态基础/多模态-输出映射器.md>) - [多模态训练与微调](<../AI多模态基础/多模态-训练与微调.md>) - [Qwen-VL 系列模型核心考点](<../AI多模态基础/Qwen-VL系列模型核心考点.md>) - [GLM-V 系列模型核心考点](<../AI多模态基础/GLM-V系列模型核心考点.md>) - [AI 视频基础总入口](<../AI视频基础/readme.md>) - [AIGC 图像创作 & AI 绘画基础总入口](<../AIGC图像创作&AI绘画基础/README.md>) - [Stable Diffusion 系列大模型基础](<../AIGC图像创作&AI绘画基础/01_Stable%20Diffusion系列大模型基础.md>) - [Stable Diffusion & FLUX 系列大模型基础](<../AIGC图像创作&AI绘画基础/02_Stable Diffusion&FLUX系列大模型基础.md>) ## 本页产出 - 画一张“图像 / 视频 / 文本如何进入同一多模态系统”的结构图。 - 准备 10 道多模态岗位高频问答的口述版答案。 - 选一个代表性模型,写清楚它是靠什么完成对齐、融合和生成的。 ## 验收清单 - [ ] 我能解释多模态里最核心的三个模块是什么。 - [ ] 我能区分图像生成、视频生成和视觉语言理解的侧重点。 - [ ] 我能把一个 VLM 的输入、对齐、解码和评测链路讲完整。 [返回热门AI学习核心课程与教程总览](README.md) | [返回项目主页](../README.md)