Commit 6409ff87 by 赵润松

第五讲:多模态机器学习与生成式人工智能(框架+图像部分)

按组长大纲与第五部分PDF搭建第五讲整体结构,拆分为 chapters/ch5_multimodal.tex 由主文件引入:
- 5.1 表示学习与跨模态对齐:单模态编码、自监督预训练、跨模态对齐(含CLIP InfoNCE损失)、跨模态融合
- 5.2 基础模型结构与训练:通用结构、视觉语言模型、指令微调、图像-语音-文本联合建模
- 5.3 条件生成建模:条件生成基础、文生图(扩散+CFG公式)、图像编辑、跨模态交互生成
- 全程以机器学习问题为主线,图像内容写实,语音/音频小节用 \todochen 占位待陈丹补充
XeLaTeX 编译通过。
parent f136e8b3
...@@ -121,6 +121,11 @@ ...@@ -121,6 +121,11 @@
\newcommand{\blankline}{\par\noindent\rule{\linewidth}{0.4pt}\par} \newcommand{\blankline}{\par\noindent\rule{\linewidth}{0.4pt}\par}
\newcommand{\keyword}[1]{\textbf{\color{CourseBlue}#1}} \newcommand{\keyword}[1]{\textbf{\color{CourseBlue}#1}}
% 协作占位:标记"待陈丹补充(语音/音频部分)"的内容,便于后续合并时定位
\newcommand{\todochen}[1]{%
\par\noindent
{\color{CourseGold}\small$\blacktriangleright$\ \textbf{[待陈丹补充 ·\ 语音/音频]}\ #1}\par}
\begin{document} \begin{document}
% 封面 % 封面
...@@ -278,6 +283,14 @@ ...@@ -278,6 +283,14 @@
\bottomrule \bottomrule
\end{longtable} \end{longtable}
% ============================================================
% 第五部分 多模态机器学习与生成式人工智能(润松负责:框架 + 图像内容)
% 内容本身定位为课程"第五部分",因此把章节计数器对齐到"第五讲"。
% 语音/音频小节由陈丹补充(见文中 \todochen 占位标记)。
% ============================================================
\setcounter{chapter}{4}
\include{chapters/ch5_multimodal}
\appendix \appendix
\chapter{附录} \chapter{附录}
......
Markdown 格式
0%
您添加了 0 到此讨论。请谨慎行事。
请先完成此评论的编辑!
注册 或者 后发表评论