AI 学习站 · 第七阶 L7

AIGC 创作:文生图与文生视频

从一张噪声,到一只猫、到一段会动的视频。本阶用纯中文讲透扩散模型、CLIP、Stable Diffusion、提示词与 ControlNet,并带你亲手玩三个浏览器内演示。

已学 0 / 10 章 · 进度自动保存
10 章学习路线图
三个交互演示(浏览器内运行)
① 扩散去噪可视化台
② CLIP 文本-图像匹配台
③ 提示词风格对比台

扩散去噪可视化台

看一张图如何被逐步「加噪」成雪花,再从纯噪声逐步「去噪」还原(用简化模拟)。这正是扩散模型生成图像的核心过程。
点击「播放」,观察从噪点逐步显影出目标图像。

CLIP 文本-图像匹配台

输入一句话,看系统如何给每张候选图打分、排序——直观感受「文字向量怎么衡量图像相关性」(此处用关键词匹配简化模拟 CLIP 的语义对齐)。

提示词风格对比台

输入提示词,看它如何匹配不同「风格预设」(写实 / 动漫 / 油画 / 像素)。同一主体,不同风格词会触发完全不同的画面——这就是风格词在交叉注意力里的作用。
← 返回路线图 ✕ 关闭