GitHub 雷达
首次出现 67 天前

CompVis/stable-diffusion

Stable Diffusion 是一个基于潜在扩散模型的文本生成图像模型,能将文字描述直接转化为高分辨率图片。 主要技术栈包括使用冻结的CLIP ViT-L/14文本编码器作为条件输入,结合860M参数的UNet和123M参数的文本编码器,在潜在空间中进行扩散生成。 其亮点在于模型相对轻量,可在至少10GB显存的GPU上运行,适用于创意设计、内容生成等需要从文本快速生成高质量图像的场景。

近 7 日
+34
累计 Star
73.5k
Fork
10,567
近 30 日
+124
Star 趋势 · 50 个采集点
+0%
7 月 28 日9 月 21 日
语言Jupyter Notebook
分类AI/机器学习
最近提交6 月 18 日
创建时间8 月 10 日
首次收录7 月 28 日 · 自动扫描
README 摘要
Stable Diffusion 是一个基于潜在扩散模型的文本生成图像模型,能将文字描述直接转化为高分辨率图片。 主要技术栈包括使用冻结的CLIP ViT-L/14文本编码器作为条件输入,结合860M参数的UNet和123M参数的文本编码器,在潜在空间中进行扩散生成。 其亮点在于模型相对轻量,可在至少10GB显存的GPU上运行,适用于创意设计、内容生成等需要从文本快速生成高质量图像的场景。
中文摘要由 AI 生成,仅供参考。
在 GitHub 打开