suno-ai/bark
Bark 是 Suno 开源的一个基于 Transformer 架构的文本到音频生成模型,能够根据文本提示生成高度逼真的多语言语音、音乐、背景噪音和简单音效,甚至包括笑声、叹息和哭泣等非语言表达。它主要使用 Jupyter Notebook 和 Python 实现,通过预训练模型检查点直接进行推理,支持自动识别输入文本语言并生成对应口音。该模型的亮点是支持多语言和多种音频类型生成,已获得 MIT 许可可用于商业用途,并提供低显存 GPU 运行选项和社区语音提示库,适合研究、创意音频制作和需要快速生成多样化音频的场景。
suno-ai/bark
67 天前首次出现未被群岛收录Bark 是 Suno 开源的一个基于 Transformer 架构的文本到音频生成模型,能够根据文本提示生成高度逼真的多语言语音、音乐、背景噪音和简单音效,甚至包括笑声、叹息和哭泣等非语言表达。它主要使用 Jupyter Notebook 和 Python 实现,通过预训练模型检查点直接进行推理,支持自动识别输入文本语言并生成对应口音。该模型的亮点是支持多语言和多种音频类型生成,已获得 MIT 许可可用于商业用途,并提供低显存 GPU 运行选项和社区语音提示库,适合研究、创意音频制作和需要快速生成多样化音频的场景。
Star 趋势
共 50 个采集点 · 近 30 日 +29项目介绍
由 AI 摘自仓库 READMEBark 是 Suno 开源的一个基于 Transformer 架构的文本到音频生成模型,能够根据文本提示生成高度逼真的多语言语音、音乐、背景噪音和简单音效,甚至包括笑声、叹息和哭泣等非语言表达。它主要使用 Jupyter Notebook 和 Python 实现,通过预训练模型检查点直接进行推理,支持自动识别输入文本语言并生成对应口音。该模型的亮点是支持多语言和多种音频类型生成,已获得 MIT 许可可用于商业用途,并提供低显存 GPU 运行选项和社区语音提示库,适合研究、创意音频制作和需要快速生成多样化音频的场景。
仓库信息
该项目由雷达自动扫描 GitHub 发现,含 Star 增速、提交活跃度与分类标签,中文摘要由 AI 生成。