GitHub 雷达
首次出现 67 天前

facebookresearch/segment-anything

Segment Anything Model (SAM) 是一个基础模型,用于解决通过输入提示(如点或框)在图像中生成高质量对象掩码的问题,并能自动分割图像中的所有对象。 主要技术栈基于 PyTorch 和 TorchVision,采用 Transformer 架构,并提供了预训练模型检查点、ONNX 导出支持以及用于推理的 Python 代码和 Jupyter Notebook 示例。 其亮点在于拥有强大的零样本分割能力,适用于广泛的视觉任务和领域,并且新发布的 SAM 2 版本进一步扩展到了视频实时分割,同时提供了最大的视频分割数据集 SA-V。

近 7 日
+39
累计 Star
54.9k
Fork
6,378
近 30 日
+163
Star 趋势 · 50 个采集点
+1%
7 月 28 日9 月 21 日
语言Jupyter Notebook
分类AI/机器学习
最近提交9 月 19 日
创建时间3 月 24 日
首次收录7 月 28 日 · 自动扫描
README 摘要
Segment Anything Model (SAM) 是一个基础模型,用于解决通过输入提示(如点或框)在图像中生成高质量对象掩码的问题,并能自动分割图像中的所有对象。 主要技术栈基于 PyTorch 和 TorchVision,采用 Transformer 架构,并提供了预训练模型检查点、ONNX 导出支持以及用于推理的 Python 代码和 Jupyter Notebook 示例。 其亮点在于拥有强大的零样本分割能力,适用于广泛的视觉任务和领域,并且新发布的 SAM 2 版本进一步扩展到了视频实时分割,同时提供了最大的视频分割数据集 SA-V。
中文摘要由 AI 生成,仅供参考。
在 GitHub 打开