图像与视频理解
识别图片视频里有什么:分类、检测、分割、OCR
数据截至 9/1 06:19(构建快照,正在获取最新)
业务价值识别图片和视频中的对象、文字与场景
更适合质检、内容审核、文档处理和媒体团队
投入提醒需要准备真实样本验证识别准确率
以下项目优先展示近期仍在维护的条目。进入详情页继续核对中文解读、许可和官方来源。
- 1
- 2
ultralytics 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估AGPL-3.0 · 注意开源义务 - 3
- 4
supervision 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估MIT · 可评估商用 - 5
paperless-ngx 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估GPL-3.0 · 注意开源义务 - 6
- 7
label-studio 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估Apache-2.0 · 可评估商用 - 8
vit-pytorch 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估MIT · 可评估商用 - 9
- 10
unstructured 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估Apache-2.0 · 可评估商用 - 11
pytorch-grad-cam 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估MIT · 可评估商用 - 12
segmentation_models.pytorch 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估MIT · 可评估商用 - 13
- 14
X-AnyLabeling 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估GPL-3.0 · 注意开源义务 - 15
techniques 属于图像与视频理解方向,主要用于识别图片和视频中的对象、文字与场景。
质检、内容审核、文档处理和媒体团队上手门槛:需评估Apache-2.0 · 可评估商用 - 16
- 17
另有 24 个项目因近期无提交或缺少数据未列入。