机器学习框架ML.NET学习笔记【8】目标检测（采用YOLO2模型）

2019-06-04 08:54:00

一个通过TinyYolo2模型实现目标检测的例子。

一、概述

本篇文章介绍通过YOLO模型进行目标识别的应用，原始代码来源于：https://github.com/dotnet/machinelearning-samples

实现的功能是输入一张图片，对图片中的目标进行识别，输出结果在图片中通过红色框线标记出来。如下：

YOLO简介

YOLO（You Only Look Once）是一种最先进的实时目标检测系统。官方网站：https://pjreddie.com/darknet/yolo/

本文采用的是TinyYolo2模型，可以识别的目标类型包括："aeroplane", "bicycle", "bird", "boat", "bottle","bus", "car", "cat", "chair", "cow","diningtable", "dog", "horse", "motorbike", "person","pottedplant", "sheep", "sofa", "train", "tvmonitor" 。

ONNX简介

ONNX 即Open Neural Network Exchange（开放神经网络交换格式），是一个用于表示深度学习模型的通用标准，可使模型在不同框架之间进行互相访问，其规范及代码主要由微软，亚马逊，Facebook 和 IBM 等公司共同制定与开发。有了ONNX标准，我们就可以在ML.NET代码中使用通过其他机器学习框架训练并保存的模型。

二、代码分析

1、Main方法

第一次运行时需要运行TrainAndSave方法，生成本地模型后，可以直接运行生产代码。

2、训练并保存模型

ImageNetData类定义如下：

tags.tsv文件中仅包含一条样本数据，因为模型已经训练好，不存在再次训练的意义。这里只要放一张图片样本即可，通过Fit方法建立数据处理通道模型。

ApplyOnnxModel方法加载第三方ONNX模型，

其中，输入、输出的列名称是指定的。可以通过安装Netron这样的工具来查询ONNX文件的详细信息，可以看到输入输出的数据列名称。

输出的“grid”列数据是一个float数组，不能直接理解其含义，所以需要通过代码将其数据转换为便于理解的格式。

YoloWinMlParser.ParseOutputs方法将float数组转为YoloBoundingBox对象的列表，第二个参数是可信度阙值，只输出大于该可信度的数据。

YoloBoundingBox类定义如下：

其中：Label为目标类型，Confidence为可行程度。

由于YOLO的特点导致对同一个目标会输出多个同样的检测结果，所以还需要对检测结果进行过滤，去掉那些高度重合的结果。

YoloWinMlParser.NonMaxSuppress第二个参数表示最多保留多少个结果，第三个参数表示重合率阙值，将去掉重合率大于该值的记录。

四、资源获取

源码下载地址：https://github.com/seabluescn/Study_ML.NET

工程名称：YOLO_ObjectDetection

资源获取：https://gitee.com/seabluescn/ML_Assets （ObjectDetection）

点击查看机器学习框架ML.NET学习笔记系列文章目录

签名区：

如果您觉得这篇博客对您有帮助或启发，请点击右侧【推荐】支持，谢谢！

机器学习框架ML.NET学习笔记【8】目标检测（采用YOLO2模型）

继续阅读

简单文档分类——朴素贝叶斯算法朴素贝叶斯算法简单文档分类实例步骤总结朴素贝叶斯分类调用(sklearn)

【分类算法】什么是分类算法定义分类与聚类分类过程方法

分类算法的评价指标

K-近邻算法以及图像分类应用

weka之NB算法

使用weka的select attribute

weka中分类器算法

在weka中集成自己的算法

【多变量线性回归】学习记录序思路实现终

申请评分模型拒绝推断（RI）方法申请评分模型拒绝推断（RI）方法

【人工智能行业大师访谈1】吴恩达采访 Geoffery Hinton

【趋高机器视觉】机器视觉技术原理解析及解决方案

吴恩达 coursera ML 第七课总结+作业答案前言目录正文模型表示作业答案

XGBoost Plotting API以及GBDT组合特征实践 XGBoost Plotting API以及GBDT组合特征实践

解码器用于语义分割：数据依赖的解码可以实现灵活的特征聚合

2021-2025年中国运动疗法（KT）带行业市场供需与战略研究报告