Skip to content

Latest commit

 

History

History
174 lines (119 loc) · 5.42 KB

File metadata and controls

174 lines (119 loc) · 5.42 KB

yolov3_darknet53_pedestrian

模型名称 yolov3_darknet53_pedestrian
类别 图像 - 目标检测
网络 YOLOv3
数据集 百度自建大规模行人数据集
是否支持Fine-tuning
模型大小 238MB
最新更新日期 2021-03-15
数据指标 -

一、模型基本信息

  • 应用效果展示

    • 样例结果示例:


  • 模型介绍

    • 行人检测是计算机视觉技术中的目标检测问题,用于判断图像中是否存在行人并给予精确定位,定位结果用矩形框表示。行人检测技术有很强的使用价值,它可以与行人跟踪、行人重识别等技术结合,应用于汽车无人驾驶系统、智能视频监控、人体行为分析、客流统计系统、智能交通等领域。yolov3_darknet53_pedestrian Module的网络为YOLOv3, 其中backbone为DarkNet53, 采用百度自建大规模车辆数据集训练得到,目前仅支持预测。

二、安装

三、模型API预测

  • 1、命令行预测

    • $ hub run yolov3_darknet53_pedestrian --input_path "/PATH/TO/IMAGE"
    • 通过命令行方式实现行人检测模型的调用,更多请见 PaddleHub命令行指令
  • 2、预测代码示例

    • import paddlehub as hub
      import cv2
      
      pedestrian_detector = hub.Module(name="yolov3_darknet53_pedestrian")
      result = pedestrian_detector.object_detection(images=[cv2.imread('/PATH/TO/IMAGE')])
      # or
      # result = pedestrian_detector.object_detection(paths=['/PATH/TO/IMAGE'])
  • 3、API

    • def object_detection(paths=None,
                           images=None,
                           batch_size=1,
                           use_gpu=False,
                           output_dir='yolov3_pedestrian_detect_output',
                           score_thresh=0.2,
                           visualization=True)  
      • 预测API,检测输入图片中的所有行人的位置。

      • 参数

        • paths (list[str]): 图片的路径;
        • images (list[numpy.ndarray]): 图片数据,ndarray.shape 为 [H, W, C],BGR格式;
        • batch_size (int): batch 的大小;
        • use_gpu (bool): 是否使用 GPU;
        • output_dir (str): 图片的保存路径,默认设为 yolov3_pedestrian_detect_output;
        • score_thresh (float): 识别置信度的阈值;
        • visualization (bool): 是否将识别结果保存为图片文件。

        NOTE: paths和images两个参数选择其一进行提供数据

      • 返回

        • res (list[dict]): 识别结果的列表,列表中每一个元素为 dict,各字段为:
          • data (list): 检测结果,list的每一个元素为 dict,各字段为:
            • confidence (float): 识别的置信度
            • label (str): 标签
            • left (int): 边界框的左上角x坐标
            • top (int): 边界框的左上角y坐标
            • right (int): 边界框的右下角x坐标
            • bottom (int): 边界框的右下角y坐标
          • save_path (str, optional): 识别结果的保存路径 (仅当visualization=True时存在)
    • def save_inference_model(dirname)
      • 将模型保存到指定路径。

      • 参数

        • dirname: 模型保存路径

四、服务部署

  • PaddleHub Serving可以部署一个行人检测的在线服务。

  • 第一步:启动PaddleHub Serving

    • 运行启动命令:

    • $ hub serving start -m yolov3_darknet53_pedestrian
    • 这样就完成了一个行人检测的服务化API的部署,默认端口号为8866。

    • NOTE: 如使用GPU预测,则需要在启动服务之前,请设置CUDA_VISIBLE_DEVICES环境变量,否则不用设置。

  • 第二步:发送预测请求

    • 配置好服务端,以下数行代码即可实现发送预测请求,获取预测结果

    • import requests
      import json
      import cv2
      import base64
      
      
      def cv2_to_base64(image):
        data = cv2.imencode('.jpg', image)[1]
        return base64.b64encode(data.tostring()).decode('utf8')
      
      # 发送HTTP请求
      data = {'images':[cv2_to_base64(cv2.imread("/PATH/TO/IMAGE"))]}
      headers = {"Content-type": "application/json"}
      url = "http://127.0.0.1:8866/predict/yolov3_darknet53_pedestrian"
      r = requests.post(url=url, headers=headers, data=json.dumps(data))
      
      # 打印预测结果
      print(r.json()["results"])

五、更新历史

  • 1.0.0

    初始发布

  • 1.0.2

    修复numpy数据读取问题

  • 1.0.3

    移除 fluid api

  • 1.1.0

    修复推理模型无法导出的问题

    • $ hub install yolov3_darknet53_pedestrian==1.1.0