位置: IT常识 - 正文

行人车辆检测与计数系统(Python+YOLOv5深度学习模型+清新界面)(行人检测技术)

编辑:rootadmin
行人车辆检测与计数系统(Python+YOLOv5深度学习模型+清新界面)

推荐整理分享行人车辆检测与计数系统(Python+YOLOv5深度学习模型+清新界面)(行人检测技术),希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:行人车辆检测与目标跟踪系统,行人检测系统,行人检测系统,行人检测的具体应用,行人检测原理,行人车辆检测与检测区别,行人检测的具体应用,行人车辆检测与目标跟踪系统,内容如对您有帮助,希望把文章链接给更多的朋友!

摘要:行人车辆检测与计数系统用于交通路口行人及车辆检测计数,道路人流量、车流量智能监测,方便记录、显示、查看和保存检测结果。本文详细介绍行人车辆检测,在介绍算法原理的同时,给出Python的实现代码、PyQt的UI界面以及训练数据集。在界面中可以选择各种行人车辆图片、视频进行检测识别与计数;可对图像中存在的多个目标进行识别分类。博文提供了完整的Python代码和使用教程,适合新入门的朋友参考,完整代码资源文件请转至文末的下载链接。本博文目录如下:

文章目录前言1. 效果演示2. 算法原理与数据集3. 行人车辆检测与计数系统下载链接结束语

➷点击跳转至文末所有涉及的完整代码文件下载页☇

行人车辆检测与计数系统演示与介绍(UI界面+YOLOv5+训练数据集)

前言

        行人车辆检测是近年来计算机视觉领域的研究热点,同时也是目标检测领域中的难点。其目的是识别和定位图像中存在的行人,在许多领域中都有广泛的应用。交通安全方面,无人驾驶汽车通过提前检测到行人及时避让来避免交通事故的发生;安防保护方面,通过行人检测来防止可疑人员进入;公共场所管理方面,通过行人和车辆检测统计人流量、车流量数据,优化人力物力等资源的分配。

        考虑对交通路口行人车辆的检测很多,前面博主也发布过实时车辆行人多目标检测与跟踪系统-上篇(UI界面清新版,Python代码)和基于深度学习的车辆检测系统(MATLAB代码,含GUI界面)等博文。近期我想到可以将模型识别到的行人、小汽车、卡车、自行车、公交、摩托车等进行计数统计,观测画面中各种类型车辆的数目。系统对于图片、视频和摄像头捕获的实时画面,检测画面中的行人及车辆并统计数目,系统支持结果记录、展示和保存,每次检测的结果记录在表格中,另外采用登录注册进行用户管理。对此这里给出博主设计的新款界面,以前都是浅色系背景,这回弄了个深色背景,功能也可以满足图片、视频和摄像头的识别检测,希望大家可以喜欢,初始界面如下图:

        检测类别时的界面截图(点击图片可放大)如下图,可识别画面中存在的多个类别并计数,也可开启摄像头或视频检测:

         详细的功能演示效果参见博主的B站视频或下一节的动图演示,觉得不错的朋友敬请点赞、关注加收藏!系统UI界面的设计工作量较大,界面美化更需仔细雕琢,大家有任何建议或意见和可在下方评论交流。

1. 效果演示

        系统界面设计上采用了许多美化技巧,首先我们还是通过动图看一下系统的效果,主要实现的功能是对图片、视频和摄像头画面中的行人车辆进行识别,识别的结果可视化显示在界面和图像中,另外提供多个行人车辆的显示选择功能,演示效果如下。

(一)系统介绍

        行人车辆检测与计数系统主要用于日常道路行人及车辆等目标的智能监测,对路口常见的目标包括行人、小汽车、卡车、公交、自行车、摩托车等目标进行计数,以方便对交通情况分析;系统提供登录注册功能,可进行用户管理;能够有效识别图片、视频等文件形式,检测目标位置、类别并统计各类别计数结果;可开启摄像头实时检测和统计路口行人车辆数目,支持结果记录、展示和保存。

(二)主要特点

         (1)YOLO v5算法实现,模型一键切换更新;          (2)检测图片、视频等图像中的各目标数目;          (3)摄像头监控实时检测,便携展示、记录和保存;          (4)支持用户登录、注册,检测结果可视化功能;          (5)提供数据集和训练代码可重新训练;

(三)用户注册登录界面

        这里设计了一个登录界面,可以注册账号和密码,然后进行登录。这里的登录比较简单,提供一个从登录到主界面的跳转功能,并没有涉及数据库等操作。

(四)选择图片识别

        系统主界面可以选择图片文件进行识别,点击图片选择按钮图标选择图片后,显示所有识别的结果,可通过下拉选框查看单个结果,以便单独显示某一特定目标。本功能的界面展示如下图所示:

(五)视频识别效果展示

        若需识别一段视频中的行人及车辆,这里可以点击视频按钮可选择待检测的视频,系统会自动解析视频逐帧识别交通道路,并将人流量、车流量的结果记录在下方表格中,效果如下图所示:

(六)摄像头检测效果展示

        在真实场景中,我们往往利用道路的摄像头获取实时画面,同时需要对画面中的行人及车辆进行识别,因此本文考虑到此项功能。如下图所示,点击摄像头按钮后系统进入准备状态,系统显示实时画面并开始检测画面中的行人及车辆,识别结果展示如下图:

2. 算法原理与数据集

(一)YOLOv5算法

        从最终效果来看YOLOv5已经相当优秀,是发展的比较完备、使用比较广泛的一个版本;而更重要的是YOLOv5的调用、训练和预测都十分方便。YOLOv5的另一个特点就是它为不同的设备需求和不同的应用场景提供了大小和参数数量不同的网络。

行人车辆检测与计数系统(Python+YOLOv5深度学习模型+清新界面)(行人检测技术)

        (1)主干部分:使用了Focus网络结构,具体操作是在一张图片中每隔一个像素拿到一个值,这个时候获得了四个独立的特征层,然后将四个独立的特征层进行堆叠,此时宽高信息就集中到了通道信息,输入通道扩充了四倍。该结构在YoloV5第5版之前有所应用,最新版本中未使用。

        (2)数据增强:Mosaic数据增强、Mosaic利用了四张图片进行拼接实现数据中增强,根据论文所说其拥有一个巨大的优点是丰富检测物体的背景!且在BN计算的时候一下子会计算四张图片的数据!

        (3)多正样本匹配:在之前的Yolo系列里面,在训练时每一个真实框对应一个正样本,即在训练时,每一个真实框仅由一个先验框负责预测。YoloV5中为了加快模型的训练效率,增加了正样本的数量,在训练时,每一个真实框可以由多个先验框负责预测。

        下图是YoloV5经过非极大值抑制在COCO数据集上的人、车图片测试结果。

(二)行人车辆数据集

        这里我们使用的行人车辆数据集,是从COCO和VOC数据集中抽取的包含行人、小汽车、卡车、公交、自行车、摩托车等类别的图像数据,每张图片除包括类别标签外,还有一个标注的物体边框(Bounding Box)。组成的训练数据集包含2856张图片,验证集1343张图片,共计4199张图片。

Chinese_name = {'person': "行人", 'bicycle': '自行车', 'car': '小汽车', 'motorcycle': '摩托车', 'bus': '公交车', 'truck': '卡车', 'train': '火车'}

        每张图像均提供了图像类标记信息,图像中行人及车辆的bounding box,行人及车辆的关键part信息,以及行人及车辆的属性信息,数据集并解压后得到如下的图片。

3. 行人车辆检测与计数系统

(一)训练过程

        数据集准备好,接下来可执行训练程序,首先要安装本系统所需的依赖库,配置一个Python3.8然后按照requirements.txt里面的依赖装环境就可以运行了。

#请按照给定的python版本配置环境,否则可能会因依赖不兼容而出错conda create -n env_rec python=3.8#激活环境activate env_rec#使用pip安装所需的以来,可通过requirements.txtpip install -r requirements.txt

        YOLOv5是通过yaml格式的配置文件来找到对应的训练测试数据,因此在训练前需要对该文件进行简单配置。这里我们为此数据集配置好的yaml文件如下所示:

train: ./PersonCar/images/trainval: ./PersonCar/images/valnc: 7names: ['person', 'bicycle', 'car', 'motorcycle', 'bus', 'truck', 'train']

        我们可以在终端输入如下命令进行训练,当然也可以直接点击train.py运行。

python train.py --batch 32 --epochs 300

(二)行人车辆预测

        在训练完成后得到最佳模型,接下来我们将帧图像输入到这个网络进行预测,从而得到预测结果,预测方法(predict.py)部分的代码如下所示。

"""运行本项目需要python3.8及以下依赖库(完整库见requirements.txt):opencv-python==4.5.5.64 tensorflow==2.9.1 PyQt5==5.15.6 scikit-image==0.19.3 torch==1.8.0 keras==2.9.0 Pillow==9.0.1 scipy==1.8.0点击运行主程序runMain.py,程序所在文件夹路径中请勿出现中文"""def predict(img): img = torch.from_numpy(img).to(device) img = img.half() if half else img.float() img /= 255.0 if img.ndimension() == 3: img = img.unsqueeze(0) t1 = time_synchronized() pred = model(img, augment=False)[0] pred = non_max_suppression(pred, opt.conf_thres, opt.iou_thres, classes=opt.classes, agnostic=opt.agnostic_nms) t2 = time_synchronized() InferNms = round((t2 - t1), 2) return pred, InferNmspred, useTime = predict(img)det = pred[0]p, s, im0 = None, '', img0if det is not None and len(det): # 如果有检测信息则进入 det[:, :4] = scale_coords(img.shape[1:], det[:, :4], im0.shape).round() # 把图像缩放至im0的尺寸 number_i = 0 # 类别预编号 detInfo = [] for *xyxy, conf, cls in reversed(det): # 遍历检测信息 c1, c2 = (int(xyxy[0]), int(xyxy[1])), (int(xyxy[2]), int(xyxy[3])) # 将检测信息添加到字典中 detInfo.append([names[int(cls)], [c1[0], c1[1], c2[0], c2[1]], '%.2f' % conf]) number_i += 1 # 编号数+1 label = '%s %.2f' % (names[int(cls)], conf) # 画出检测到的目标物 plot_one_box(image, xyxy, label=label, color=colors[int(cls)]) # 实时显示检测画面 cv2.imshow('Stream', image) image = cv2.resize(image, (vw, vh))

        得到预测结果我们便可以将帧图像中的行人车辆框出,然后在图片上用opencv绘图操作,输出行人车辆的的类别及行人车辆的预测分数。以下是读取一个行人车辆图片并进行检测的脚本,首先将图片数据进行预处理后送predict进行检测,然后计算标记框的位置并在图中标注出来。

        跑通了这个预测程序,我们可以将其封装到界面中,利用PyQt5设计一个UI界面,在运行图片、视频检测时调用这个方法。博主对整个系统进行了详细测试,最终开发出一版流畅得到清新界面,就是博文演示部分的展示,完整的UI界面、测试图片视频、代码文件,以及Python离线依赖包(方便安装运行,也可自行配置环境),均已打包上传,感兴趣的朋友可以通过参考文章里面给出的下载链接或B站视频简介处的下载链接获取。

下载链接

    若您想获得博文中涉及的实现完整全部程序文件(包括测试图片、视频,py, UI文件等,如下图),这里已打包上传至博主的面包多平台,见可参考博客与视频,已将所有涉及的文件同时打包到里面,点击即可运行,完整文件截图如下:

    在文件夹下的资源显示如下,下面的链接中也给出了Python的离线依赖包,读者可在正确安装Anaconda和Pycharm软件后,复制离线依赖包至项目目录下进行安装,离线依赖的使用详细演示也可见本人B站视频:win11从头安装软件和配置环境运行深度学习项目、Win10中使用pycharm和anaconda进行python环境配置教程。

注意:该代码采用Pycharm+Python3.8开发,经过测试能成功运行,运行界面的主程序为runMain.py和LoginUI.py,测试图片脚本可运行testPicture.py,测试视频脚本可运行testVideo.py。为确保程序顺利运行,请按照requirements.txt配置Python依赖包的版本。Python版本:3.8,请勿使用其他版本,详见requirements.txt文件;

完整资源中包含数据集及训练代码,环境配置与界面中文字、图片、logo等的修改方法请见视频,项目完整文件下载请见参考博客文章里面,或参考视频的简介处给出:➷➷➷

参考博客文章:https://zhuanlan.zhihu.com/p/614612564

参考视频演示:https://www.bilibili.com/video/BV1mT411r7hq/

离线依赖库下载链接:https://pan.baidu.com/s/1hW9z9ofV1FRSezTSj59JSg?pwd=oy4n (提取码:oy4n )

界面中文字、图标和背景图修改方法:

        在Qt Designer中可以彻底修改界面的各个控件及设置,然后将ui文件转换为py文件即可调用和显示界面。如果只需要修改界面中的文字、图标和背景图的,可以直接在ConfigUI.config文件中修改,步骤如下:         (1)打开UI_rec/tools/ConfigUI.config文件,若乱码请选择GBK编码打开。         (2)如需修改界面文字,只要选中要改的字符替换成自己的就好。         (3)如需修改背景、图标等,只需修改图片的路径。例如,原文件中的背景图设置如下:

mainWindow = :/images/icons/back-image.png

        可修改为自己的名为background2.png图片(位置在UI_rec/icons/文件夹中),可将该项设置如下即可修改背景图:

mainWindow = ./icons/background2.png结束语

        由于博主能力有限,博文中提及的方法即使经过试验,也难免会有疏漏之处。希望您能热心指出其中的错误,以便下次修改时能以一个更完美更严谨的样子,呈现在大家面前。同时如果有更好的实现方法也请您不吝赐教。

本文链接地址:https://www.jiuchutong.com/zhishi/298310.html 转载请保留说明!

上一篇:YOLOv5-7.0实例分割训练自己的数据,切分mask图并摆正(yolov3实例)

下一篇:微信小程序图片裁剪功能的实现(微信小程序图片大小如何设置)

  • 当博客都不给链接以后(博客为什么没了)

    当博客都不给链接以后(博客为什么没了)

  • 腾讯体育怎么开通会员(腾讯体育怎么开直播)

    腾讯体育怎么开通会员(腾讯体育怎么开直播)

  • u盘在华为手机上怎么读取(u盘在华为手机上读不出来怎么办)

    u盘在华为手机上怎么读取(u盘在华为手机上读不出来怎么办)

  • 华为mate30pro256g5g防水吗(华为Mate30Pro 8+256G)

    华为mate30pro256g5g防水吗(华为Mate30Pro 8+256G)

  • 腾讯视频怎么两个人一起看电影(腾讯视频怎么两个设备用一个账号)

    腾讯视频怎么两个人一起看电影(腾讯视频怎么两个设备用一个账号)

  • 华为锁屏密码忘记了怎么重置(华为锁屏密码忘了怎么刷机)

    华为锁屏密码忘记了怎么重置(华为锁屏密码忘了怎么刷机)

  • 新手机开机了就属于激活了吗(新手机开机了就不是新的了吗)

    新手机开机了就属于激活了吗(新手机开机了就不是新的了吗)

  • qq免费挂件有哪些名字(qq免费挂件有哪些永久2022)

    qq免费挂件有哪些名字(qq免费挂件有哪些永久2022)

  • qq显示离开对方在干嘛(qq对某人显示离开)

    qq显示离开对方在干嘛(qq对某人显示离开)

  • 手机卡补卡要回本地吗(手机卡补卡回来不想要了,可以注销吗)

    手机卡补卡要回本地吗(手机卡补卡回来不想要了,可以注销吗)

  • 电脑三原色英文叫什么(电脑三原色英文怎么表示)

    电脑三原色英文叫什么(电脑三原色英文怎么表示)

  • 微博加入黑名单 对方会知道吗(微博加入黑名单对方还能看我主页吗)

    微博加入黑名单 对方会知道吗(微博加入黑名单对方还能看我主页吗)

  • 4gb能下载多少首歌(4g能下多少首歌mp4)

    4gb能下载多少首歌(4g能下多少首歌mp4)

  • 人人视频pc端叫什么(人人视频的pc端)

    人人视频pc端叫什么(人人视频的pc端)

  • 播放音乐时无法唤醒siri(播放音乐时无法唤醒siri怎么办)

    播放音乐时无法唤醒siri(播放音乐时无法唤醒siri怎么办)

  • m2fan可以接风扇吗(m.2风扇)

    m2fan可以接风扇吗(m.2风扇)

  • a1398是什么型号(a1387是什么型号)

    a1398是什么型号(a1387是什么型号)

  • 手机怎么给群成员改名片(手机怎么给群成员点赞)

    手机怎么给群成员改名片(手机怎么给群成员点赞)

  • 荣耀20nfc怎么用(荣耀20nfc在哪里设置)

    荣耀20nfc怎么用(荣耀20nfc在哪里设置)

  • 韩版三星s10是双卡双待吗(三星s10韩版和国行的区别双卡吗)

    韩版三星s10是双卡双待吗(三星s10韩版和国行的区别双卡吗)

  • 笔记本电脑的顿号是哪个键(笔记本电脑的顿号打不出来)

    笔记本电脑的顿号是哪个键(笔记本电脑的顿号打不出来)

  • qq音乐删除访问有效吗(qq音乐删除访问记录别人能看见吗)

    qq音乐删除访问有效吗(qq音乐删除访问记录别人能看见吗)

  • beats solo3和studio3的区别(beats solo3和studio3哪个贵)

    beats solo3和studio3的区别(beats solo3和studio3哪个贵)

  • beatsx防水吗

    beatsx防水吗

  • 微信如何加人(微信如何加人找客源)

    微信如何加人(微信如何加人找客源)

  • airpods有什么用(airpods的用处)

    airpods有什么用(airpods的用处)

  • 在线网速测试网速比较快,用起来比较慢的原因?(在线网速测试网站测速工具)

    在线网速测试网速比较快,用起来比较慢的原因?(在线网速测试网站测速工具)

  • McWCECfg.exe是什么进程 McWCECfg进程查询(mc office是什么意思)

    McWCECfg.exe是什么进程 McWCECfg进程查询(mc office是什么意思)

  • 印花税都有啥
  • 增值税抵扣了还能作废吗
  • 银行共管账户现在可以开设吗
  • 本月发生费用未支付会计处理
  • 季度不超过30万是含税还是不含税
  • 过桥过路费为什么这么贵
  • 社会保险申报表中工资总额累计金额是什么意思
  • 生产企业出口退税
  • 固定资产公允价值减去处置费用后的净额
  • 长期股权投资收益会计处理
  • 电子产品委外加工
  • 工业企业购进货物进项税额抵扣的时限
  • 收到费用发票入账后发现错误
  • 物业费能开公司名称吗
  • 机打发票丢失如何处理报销
  • 分公司如何缴纳公积金
  • 企业所得税季度申报时间
  • 非同一控制企业合并商誉
  • 涉农和中小企业贷款分类证明没有就不能进行税前扣除么
  • 报销款冲抵其他应收款怎么做账?
  • 账务中如何把短期借款转变为实收资本?
  • 管理费用保险费汇算清缴
  • 房地产企业预缴增值税如何申报
  • 个人所得税代扣代缴的适用范围
  • 房地产企业土地出让金抵减销项税额
  • 废旧物资收购发票
  • 政府补助专款专用如何入账
  • 资本成本的组成
  • 如何计算劳务费个人所得税
  • ZF框架实现发送邮件的方法
  • 上年费用未计提
  • php odbc
  • php实现简单的登录验证
  • 十个php高级应用题
  • php获取网页视频地址
  • 会计核算的实训目的
  • 税后现金流入
  • 去年买的设备今年入固定资产如何做账
  • 应交增值税减免税额在借方
  • 去年的普票可以开红字吗
  • 公司注册完成以后需要做哪些事情
  • js读取json配置文件
  • 政府无偿划转股权印花税
  • 当月发生的费用
  • 股东分红账务处理表格
  • 增值税纳税申报表在哪里查询
  • 缴增值税的账务处理
  • 销售旧固定资产开票编码
  • 公司注销后违法行为追究吗
  • 应付账款多怎么办
  • 存货盘点后的检查
  • 单式记账法缺点是什么
  • 什么叫做差旅费
  • 其他综合收益是当期损益吗
  • 水利建设基金怎么交
  • 白条入账会受到监管吗
  • 对公网银回单可以导出吗
  • 资本性支出项目管理
  • 应收账款坏账准备借贷方向
  • 单独设置停工损失科目
  • microsoft window vista
  • 硬盘安装windows11
  • ubuntu16.04命令行配置静态ip
  • u盘重装系统电脑
  • Mac OS X Mavericks的Finder打开不同标签的操作步骤
  • debian和ubuntu server
  • 不知道,不知道
  • 电脑上dell是什么意思
  • linux最常用的shell终端是
  • windows8使用教程
  • win8.1专业版怎么升级成win10
  • Node.js中的construct构造函数
  • linux中tar
  • n归档是什么软件
  • javascript查看数据类型
  • 个体加油站税务怎么申报
  • 福建省地税局副局长 阮
  • 资源税属于国税还是地税
  • 华为西安总代理
  • 手机微信怎么预约
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设