可怕,40行代码的人脸识别实践

作者: 刘潇龙 2017-07-24 15:06:02

最近听说有这么一个黑科技,让之前闯红灯有恃无恐的人们纷纷给交警部门打电话,求交警叔叔能不能把自己的照片撤下来......

闯红灯这件事情,一直是交通问题的一大头疼病。自从交通法对机动车闯红灯进行扣 6 分的举措后,很多司机朋友们纷纷表示不敢怠慢了。

机动车好了,可是非机动车和行人闯红灯的病咋治?当中国式过马路已经深入人心的时候,这不,黑科技来了,乍一看还真的很像警方在搜捕嫌疑人。

近期山东、江苏、深圳等一些城市开始在交通路口上启用了人脸识别系统,针对行人和非机动车闯红灯等违规行为进行抓拍,并现场进行曝光。

而对于行人和非机动车闯红灯的行为,交管部门将会给予 20 元到 50 元的罚款。

虽然罚款钱数不多,但是最让大家忌惮的就是,你不文明行为的视频和你的个人信息,都会在大屏幕上全天轮次播放。交警叔叔说了,被拍的市民纷纷表示下次再也不敢闯红灯了。

人脸抓拍系统的工作原理是:当红灯亮起后,如有行人和非机动车越过停止线,系统会自动抓拍四张照片,保留 15 秒视频并截取违法者头像,即便在晚上也能清晰成像。除了现场回放,交管部门还将连接的户籍信息进行曝光。

人脸识别技术到底是怎样实现的呢?

很多人都认为人脸识别是一项非常难以实现的工作,看到名字就害怕,然后心怀忐忑到网上一搜,看到网上 N 页的教程立马就放弃了。

这些人里包括曾经的我自己。其实如果如果你不是非要深究其中的原理,只是要实现这一工作的话,人脸识别也没那么难。

今天我们就来看看如何在 40 行代码以内简单地实现人脸识别。

一点区分

对于大部分人来说,区分人脸检测和人脸识别完全不是问题。但是网上有很多教程有意无意地把人脸检测说成是人脸识别,误导群众,造成一些人认为二者是相同的。

其实,人脸检测解决的问题是确定一张图上有木有人脸,而人脸识别解决的问题是这个脸是谁的。可以说人脸检测是是人识别的前期工作。

今天我们要做的是人脸识别。

所用工具

Anaconda 2 —— Python 2

Dlib

scikit-image

Dlib

对于今天要用到的主要工具,还是有必要多说几句的。Dlib 是基于现代 C++ 的一个跨平台通用的框架,作者非常勤奋,一直在保持更新。

Dlib 内容涵盖机器学习、图像处理、数值算法、数据压缩等等,涉猎甚广。更重要的是,Dlib 的文档非常完善,例子非常丰富。就像很多库一样,Dlib 也提供了 Python 的接口,安装非常简单,用 pip 只需要一句即可:

  1. pip install dlib 

上面需要用到的 scikit-image 同样只是需要这么一句:

  1. pip install scikit-image 

注:如果用 pip install dlib 安装失败的话,那安装起来就比较麻烦了。错误提示很详细,按照错误提示一步步走就行了。

人脸识别

之所以用 Dlib 来实现人脸识别,是因为它已经替我们做好了绝大部分的工作,我们只需要去调用就行了。Dlib 里面有人脸检测器,有训练好的人脸关键点检测器,也有训练好的人脸识别模型。

今天我们主要目的是实现,而不是深究原理。例子既然代码不超过 40 行,其实是没啥难度的。

首先先通过文件树看一下今天需要用到的代码:

准备了六个候选人的图片放在 candidate-faces 文件夹中,然后需要识别的人脸图片 test.jpg 。我们的工作就是要检测到 test.jpg 中的人脸,然后判断她到底是候选人中的谁。

另外的 girl-face-rec.py 是我们的 python 脚本。

shape_predictor_68_face_landmarks.dat 是已经训练好的人脸关键点检测器。

dlib_face_recognition_resnet_model_v1.dat 是训练好的 ResNet 人脸识别模型。

ResNet 是何凯明在微软的时候提出的深度残差网络,获得了 ImageNet 2015 冠军,通过让网络对残差进行学习,在深度和精度上做到了比 CNN 更加强大。

前期准备

shape_predictor_68_face_landmarks.dat和 dlib_face_recognition_resnet_model_v1.dat 都可以在这里找到。

不能点击超链接的可以直接输入以下网址:https://dlib.net/files/。

然后准备几个人的人脸图片作为候选人脸,***是正脸。放到 candidate-faces 文件夹中。

本文这里准备的是六张图片,如下:

她们分别是:

然后准备四张需要识别的人脸图像,其实一张就够了,这里只是要看看不同的情况:

可以看到前两张和候选文件中的本人看起来还是差别不小的,第三张是候选人中的原图,第四张图片微微侧脸,而且右侧有阴影。

识别流程

数据准备完毕,接下来就是代码了。识别的大致流程是这样的:

先对候选人进行人脸检测、关键点提取、描述子生成后,把候选人描述子保存起来。

然后对测试人脸进行人脸检测、关键点提取、描述子生成。

***求测试图像人脸描述子和候选人脸描述子之间的欧氏距离,距离最小者判定为同一个人。

代码

代码不做过多解释,因为已经注释的非常完善了。以下是 girl-face-rec.py:

  1. # -*- coding: UTF-8 -*- 
  2. import sys,os,dlib,glob,numpy 
  3. from skimage import io 
  4.  if len(sys.argv) != 5: 
  5.      print "请检查参数是否正确" 
  6.      exit() 
  7. # 1.人脸关键点检测器 
  8. predictor_path = sys.argv[1] 
  9. # 2.人脸识别模型 
  10. face_rec_model_path = sys.argv[2] 
  11. # 3.候选人脸文件夹 
  12. faces_folder_path = sys.argv[3] 
  13. # 4.需识别的人脸 
  14. img_path = sys.argv[4] 
  15. # 1.加载正脸检测器 
  16. detector = dlib.get_frontal_face_detector() 
  17. # 2.加载人脸关键点检测器 
  18. sp = dlib.shape_predictor(predictor_path) 
  19. # 3. 加载人脸识别模型 
  20. facerec = dlib.face_recognition_model_v1(face_rec_model_path) 
  21. # win = dlib.image_window() 
  22. # 候选人脸描述子list 
  23. descriptors = [] 
  24. # 对文件夹下的每一个人脸进行: 
  25. # 1.人脸检测 
  26. # 2.关键点检测 
  27. # 3.描述子提取 
  28. for f in glob.glob(os.path.join(faces_folder_path, "*.jpg")): 
  29.     print("Processing file: {}".format(f)) 
  30.     img = io.imread(f) 
  31.     #win.clear_overlay() 
  32.     #win.set_image(img) 
  33.     # 1.人脸检测 
  34.     dets = detector(img, 1) 
  35.     print("Number of faces detected: {}".format(len(dets))) 
  36.     for k, d in enumerate(dets):   
  37.     # 2.关键点检测 
  38.     shape = sp(img, d) 
  39.     # 画出人脸区域和和关键点 
  40.     # win.clear_overlay() 
  41.     # win.add_overlay(d) 
  42.     # win.add_overlay(shape) 
  43.     # 3.描述子提取,128D向量 
  44.     face_descriptor = facerec.compute_face_descriptor(img, shape) 
  45.     # 转换为numpy array 
  46.     v = numpy.array(face_descriptor)   
  47.     descriptors.append(v) 
  48. # 对需识别人脸进行同样处理 
  49. # 提取描述子,不再注释 
  50. img = io.imread(img_path) 
  51.  dets = detector(img, 1) 
  52.  dist = [] 
  53. for k, d in enumerate(dets): 
  54.     shape = sp(img, d) 
  55.     face_descriptor = facerec.compute_face_descriptor(img, shape) 
  56.     d_test = numpy.array(face_descriptor)  
  57.     # 计算欧式距离 
  58.     for i in descriptors: 
  59.     dist_ = numpy.linalg.norm(i-d_test) 
  60.     dist.append(dist_) 
  61. # 候选人名单 
  62. candidate = ['Unknown1','Unknown2','Shishi','Unknown4','Bingbing','Feifei'
  63.  # 候选人和距离组成一个dict 
  64. c_d = dict(zip(candidate,dist)) 
  65. cd_sorted = sorted(c_d.iteritems(), key=lambda d:d[1]) 
  66. print "\n The person is: ",cd_sorted[0][0]   
  67. dlib.hit_enter_to_continue() 

运行结果

我们在 .py 所在的文件夹下打开命令行。运行如下命令:

python girl-face-rec.py 1.dat 2.dat ./candidate-faecs test1.jpg

由于 shape_predictor_68_face_landmarks.dat 和 dlib_face_recognition_resnet_model_v1.dat 名字实在太长,所以我把它们重命名为 1.dat 和 2.dat 。

运行结果如下:

  • The person is Bingbing。

记忆力不好的同学可以翻上去看看 test1.jpg 是谁的图片。有兴趣的话可以把四张测试图片都运行下试试。

这里需要说明的是,前三张图输出结果都是非常理想的。但是第四张测试图片的输出结果是候选人 4。对比一下两张图片可以很容易发现混淆的原因。

机器毕竟不是人,机器的智能还需要人来提升。

有兴趣的朋友可以继续深入研究如何提升识别的准确率。比如每个人的候选图片用多张,然后对比和每个人距离的平均值之类的,全凭自己了。

代码 人脸识别 实践
上一篇:独家 | 教你在R中使用Keras和TensorFlow构建深度学习模型 下一篇:人工智能与机器学习有哪些不同
评论
取消
暂无评论,快去成为第一个评论的人吧

更多资讯推荐

复工如何避免间接接触?人脸识别门禁实现硬核防控

随着返工日的临近,全国各地陆续恢复生产和工作,与此同时,疫情预防的工作也不可松懈。据悉,新型冠状病毒的传播方式主要为飞沫传播和间接接触,当下,人人出门都会佩戴口罩,并且经常洗手,可以有效预防飞沫传播,而接触公共设施的间接传播方式不容忽视。

佚名 ·  3天前
Excel狂魔?单元格做计算机视觉:人脸检测、OCR都不在话下

计算机视觉是什么?过于专业,一步劝退?在普通人看来,计算机视觉是软件开发者才能涉足的领域,需要用到很多专业的框架,普通人只能围观。但 GitHub 上的一个项目似乎颠覆了我们的认知。

佚名 ·  4天前
独家下载!阿里如何用 AI 写代码?

作为今年阿里经济体前端委员会的四大技术方向之一,前端智能化方向一被提及,就不免有人好奇:前端结合 AI 能做些什么,怎么做,未来会不会对前端产生很大的冲击等等。本篇文章将围绕这些问题,以「设计稿自动生成代码」场景为例,从背景分析、竞品分析、问题拆解、技术方案等几个角度切入,细述相关思考及过程实践。

妙净、波本 ·  4天前
人工智能技术快速识别人流中个体感染者风险,同济研发疫情防控识别系统

在摆放于校门口的摄像头前站定,系统马上通过人脸识别技术,结合现场体温检测,对同济大学教职员工、学生的基本情况进行自动分析查询。如果体温正常、满足外地返沪大于14天隔离和上海的相关要求,校门将予以放行;如有发热现象或不满足相关要求,系统将自动报警,不予放行,对相关人员实现......

彭德倩 ·  2020-02-18 07:00:50
支付宝人脸识别被“破解”,我们的钱不安全了么?

技术总归是不断发展进步的,坏人掌握的技术也是一样。并且,任何一个技术都有被黑被破解的可能,只是成本问题。

徐九 ·  2020-02-14 13:36:12
如何用人脸识别自动给头像添加口罩及护目镜

此项目使用人脸识别自动给头像添加口罩及护目镜,仅为呼吁大家积极佩戴口罩及护目镜,为武汉及奋斗在第一线的医护人员加油!

Evilran ·  2020-02-13 12:50:07
人脸识别背后:可怕的不是技术,而是……

当下AI程序到底会用人类面孔做什么?有多少的恐惧是来源于传言,而非摆在面前的事实?技术的力量是否让人类的担忧不断增多?我们来一起想想这个问题。

读芯术 ·  2020-02-12 22:20:39
代码开源!超好用的《机器学习实用指南》第二版终于来了

早在去年的这个时候,红色石头就发文给大家推荐过一本非常棒的机器学习实用指南书籍《Hands-On Machine Learning with Scikit-Learn & TensorFlow》

Author 红色石头 ·  2020-02-11 10:30:32
Copyright©2005-2020 51CTO.COM 版权所有 未经许可 请勿转载