数码系统

相机 win10

测评 win11

手机智车

华为 Tesla

小米理想

苹果蔚来

游戏软件

LOL 抖音

原神微信

当前位置：首页

AI资讯

热点详情

人脸关键点检测模型-MTCNN

AI热点日报时间：2025-07-18

热点解读

本文介绍了基于PaddlePaddle实现的MTCNN多任务卷积神经网络项目，该模型含P-Net、R-Net、O-Net三层结构，可检测人脸区域及关键点。说明环境要求、文件功能，详

本文介绍了基于PaddlePaddle实现的MTCNN多任务卷积神经网络项目，该模型含P-Net、R-Net、O-Net三层结构，可检测人脸区域及关键点。说明环境要求、文件功能，详述数据集下载与放置，训练需分三步依次训练PNet、RNet、ONet模型，每步依赖上一步结果，还提及预测方法及参考资料。

人脸关键点检测模型-mtcnn - 游乐网

啥也别说，先来试试效果吧。

In [2]

!python infer_path.py --image_path=dataset/test.webpfrom PIL import Imagedisplay(Image.open('result.webp'))

登录后复制

/opt/conda/envs/python35-paddle120-env/lib/python3.7/site-packages/setuptools/depends.py:2: DeprecationWarning: the imp module is deprecated in favour of importlib; see the module's documentation for alternative uses  import imp/opt/conda/envs/python35-paddle120-env/lib/python3.7/site-packages/paddle/fluid/backward.py:1640: DeprecationWarning: Using or importing the ABCs from 'collections' instead of from 'collections.abc' is deprecated, and in 3.8 it will stop working  return list(x) if isinstance(x, collections.Sequence) else [x]W0408 11:14:58.244475   362 device_context.cc:362] Please NOTE: device: 0, GPU Compute Capability: 7.0, Driver API Version: 10.1, Runtime API Version: 10.1W0408 11:14:58.249330   362 device_context.cc:372] device: 0, cuDNN Version: 7.6.: cannot connect to X server

登录后复制

前言

MTCNN，Multi-task convolutional neural network（多任务卷积神经网络），将人脸区域检测与人脸关键点检测放在了一起，总体可分为P-Net、R-Net、和O-Net三层网络结构。它是2016年中国科学院深圳研究院提出的用于人脸检测任务的多任务神经网络模型，该模型主要采用了三个级联的网络，采用候选框加分类器的思想，进行快速高效的人脸检测。这三个级联的网络分别是快速生成候选窗口的P-Net、进行高精度候选窗口过滤选择的R-Net和生成最终边界框与人脸关键点的O-Net。和很多处理图像问题的卷积神经网络模型，该模型也用到了图像金字塔、边框回归、非最大值抑制等技术。

环境

PaddlePaddle 2.0.1Python 3.7

文件介绍

models/Loss.py MTCNN所使用的损失函数，包括分类损失函数、人脸框损失函数、关键点损失函数models/PNet.py PNet网络结构models/RNet.py RNet网络结构models/ONet.py ONet网络结构utils/data_format_converter.py 把大量的图片合并成一个文件utils/data.py 训练数据读取器utils/utils.py 各种工具函数train_PNet/generate_PNet_data.py 生成PNet训练的数据train_PNet/train_PNet.py 训练PNet网络模型train_RNet/generate_RNet_data.py 生成RNet训练的数据train_RNet/train_RNet.py 训练RNet网络模型train_ONet/generate_ONet_data.py 生成ONet训练的数据train_ONet/train_ONet.py 训练ONet网络模型infer_path.py 使用路径预测图像，检测图片上人脸的位置和关键的位置，并显示infer_camera.py 预测图像程序，检测图片上人脸的位置和关键的位置实时显示

数据集下载

WIDER Face 下载训练数据WIDER Face Training Images，解压的WIDER_train文件夹放置到dataset下。并下载 Face annotations ，解压把里面的 wider_face_train_bbx_gt.txt 文件放在dataset目录下，Deep Convolutional Network Cascade for Facial Point Detection 。下载 Training set 并解压，将里面的 lfw_5590 和 net_7876 文件夹放置到dataset下解压数据集之后，dataset目录下应该有文件夹lfw_5590，net_7876，WIDER_train，有标注文件testImageList.txt，trainImageList.txt，wider_face_train.txt，wider_face_train_bbx_gt.txt

训练模型

训练模型一共分为三步，分别是训练PNet模型、训练RNet模型、训练ONet模型，每一步训练都依赖上一步的结果。

第一步训练PNet模型

PNet全称为Proposal Network，其基本的构造是一个全卷积网络，P-Net是一个人脸区域的区域建议网络，该网络的将特征输入结果三个卷积层之后，通过一个人脸分类器判断该区域是否是人脸，同时使用边框回归。

人脸关键点检测模型-MTCNN - 游乐网

请在终端执行以下命令：

cd train_PNet 切换到train_PNet文件夹python3 generate_PNet_data.py 首先需要生成PNet模型训练所需要的图像数据python3 train_PNet.py 开始训练PNet模型

第二步训练RNet模型

全称为Refine Network，其基本的构造是一个卷积神经网络，相对于第一层的P-Net来说，增加了一个全连接层，因此对于输入数据的筛选会更加严格。在图片经过P-Net后，会留下许多预测窗口，我们将所有的预测窗口送入R-Net，这个网络会滤除大量效果比较差的候选框，最后对选定的候选框进行Bounding-Box Regression和NMS进一步优化预测结果。

人脸关键点检测模型-MTCNN - 游乐网

请在终端执行以下命令：

cd train_RNet 切换到train_RNet文件夹python3 generate_RNet_data.py 使用上一步训练好的PNet模型生成RNet训练所需的图像数据python3 train_RNet.py 开始训练RNet模型

第三步训练ONet模型

ONet全称为Output Network，基本结构是一个较为复杂的卷积神经网络，相对于R-Net来说多了一个卷积层。O-Net的效果与R-Net的区别在于这一层结构会通过更多的监督来识别面部的区域，而且会对人的面部特征点进行回归，最终输出五个人脸面部特征点。

人脸关键点检测模型-MTCNN - 游乐网

请在终端执行以下命令：

cd train_ONet 切换到train_ONet文件夹python3 generate_ONet_data.py 使用上两部步训练好的PNet模型和RNet模型生成ONet训练所需的图像数据python3 train_ONet.py 开始训练ONet模型

预测

python3 infer_path.py 使用图像路径，识别图片中人脸box和关键点，并显示识别结果

python3 infer_camera.py 使用相机捕获图像，识别图片中人脸box和关键点，并显示识别结果

参考资料

https://github.com/AITTSMD/MTCNN-Tensorflowhttps://blog.csdn.net/qq_36782182/article/details/83624357

本项目Github地址：https://github.com/yeyupiaoling/PaddlePaddle-MTCNN

热点追踪提示词

你是一名 AI 行业编辑，请围绕下面这条热点输出一份资讯解读：
热点：人脸关键点检测模型-MTCNN要求：
1. 先用一句话解释这条热点在讲什么
2. 再总结它为什么重要
3. 说明会影响哪些 AI 产品或内容方向
4. 最后给出 3 个适合资讯站使用的标题

来源：https://www.php.cn/faq/1414415.html

python git cad 工具 qq ai

上一篇：用豆包AI生成Python网络请求代码

下一篇：近端策略优化PPO-算法简析-paddle2.0

游乐网为非赢利性网站，所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系youleyoucom@outlook.com。

延伸阅读

iPhone 17系列液态硅胶壳曝光：8色可选+挂绳孔设计 iOS 26整合ChatGPT-5：AI全面赋能苹果智能生态真我828真粉节揭晓：10000mAh超大电池手机即将亮相？苹果折叠iPhone曝光：搭载自研C2基带芯片与Touch ID指纹识别对话元戎启行周光：VLA模型核心成本在AI芯片，辅助驾驶方案交付近10万套刘志强：京东方坚持开放合作，拒绝低质低价竞争 Redmi K90系列全系标配5000万长焦与3D超声波指纹，配置再升级 vivo X300系列曝光：天玑9500+2亿像素主摄，长焦微距实力升级

日榜
周榜
月榜

01 / 08-26iPhone 17系列液态硅胶壳曝光：8色可选+挂绳孔设计 02 / 08-26iOS 26整合ChatGPT-5：AI全面赋能苹果智能生态 03 / 08-26真我828真粉节揭晓：10000mAh超大电池手机即将亮相？ 04 / 08-26苹果折叠iPhone曝光：搭载自研C2基带芯片与Touch ID指纹识别 05 / 08-27对话元戎启行周光：VLA模型核心成本在AI芯片，辅助驾驶方案交付近10万套

01 / 本周微信聊天多图合并发送，折叠一键保存转发 02 / 本周育碧重组关停两工作室 380名员工受影响引行业争议 03 / 本周反诈手册：关闭境外来电与803反诈智能体详解 04 / 本周SK海力士计划2034年将AI芯片产能提升三倍 05 / 本周迅雷鸿蒙版新增碰一碰分享与桌面卡片功能

01 / 本月微信聊天多图合并发送，折叠一键保存转发 02 / 本月育碧重组关停两工作室 380名员工受影响引行业争议 03 / 本月反诈手册：关闭境外来电与803反诈智能体详解 04 / 本月SK海力士计划2034年将AI芯片产能提升三倍 05 / 本月迅雷鸿蒙版新增碰一碰分享与桌面卡片功能

热点快看

07-07 08:52微信聊天多图合并发送，折叠一键保存转发 07-07 08:52育碧重组关停两工作室 380名员工受影响引行业争议 07-07 08:52反诈手册：关闭境外来电与803反诈智能体详解 07-07 08:52SK海力士计划2034年将AI芯片产能提升三倍 07-07 08:52迅雷鸿蒙版新增碰一碰分享与桌面卡片功能

热点追踪

持续追踪iPhone 17系列液态硅胶壳曝光：8色可选+挂绳孔设计 持续追踪iOS 26整合ChatGPT-5：AI全面赋能苹果智能生态 持续追踪真我828真粉节揭晓：10000mAh超大电池手机即将亮相？ 持续追踪苹果折叠iPhone曝光：搭载自研C2基带芯片与Touch ID指纹识别

人脸关键点检测模型-MTCNN

啥也别说，先来试试效果吧。

前言

环境

文件介绍

数据集下载

训练模型

第一步 训练PNet模型

第二步 训练RNet模型

第三步 训练ONet模型

预测

参考资料

第一步训练PNet模型

第二步训练RNet模型

第三步训练ONet模型