利索能及
我要发布
收藏
专利号: 2019101693113
申请人: 百度在线网络技术(北京)有限公司
专利类型:发明专利
专利状态:已下证
更新日期:2025-12-08
缴费截止日期: 暂无
联系人

摘要:

权利要求书:

1.一种用于输出信息的方法,包括:

获取待识别图像;

确定所述待识别图像中是否存在行人;

若所述待识别图像中存在行人,基于所述待识别图像和预先训练的性别识别模型,得到所述行人的性别,其中,所述性别识别模型用于识别图像中的行人的性别,所述性别识别模型训练前的初始化参数是一些不同的小随机数,所述性别识别模型包括特征提取网络和分类网络,所述特征提取网络是VGG模型,所述分类网络由三个卷积层和两个全连接层组成;

若所述行人的性别与预设性别不同,输出提示信息;

其中,所述基于所述待识别图像和预先训练的性别识别模型,得到所述行人的性别包括:从所述待识别图像中分割出所述行人的人脸图像和人体图像;将所述人脸图像和所述人体图像缩放至相同尺寸;将缩放后的所述人脸图像和所述人体图像输入至所述性别识别模型,得到所述行人的性别;

所述确定所述待识别图像中是否存在行人包括:

将所述待识别图像输入至预先训练的人体检测模型,得到所述待识别图像的人体检测结果,其中,所述人体检测模型用于检测图像中是否存在行人,所述人体检测结果包括用于指示所述待识别图像中是否存在行人的信息,及人脸和人体的位置信息。

2.根据权利要求1所述的方法,其中,所述将所述人脸图像和所述人体图像输入至所述性别识别模型,得到所述行人的性别,包括:将所述人脸图像和所述人体图像输入至所述特征提取网络,得到所述行人的人脸特征和人体特征;

将所述人脸特征和所述人体特征合并,生成合并特征;

将所述合并特征输入至所述分类网络,得到所述行人的性别。

3.根据权利要求1‑2之一所述的方法,其中,所述待识别图像是对与所述预设性别匹配的房间的门口区域进行拍摄所得到的视频中的视频帧。

4.一种用于输出信息的装置,包括:

获取单元,被配置成获取待识别图像;

确定单元,被配置成确定所述待识别图像中是否存在行人;

识别单元,被配置成若所述待识别图像中存在行人,基于所述待识别图像和预先训练的性别识别模型,得到所述行人的性别,其中,所述性别识别模型用于识别图像中的行人的性别,所述性别识别模型训练前的初始化参数是一些不同的小随机数,所述性别识别模型包括特征提取网络和分类网络,所述特征提取网络是VGG模型,所述分类网络由三个卷积层和两个全连接层组成;

输出单元,被配置成若所述行人的性别与预设性别不同,输出提示信息;

其中,所述识别单元包括:

分割子单元,被配置成从所述待识别图像中分割出所述行人的人脸图像和人体图像;

缩放子单元,被配置成将所述人脸图像和所述人体图像缩放至相同尺寸;识别子单元,被配置成将缩放后的所述人脸图像和所述人体图像输入至所述性别识别模型,得到所述行人的性别;

所述确定单元进一步被配置成:

将所述待识别图像输入至预先训练的人体检测模型,得到所述待识别图像的人体检测结果,其中,所述人体检测模型用于检测图像中是否存在行人,所述人体检测结果包括用于指示所述待识别图像中是否存在行人的信息,及人脸和人体的位置信息。

5.根据权利要求4所述的装置,其中,所述识别子单元包括:提取模块,被配置成将所述人脸图像和所述人体图像输入至所述特征提取网络,得到所述行人的人脸特征和人体特征;

合并模块,被配置成将所述人脸特征和所述人体特征合并,生成合并特征;

分类模块,被配置成将所述合并特征输入至所述分类网络,得到所述行人的性别。

6.根据权利要求4‑5之一所述的装置,其中,所述待识别图像是对与所述预设性别匹配的房间的门口区域进行拍摄所得到的视频中的视频帧。

7.一种服务器,包括:

一个或多个处理器;

存储装置,其上存储有一个或多个程序,

当所述一个或多个程序被所述一个或多个处理器执行,使得所述一个或多个处理器实现如权利要求1‑3中任一所述的方法。

8.一种计算机可读介质,其上存储有计算机程序,其中,所述计算机程序被处理器执行时实现如权利要求1‑3中任一所述的方法。