大数据采集之这个「多模态视频人物数据集」里,藏了杨幂、吴亦凡和鹿晗
沉沙 2019-02-19 来源 : 阅读 644 评论 0

摘要:本篇文章探讨了大数据采集之这个「多模态视频人物数据集」里,藏了杨幂、吴亦凡和鹿晗,希望阅读本篇文章以后大家有所收获,帮助大家对相关内容的理解更加深入。

本篇文章探讨了大数据采集之这个「多模态视频人物数据集」里,藏了杨幂、吴亦凡和鹿晗,希望阅读本篇文章以后大家有所收获,帮助大家对相关内容的理解更加深入。

大数据采集之这个「多模态视频人物数据集」里,藏了杨幂、吴亦凡和鹿晗

       

爱奇艺最近公开了一个数据集,名叫iQIYI-VID

公开这个数据集的爱奇艺官方给它确认的类别名字叫“多模态视频人物数据集”,翻译成人话,就是有很多人,每个人用不同的“姿势”拍视频,收集起来攒成的数据集。

只不过,这些人相对比较有名,有杨幂、吴亦凡、鹿晗……

5000个明星艺人

整个数据集非常庞大,包含5000个艺人,近60万条视频,每条视频长1~30秒。

数据集中的每个视频片段都经过人工注释,错误率低于0.2%。

其中收录了一些同一个艺人都的不同造型,比如,有发型别致的吴亦凡

还有发型比较常规的吴亦凡

有穿红衣服的杨幂

还有穿蓝白衣服的杨幂

以及穿同样衣服的鹿晗和……抱歉,脸盲的量子位认出鹿晗已经是极限了。

整个数据集中,大部分明星都拥有10~50个视频,有50~100个视频或100~300个视频的也不少,但只有少量头部艺人拥有300个以上的视频。

而根据年龄来看,主力军竟然是30多岁的明星艺人,其次才是40多岁的明星,30岁以下的明星只有不到600个。原来年纪大了也可以出道啊?

最后,大部分视频都是在5秒钟以内,非常简短,节省计算资源。

有什么用

不过,把这些明星艺人的视频搜集到一起,究竟能炼什么丹呢?

主要可以做三件事:

第一,人脸识别

5000个人呢,辨认一下谁是谁。不过人脸识别实在是太普遍了。

第二,说话人识别

基于音频的说话人识别,训练机器听声音,判断是谁在说话。

目前这方面的资料不是很多,这方面最大的免费数据集是VoxCeleb和VoxCeleb2;另外美国国家标准技术研究院(NIST)曾经做过一些工作,但是那些数据集不是免费的。

第三,基于身体特征的人员重新识别

根据身体特征,判断不同镜头中的人是否为同一个人,目前主要还是用单帧的方法,从视频中抽取单帧图像,通过图像切割、骨架点定位、姿态校准进行比较。

综艺节目再利用

至于这些视频是哪儿来的嘛,自然是要感谢爱奇艺作为视频网站的老本行。


这些视频片段是从40万小时的电影、电视剧、综艺、新闻视频中剪出来的,内容源自爱奇艺网站上TOP 50万的热门视频。

将这些热门视频按照分镜头剪开后,不到一秒的视频因为信息不足被丢掉,超过30秒的视频考虑到计算负载过大也被删掉了。

之后,去掉噪声,根据每个人的衣服或人脸特征来归类,匹配到爱奇艺的名人数据库,从而生成针对每个不同人物的视频数据集。

  

   

本文由职坐标整理发布,学习更多的相关知识,请关注职坐标IT知识库!

本文由 @沉沙 发布于职坐标。未经许可,禁止转载。
喜欢 | 0 不喜欢 | 0
看完这篇文章有何感觉?已经有0人表态,0%的人喜欢 快给朋友分享吧~
评论(0)
后参与评论

您输入的评论内容中包含违禁敏感词

我知道了

助您圆梦职场 匹配合适岗位
验证码手机号,获得海同独家IT培训资料
选择就业方向:
人工智能物联网
大数据开发/分析
人工智能Python
Java全栈开发
WEB前端+H5

请输入正确的手机号码

请输入正确的验证码

获取验证码

您今天的短信下发次数太多了,明天再试试吧!

提交

我们会在第一时间安排职业规划师联系您!

您也可以联系我们的职业规划师咨询:

小职老师的微信号:z_zhizuobiao
小职老师的微信号:z_zhizuobiao

版权所有 职坐标-一站式IT培训就业服务领导者 沪ICP备13042190号-4
上海海同信息科技有限公司 Copyright ©2015 www.zhizuobiao.com,All Rights Reserved.
 沪公网安备 31011502005948号    

©2015 www.zhizuobiao.com All Rights Reserved

208小时内训课程