动作谷歌sb

谷歌sb  时间:2021-05-21  阅读:()
Google发布AVA:一个用于理解人类动作的精细标记视频数据集原创:Google谷歌开发者2017-11-03文/Google软件工程师ChunhuiGu和DavidRoss教机器理解视频中的人类动作是计算机视觉的一个基本研究课题,对于个人视频搜索和发现、运动分析和手势接口等应用必不可少.
过去几年来,在图像中分类和查找对象取得了令人兴奋的突破,但识别人类动作仍然是一个巨大的挑战.
原因在于,就其本性而言,人类动作的定义不如视频对象完善,因此,很难构建精细标记的动作视频数据集.
尽管有许多基准数据集(如UCF101、ActivityNet和DeepMind的Kinetics)采用图像分类标记模式,并为数据集中的每个视频或视频剪辑分配一个标签,但对于有多人执行不同动作的复杂场景,还没有相应的数据集.
为促进对人类动作识别的进一步研究,我们发布了AVA,它诞生于"原子视觉动作",是一个全新的数据集,为扩展视频序列中的每个人提供多个动作标签.
AVA由YouTube中公开视频的网址组成,注解了一组80种时空局部化的原子动作(如"走"、"踢(物体)"、"握手"等),产生了5.
76万个视频片段、9.
6万个标记动作执行人以及总共21万个动作标签.
您可以浏览网站,了解数据集和下载注解:https://research.
google.
com/ava并阅读我们的arXiv论文,了解数据集的设计和开发:https://arxiv.
org/abs/1705.
08421与其他动作数据集相比,AVA具有以下重要特征:以人为中心的注解.
每个动作标签与人相关,而不是与视频或剪辑相关.
因此,我们可以将不同标签分配到同一场景中执行不同动作的多个人(这种情况很常见).
原子视觉动作.
我们将动作标签限于很小的时间尺度(3秒),在此范围内,动作的性质是身体活动,具有清晰的视觉特征.
现实视频材料.
我们使用电影作为AVA的来源,从很多不同的流派和原产国取材.
因此,数据中包含广泛的人类行为.
3秒视频片段(来自视频来源)示例,其边界框注解在每个片段的中间帧中.
(为清楚起见,每个示例只显示一个边界框)为创建AVA,我们先从YouTube收集了一组变化多的长形式内容,集中于"电影"和"电视"类别,有许多不同国籍的专业演员.
我们对每个视频分析了15分钟的片段,将其统一分隔为300个不重叠的3秒片段.
采样策略将动作序列保持在连贯的时间背景中.
然后,我们手动标识每个3秒片段中间帧中所有人的边界框.
对于边界框中的每个人,注解人员从预定义的原子动作词汇(有80个类别)中选择不同数量的标签来描述个人在片段中的动作.
这些动作分为三组:姿势/移动、人-物体互动以及人-人互动.
因为我们详尽标记了执行全部动作的所有人,所以,AVA标签的频率遵循长尾分布,下面进行了简要介绍.
AVA原子动作标签的分布.
X轴中显示的标签只是我们词汇的一部分.
AVA的独特设计可让我们推导出其他现有数据集中没有的一些有趣统计信息.
例如,如果很多人至少有两个标签,我们便可测量动作标签的共现模式.
下图所示为AVA中最常见的共现动作对及其共现得分.
我们确认预期模式,比如人们经常在唱歌时弹奏乐器,跟小孩玩时把人举起,以及在亲吻时拥抱,等等.
AVA中最常见的共现动作对.
为评估AVA数据集中人类动作识别系统的有效性,我们实现了现有基线深度学习模型,该模型可以从更小的JHMDB数据集获得更好的性能.
由于缩放、背景杂波、摄影和外观变化等富有挑战性的变化,此模型在正确识别AVA中的动作时表现一般(18.
4%mAP).
这表明AVA是一个有用的试验台,可用于为未来几年开发和评估新的动作识别架构和算法.
我们希望,AVA能帮助改进人类动作识别系统的开发,能基于精细时空粒度的标签在个人动作层级为复杂活动建模.
我们将继续扩展和改进AVA,也渴望听到社区的反馈意见,帮助我们指引未来的方向.
致谢AVA的核心团队包括ChunhuiGu、ChenSun、DavidRoss、CarolinePantofaru、YeqingLi、SudheendraVijayanarasimhan、GeorgeToderici、SusannaRicco、RahulSukthankar、CordeliaSchmid和JitendraMalik.
感谢许多Google同事和注解人员对此项目的全力支持.

湖北22元/月(昔日数据)云服务器,国内湖北十堰云服务器,首月6折

昔日数据怎么样?昔日数据新上了湖北十堰云服务器,湖北十堰市IDC数据中心 母鸡采用e5 2651v2 SSD MLC企业硬盘 rdid5阵列为数据护航 100G高防 超出防御峰值空路由2小时 不限制流量。目前,国内湖北十堰云服务器,首月6折火热销售限量30台价格低至22元/月。(注意:之前有个xrhost.cn也叫昔日数据,已经打不开了,一看网站LOGO和名称为同一家,有一定风险,所以尽量不要选择...

创梦网络-四川大带宽、镇江电信服务器云服务器低至56元

达州创梦网络怎么样,达州创梦网络公司位于四川省达州市,属于四川本地企业,资质齐全,IDC/ISP均有,从创梦网络这边租的服务器均可以备案,属于一手资源,高防机柜、大带宽、高防IP业务,一手整C IP段,四川电信,一手四川托管服务商,成都优化线路,机柜租用、服务器云服务器租用,适合建站做游戏,不须要在套CDN,全国访问快,直连省骨干,大网封UDP,无视UDP攻击,机房集群高达1.2TB,单机可提供1...

CloudCone(20美元/年)大硬盘VPS云服务器,KVM虚拟架构,1核心1G内存1Gbps带宽

近日CloudCone商家对旗下的大硬盘VPS云服务器进行了少量库存补货,也是悄悄推送了一批便宜VPS云服务器产品,此前较受欢迎的特价20美元/年、1核心1G内存1Gbps带宽的VPS云服务器也有少量库存,有需要美国便宜大硬盘VPS云服务器的朋友可以关注一下。CloudCone怎么样?CloudCone服务器好不好?CloudCone值不值得购买?CloudCone是一家成立于2017年的美国服务...

谷歌sb为你推荐
支持ipad支持ipad支持ipad勒索病毒win7补丁求问win7 64位旗舰版怎么预防勒索病毒127.0.0.1DNS老是被修改为127.0.0.1,这是为什么?用itunes备份iphone怎么从itunes备份恢复联通版iphone4s怎样看苹果4S是联通版还是电信版win7关闭135端口如何关闭135端口,关闭它有什么影响么?联通合约机iphone5我想问下,我想入手iphone5的联通合约机, 会被坑吗chrome18CHROME现在最新版是多少?
免费com域名注册 广西虚拟主机 西安电信测速 simcentric 安云加速器 uk2 cdn服务器 优惠码 mediafire下载工具 免费网站申请 anylink 数字域名 帽子云 怎样建立邮箱 免费活动 免费cdn 香港新世界中心 in域名 美国独立日 东莞idc 更多