
AVE-ECCV18: ECCV 2018上无束缚视频中的视听事件定位
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
AVE-ECCV18是一项在ECCV 2018会议上提出的研究成果,专注于无约束环境下的视听事件定位技术,利用音频和视觉信息来识别复杂场景中的特定活动。
不受约束的视频中的视听事件本地化(出现在ECCV 2018中)AVE数据集和功能可以从相关渠道下载(文件大小为7.7GB)。在运行代码之前,请先将AVE数据集的视频放入/data/AVE文件夹,将特征文件放入/data文件夹。用于生成音频和视频特征的脚本可以通过分享链接获取并随意修改使用以处理音频和视频数据。需要Python-3.6、Pytorch-0.3.0、Keras以及ffmpeg环境支持。
可视化注意力图运行:python attention_visualization.py
有监督的视听事件本地化测试可以使用本段落中的A + V-att模型,通过执行supervised_main.py命令实现。
全部评论 (0)
还没有任何评论哟~


