
i-vector工具箱
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
i-vector工具箱是一款用于语音和说话人识别研究的软件包,提供了一系列算法来提取能够表征语音特征的i-vector。
介绍了一个用于身份验证的GMM-UBM(高斯混合模型通用背景模型)及i-vector方法的Matlab代码包。
该代码包包括两个主要部分:一个是基于GMM-UBM的方法,另一个是更先进的i-vector技术。这两个过程都涉及训练、适配或提取特征向量,并使用这些信息来验证和识别说话人身份的过程。以下是每个步骤的具体描述:
### GMM-UBM Demo
1. **创建通用背景模型(UBM)**:从所有训练数据中生成一个包含一定数量混合成分的GMM。
2. **适配个体模型**:将UBM映射到每位发言人的具体特征上,形成个性化的GMM模型。
3. **计算验证分数**:利用步骤2中的个性化模型和测试数据集来评估匹配度,产生每个说话人之间的对比评分矩阵。
4. **性能测量**:通过混淆矩阵或EER(等错误率)这样的指标来衡量系统的表现。
### i-vector Demo
1. **UBM训练**:与GMM-UBM方法类似,首先从所有背景数据中生成一个通用模型。
2. **学习总变化子空间和提取开发集i向量**:
- 计算用于iVector建模的统计信息,并通过这些信息构建整个说话人数据库中的总体可变性(Total Variability)空间。
- 使用训练好的UBM及TV空间对每个发言人的数据进行处理,获得相应的i向量表示形式。
3. **PLDA模型训练**:应用线性判别分析(LDA)来减少特征维度,并利用开发集的i向量信息构建一个高斯PLDA(Probability Linear Discriminant Analysis)模型。
4. **生成测试和验证数据的得分矩阵**:
- 使用步骤2中获得的平均IVs作为模型,同时计算所有可能对比情况下的分数。
5. **性能评估**:使用混淆矩阵或EER来衡量系统的准确性。
这些脚本提供了从基础训练到最终识别过程中的全面指导,并展示了如何在人工生成的数据集上实现和测试这两种技术。
全部评论 (0)


