使用科大讯飞语音转文字的服务进行电话录音分析

2020-02-08 954

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介：

需求

合规性质检：1）设定规则，实现自动质检，自动打分；2）如VOC文本质检可与语音文字进行匹配，自动判断是否合格；3）新媒体文本可自动质检4）可识别异常录音（指定标准外）；5）诉求记录与语音内容是否可匹配，检测内容是否一致（关键词）；6）系统自我检测，对需要质检员校准的分析进行识别；7）特定内容判断是否合规（如蒸箱拨测内容）。

分析功能

(1) 对指定的录音进行制定规则的分析（如交互时长）。
(2) 对指定的某类型录音记录，自动找根因（如重复来电、不满意分析、满意、外拨分析，系统自我检测，对需要质检员校准的分析进行识别）。
(3) 通过语音、语调、语速等识别客服和客户的情绪和态度。
(4) 语音语调的范围（用来匹配哪种语音语调的客户满意度高）。
(5) 筛选录音时长，对过长的录音进行预先分析。

我们solution proposal的文档里打算用科大讯飞的service，但是他无法满足3和4这两个requirement。
我对可达讯飞的service做了简单的测试: 其工作原理是通过讯飞的SDK将本地语音文件上传到讯飞的server上，server通过http response以json格式返回给consumer. 附件是我用于测试的一个语音文件，我说的话是”测试一下Netweaver对于并发请求的响应性能”.

测试结果

(1) 所有中文均能成功转成文字; 但英文Netweaver的语音转换成了Net ball
(2) 智能分词也能按照期望工作，比如“测试一下”成功地分词成了“测试”和“一下”。

本文来自云栖社区合作伙伴“汪子熙”，了解相关信息可以关注微信公众号"汪子熙"。

相关实践学习

一键创建和部署高分电影推荐语音技能

本场景使用天猫精灵技能应用平台提供的技能模板，在2-5分钟内，创建一个好玩的高分电影推荐技能，使用模板后无须代码开发，系统自动配置意图、实体等，新手0基础也可体验创建技能的乐趣。

达摩院智能语音交互 - 声纹识别技术

声纹识别是基于每个发音人的发音器官构造不同，识别当前发音人的身份。按照任务具体分为两种：声纹辨认：从说话人集合中判别出测试语音所属的说话人，为多选一的问题声纹确认：判断测试语音是否由目标说话人所说，是二选一的问题（是或者不是）按照应用具体分为两种：文本相关：要求使用者重复指定的话语，通常包含与训练信息相同的文本（精度较高，适合当前应用模式）文本无关：对使用者发音内容和语言没有要求，受信道环境影响比较大，精度不高本课程主要介绍声纹识别的原型技术、系统架构及应用案例等。讲师介绍：郑斯奇，达摩院算法专家，毕业于美国哈佛大学，研究方向包括声纹识别、性别、年龄、语种识别等。致力于推动端侧声纹与个性化技术的研究和大规模应用。

使用科大讯飞语音转文字的服务进行电话录音分析

需求

分析功能

测试结果

汪子熙

热门文章

最新文章

相关课程

相关电子书

相关实验场景