齿轮厂家
免费服务热线

Free service

hotline

010-00000000
齿轮厂家
热门搜索:
成功案例
当前位置:首页 > 成功案例

快商通发明单通道电话人声分离技术标准卡地板插座铸钢阀门剃毛器输送泵Frc

发布时间:2024-01-09 16:34:25 阅读: 来源:齿轮厂家

快商通发明单通道人声分离技术

自声纹识别技术被推广应用以来,声纹库建设的数据来源,一直是从业者们头疼的难题。

对于金融、保险、证券、市场调研、电商等拥有呼叫中心,并会产生大量语音数据的领域来说,建设声纹库本不是难事,但受历史技术水平的限制,这些领域所存储的历史语音数据来源大多为单通道,客服与客户的声音共存在同一段音频之中,难以分割,无法发挥数据价值。

最近,Kriston AI Lab发明了一种基于深度学习的单通道语音快速人声分离技术(简称 单通道人声分离 ),破解了复杂场景下的人声分离的难题,将银行、保险、市场调研等行业的呼叫中心历史语音数据变废为宝,大大降低了声纹数据库的建设门槛。

一、无需人工干预的信道人声分离

呼叫中心的语音,同时存在客服和客户两种不同的声源,如何分辨出特定人物的声音,这对于我们人类来说十分简单,但对于计算机来说,要把一个音频分割成精密机械多个不同的语音来源,却要面临很多困难。

尤其是多人声音重叠部分,分离效果差,且需要采集大量的相关音频进行单独优化,无疑是一种事倍功半的行为。

Kriston AI Lab提出的这种信道人声分离技术,以深度学习的方法实现数据模型训练,无需人工干预,便可以将单通道信道音频中两个不同说话人的音频进行拆分,分别保存,实现端到端的信道人声分离。

二、信道人声分离是如何 炼 成的?

人声分离技术以深度安装步骤1定要认真浏览了解学习技术为基础,构建多层RNN循环神经络。

1、利用现实生活中信道双通道音频作为训练的数据集,将信道双通道音频合并为融合左通道客服音频和右通道客户音频的单通道音频作为整个模型训练的输入音频,将双通道音频直接读取的左通道音频和右通道音频作为络训练的标签音频;

2、输入单通道融合客服和客户音频到整个络当中,络的输出结果为模型预测出来的拆分客服和客户后的左通道音频和右通道音频;

3、将模型预测拆分的左通道音频和右通道音频,与原始双通道音频读取的左通道音频和右通道音频进行损失值的计算,训练整个模型络的参数;

4、当模型训练拟合之后,将模型取出,输入现实生活中信道单通道音频,模型输出的音频即为拆分后的左通道音绘图板频(客户)和右通道客服(客服)路用涂料。

三、信道人声分离能发挥怎样的作用?

信道人声分离的最大作用,便是利用分割后的音频进行声纹库注册,以实现反欺诈、营销等功能。

在银行推动可再生能源发展领域,客服会对逾期不还的订单进行提醒,从而产生大量的不还款语音数据,如果彼时该银行使用的是单通道通话,可以应用快商通信道人声分离技术对失信者音频进行分割。分割后的音频,便成为黑声纹库建设中历史黑产数据的重要来源。银行可进一步以黑声纹库为基础,准确识别黑名单用户,从源头上降低坏账率,完善金融反欺诈链条。

在营销方面,使用快商通信道人声分离技术,可以对客服外呼进行客户音频分割,将客户声音与会员标签、交易标签、营销标签等特征相匹配,统一由后台系统进行管理,实现高质量的营销。

技术日趋成熟、政策大力支持,声纹识别这种身份认证方式已逐渐被各领域所认可,但与此同时,种种实际应用问题也浮出水面,声纹库建设的数据来源便是使用者们需要跨过的首个难关。

Kriston AI Lab从客户的需求出发,推出能够解决复杂场景下的人声分离技术,为银行、保险、证券、市场调研、整体将该装备分为驱动系统、液压施力系统、磨擦副、数据收集系统电商等行业呼叫中心提供了声纹库建设的可行性方案。未来,Kriston AI Lab将持续发挥国际领先的算法优势,完善声纹识别技术与产品的服务能力,推动产业链上下游共同发展。

附:Kriston AI Lab由快商通于2012年创建,粘土砖专注于自然语言处理、声纹识别和大数据技术研发,现由李海洲教授牵头负责。Kriston AI Lab共申请400余项发明专利,为医疗、教育、金融、公安、智能家居等行业提供AI技术服务。

双鱼女对男友怎么样
松雅湖中学有多少个班
民族舞蹈有多少种
清华学生有多少人