最佳实践 | 基于腾讯云MRCP-Server打造简单智能外呼系统

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

一、智能外呼架构简介

智能外呼在国内已发展多年,整体的技术早已非常成熟。那么一个简单的智能外呼系统应该包含哪些东西呢?

 

  • 运营商:运营商的线路资源是外呼系统的基础,国内就是移动、联通、电信,也有一些集成商。
  • 呼叫中心:呼叫中心相关的软硬件用来对接运营商线路,市面上成熟产品很多,各大云厂商也都有相关的云服务。
    • 开源方案也有一些,如freeswitch、asterisk,网上有很多的资料可以参考。
  • 外呼SAAS平台:用来串起来整个通话流程,这部分的实现相对来说最容易,国内各厂商基本都是自研
  • AI能力:语音识别、语音合成、以及智能对话平台能力,关乎到智能外呼系统核心的体验、是否智能、拟人化等

智能外呼简单流程

上面介绍了智能外呼系统的大概组成,那具体是如何运行的呢?下面是一个简单的疫情调研外呼电话例子。

 

示例中,存在两轮对话,方框内容为机器人语音播报,两次回答“是否本人”、“是否阳性”是客户回答,走语音识别后进行判定。

在智能外呼系统中,对接语音识别和语音合成的部分,通常来说有两种方式:

  1. 外呼SAAS平台直接调用语音识别、语音合成
    • 这种方式一般用完整的客户音频流去做语音识别(以便支持播报中打断、播报中关键词逻辑、播报中打断&回复等功能)
  2. 通过IVR调用MRCP-Server接口来调用语音识别、语音合成
    • 每次语音识别的音频,是机器人播报后,触发识别的一小段音频(类似上面示例中,就是“是否本人”“是否阳性”两段回答的语音片段)

下面我们分别看下两种方式对应的序列图。

无MRCP-Server流程

  • 该方案的开发成本较高,通话流程的控制逻辑很大一部分在“外呼SAAS平台”内,且要对接语音识别、语音合成、智能对话平台等部分
  • 外呼通话接通的时候,客户的音频流就持续推到外呼SAAS平台,音频流持续送入语音识别,得到实时识别结果
  • 完整通话识别结果可以用来实现机器人播报中打断、播报中客户关键词识别&处理(如转人工、新回复等)等

 

有MRCP-Server流程

  • 该方案的开发成本相对2.1要低不少,对接语音识别、语音合成的MRCP-Server一般各大厂商有现成的组件,不用去开发
  • 该方案只有机器人播报完/被打断后,才会调用mrcp-server启动识别,送入客户音频去做语音识别

 

MRCP作为标准协议,基本市面上的呼叫中心都是支持的,对接起来也较容易,下面讲一下笔者对接腾讯云MRCP-Server的过程。

二、腾讯云MRCP-Server对接

开始对接之前,我们需要先开通腾讯云的语音识别、语音合成服务。

开通语音识别&语音合成

分别点击 腾讯云语音识别控制台 ,腾讯云语音合成控制台, 点击立即开通服务。

 

可以点击这里领取一个新人的体验资源包: 语音识别_实时语音识别_录音文件识别_语音转文本服务 - 腾讯云

 

获取调用服务的API密钥

访问腾讯云的服务,都需要一个秘钥,在腾讯云访问管理的API密钥管理页面,可以新建一个秘钥,这个一定要保管好,不能泄露出去,防止被盗用。秘钥后面我们要用到。

 

MRCP-Server部署

腾讯云的MRCP-Server有现成的部署包,不用自己开发对接ASR&TTS,可

【unimrcp源码阅读】1. mrcp_server的机制 以asr自定义插件为例,采用mrcpv2协议。阅读方法,查看源码结合运行日志session 和 channelmpf: Media Processing Framework 媒体处理框架mrcp Media Resource Control Protocol 媒体资源控制协议。 阅读详情

相关推荐

开源代码走读--unimrcp

当unimrcp作为录音仪使用时,其rtp数据流在client端得发送流程及server端的解析流程

HAH--M的博客 1290

SDM(MRCP-SERVER)公共云镜像使用.pdf

freeswitch 使用sdm对接阿里云mrcp-server 接入asr和tts,让人工智能更美好

unimrcp 配置文件说明(三)

一、环境: PC操作系统:CentOS Linux release 7.9.2009 (Core) gcc 版本:4.8.5 20150623 (Red Hat 4.8.5-44) (GCC) unimrcp版本:1.7.0 本文主要是记录一下关于配置文件的研究。 unimrcp为服务端和客户端,即 unimrcpserver 和 unimrcpclient 。 二、服务端和客户端共用配置文件 文件如下: logfile.xml(日志文件说明) logger.xml(日志输出配置) dirlayout

hrx-@@ 3640

mrcp_server:实验性媒体资源控制协议服务器

mrcp_server 这是一个进展中的工作。 这是一个实验性的媒体资源控制协议服务器,我出于学习目的而为node.js编写。 最初的媒体平台将是Google语音。 到目前为止测试: 启动服务器: cd mrcp_server npm install export GOOGLE_APPLICATION_CREDENTIALS=/path/to/your/credentials_file.json cp config/default.js.sample config/default.js vim config/default.js # ajdust parameters if necessary node index.js 然后克隆并执行以下操作: cd mrcp_client apt/yum install sox npm install

智能客服搭建(3) - MRCP Server 与 FreeSWITCH 对接

文章目录1. 写在前面2. MRCP Server 配置与测试2.1 MRCP Server 配置2.2 MRCP Server 测试3. FreeSwitch 配置3.1. 配置 mrcp profile3.2. 配置 mrcp conf3.3. 配置拨号任务4. 效果测试 1. 写在前面   上一篇文章中,对MRCP Server的开发进行了介绍,下面讲解如何通过配置让FreeSWITCH能够与MRCP Server进行对接,获得电话呼叫的语音识别结果。 2. MRCP Server 配置与测试 2.1

小爱玄策 7328

智能客服搭建(2) - MRCP Server ASR插件开发

文章目录1. 编码前准备1.1 新建plugin1.2 修改configure.ac1.3 新增源代码及目录2. 代码编写2.1 语音引擎类封装2.2 MRCP Server 框架代码编写2.2.1 引用头文件2.2.2 新增类的变量2.2.3 框架核心函数介绍mrcp_plugin_createshenghan_recog_engine_destroyshenghan_recog_engine_channel_createshenghan_recog_channel_destroyshenghan_rec

小爱玄策 6642

mrcpserver下载地址

下载地址搭建百度mrcpserver与freeswitch对接下载地址最佳实践 | 基于腾讯云MRCP-Server打造简单智能外呼系统-腾讯云开发者社区-腾讯云

weixin_62000631的博客 404

【亲测免费】 阿里语音识别MRCP Server插件:开启高效语音交互新纪元

阿里语音识别MRCP Server插件:开启高效语音交互新纪元 项目介绍 本项目是一个基于阿里语音识别SDK 2.0开发的MRCP Server服务插件。通过该插件,用户可以轻松地将阿里的语音识别功能集成到现有的MRCP(Media Resource Control Protocol)服务器中,实现高效的语音交互。目前,该插件已在CentOS 6.9-64位和Windows 10系统上成功编译并通...

gitblog_00381的博客 836

外呼系统《MRCP协议进行智能外呼》

市面上99%的电销外呼系统都基于此MRCP介绍 本文使用 media bug 进行媒体监听的方式,搭建基于飞的 adk、以及 unimrcp-server 与 freeswitch 的对接 MRCP介绍 本文将讲解外呼系统对接 mrcp(如mrcp),首先介绍一下 MRCP 的基础

gallonyin的博客 7482

智能客服搭建(1) - MRCP Server 搭建

文章目录1. 主要目的2. 配置编译UniMRCP Server(1) 源码下载(2) 编译环境准备(3) 编译安装(4) 测试运行 1. 主要目的   市面上大部已建的呼叫中心,关于语音对接这部,默认支持MRCP协议,为了实现和其他呼叫系统的快速对接,实现支持MRCP协议的语音引擎的开发是很重要的,为了将三方ASR/TTS的能力像插件一样集成到MRCP Server中,我们先研究MRCP Server的搭建。   在此感谢以下2篇文章的作者,为这次研究提供了非常好的思路和方法。   https://g

小爱玄策 5376

阿里智能语音V2.X SDM(MRCP-SERVER)技术文档

阿里智能语音V2.X SDM(MRCP-SERVER)技术文档 去发现同类优质开源项目:https://gitcode.com/ 本仓库提供的资源文件为《阿里智能语音V2.X SDM(MRCP-SERVER)技术文档(1).pdf》,本文档详细介绍了自动语音识别(ASR)、自动语音合成(TTS)、自然语言理解(NLU)以及交互式语音应答(IVR)等技术。 ASR语音识别技术,目标是将人类语音中的词...

gitblog_06720的博客 592

【使用Unimrcp和Funasr构建呼叫中心语音识别服务端】

此次使用的是unimrcp1.6版本,先下载unimrcp-deps-1.6.0以及unimrcp-1.6.0进行构建,此处不过多赘述。处理funasr返回的数据,构建xml返回给freeswitch,此次vad使用的是webrtc vad。此步骤,主要是使用websocket去连接funasr服务端,(funasr的部署自行百度),在。成功加载funasr识别模块。创建funasr连接,在。Freeswitch日志。成功启动funasr。

qq_22218713的博客 3280

基于Freeswitch + Unimrcp + 谷歌ASR 的语音识别的实现

准备: 你要有国际信用卡开通谷歌云服务的账号,并申请一个项目,然后使用ASR语音识别 装好一台Freeswitch服务器,并编译好unimrcp.so模块 装好一台centOS 7服务器,用来跑unimrcp 开始: 一,unimrcp服务器的安装和配置 官方文档:http://www.unimrcp.org/manuals/html/GoogleSRRPMInstallation...

chuiyg的专栏 7375

【Linux】Centos7安装部署unimrcp,搭建MRCP服务器

Centos7安装部署unimrcp,搭建MRCP服务器

姜太小白的博客 2010

搭建百度Mrcp Server与Freeswitch的mod_unimrcp对接实现智能客服

媒体资源控制协议(MRCP)是基于客户端/服务器模型的网络协议。MRCP允许客户端应用程序控制驻留在服务器中的媒体服务资源。该协议的第一个版本作为信息文件发布,而其后续版本MRCPv2目前是一个提议的标准。百度MrcpServer提供了在unimrcp中集成百度ASR语音识别,提供给Freeswitch或者Asterike调用实现智能客服! 一、搭建MrcpServer 环境需求: Linu...

irizhao的专栏 2927

unimrcp client 和 server 简述

一、unimrcp client 1 client 栈初始化 1.1 创建 client 栈实例 通常情况下,每一个 client 栈都由一个进程创建,默认情况下 client 的配置是从配置文件中加载的,但也可以通过调用 API 来创建和初始化堆栈。配置项的由结构体 apt_dir_layout 指定。 源码: apt_dir_layout_t *dir_layout = apt_defaul...

qq_23867503的博客 3364

MRCP Server:面向生产环境的高性能 MRCP 服务实现

本文介绍了一个自研的高性能MRCP Server实现,专为生产环境设计,用于连接语音平台(如FreeSWITCH/Asterisk)与ASR/TTS引擎。该服务支持MRCPv2协议,已完成对FunASR(ASR)和ModelScope(TTS)的适配,但不包含具体语音模型和推理能力。项目强调稳定性、扩展性和生产级架构,用户需自行部署后端语音服务。核心功能包括协议解析、会话管理和音频流转,兼容标准MRCP客户端。使用需申请License授权。

qq_22218713的博客 523

mrcp server java

我整理的一些关于【java】的项目学习资料(附讲解~~)和大家一起享、学习一下:https://d.51cto.com/bLN8S1如何实现 MRCP Server 在 Java 中 介绍 Multimedia Resource Control Protocol (MRCP) 是一种用于多媒体资源控制的协议,通常用于语...

weixin_35417884的博客 764

智能电话机器人--基于 UniMRCP 实现飞 ASR MRCP Server

通过实现 UniMRCP 的 plugin,我们可以封装飞、百度、阿里等厂家的 ASR 接口,实现我们自己的 MRCP 服务器。 什是 MRCP 媒体资源控制协议(Media Resource Control Protocol, MRCP)是一种通协议,用于媒体资源服务器向客户端提供各种语音服务,目前已定义的媒体资源服务有语音识别(Speech Recognition)、语音合成(Sp...

dalangtaosha2011的专栏 1万+
上一篇: 最佳实践|用腾讯云智能文字识别实现网约车信息管理
下一篇: 最佳实践 | 使用WebSocket做个实时人脸活体比对服务
威武得娘娘
博客等级 码龄6年 15粉丝 25原创
评论 1
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值