我们知道,微信最开始就是做语音聊天而使得其更加流行的,因此语音的识别处理自然也就成为微信交流的一个重要途径,微信的开发接口,也提供了对语音的消息请求处理。本文主要介绍如何利用语音的识别,对c#开发的微信门户应用的整个事件链的处理操作,使得在我们的微信账号里面,更加方便和多元化对用户的输入进行处理。
1、微信语音接口的定义0微信的api这么定义语音的识别的:开通语音识别功能,用户每次发送语音给公众号时,微信会在推送的语音消息xml数据包中,增加一个recongnition字段。
语音的消息格式如下所示。
<xml>
<tousername><![cdata[touser]]></tousername>
<fromusername><![cdata[fromuser]]></fromusername>
<createtime>1357290913</createtime>
<msgtype><![cdata[voice]]></msgtype>
<mediaid><![cdata[media_id]]></mediaid>
<format><![cdata[format]]></format>
<msgid>1234567890123456</msgid>
</xml>
参数描述
tousername 开发者微信号
fromusername 发送方帐号(一个openid)
createtime 消息创建时间 (整型)
msgtype 语音为voice
mediaid 语音消息媒体id,可以调用多媒体文件下载接口拉取数据。
format 语音格式,如amr,speex等
msgid 消息id,64位整型
根据以上微信接口的定义,我们可以定义一个实体类来对消息的传递进行处理,如下所示。
/// <summary>
/// 接收的语音消息
/// </summary>
[system.xml.serialization.xmlroot(elementname = "xml")]
public class requestvoice : basemessage
{
public requestvoice()
{
this.msgtype = requestmsgtype.voice.tostring().tolower();
}
/// <summary>
/// 语音格式,如amr,speex等
/// </summary>
public string format { get; set; }
/// <summary>
/// 语音消息媒体id,可以调用多媒体文件下载接口拉取数据。
/// </summary>
public string mediaid { get; set; }
/// <summary>
/// 消息id
/// </summary>
public int64 msgid { get; set; }
/// <summary>
/// 语音识别结果,utf8编码
/// </summary>
public string recognition { get; set; }
}
我们看到,这里我们最感兴趣的是语音的识别结果,也就是recognition的字段,这个就是微信服务器自动根据用户的语音转换过来的内容,我测试过,识别率还是非常高的。
这个实体类,在整个微信应用的消息传递中的关系如下所示:
2、语音的处理操作明确了上面的语音对象实体,我们就可以看看它们之间是如何处理的。
微信消息的处理逻辑如下图所示。
其中我们来看看语音的处理操作,我的代码处理逻辑如下所示。
/// <summary>
/// 对语音请求信息进行处理
/// </summary>
/// <param name="info">语音请求信息实体</param>
/// <returns></returns>
public string handlevoice(entity.requestvoice info)
{
string xml = "";
// 开通语音识别功能,用户每次发送语音给公众号时,
// 微信会在推送的语音消息xml数据包中,增加一个recongnition字段。
if (!string.isnullorempty(info.recognition))
{
textdispatch dispatch = new textdispatch();
xml = dispatch.handlevoicetext(info, info.recognition);
}
else
{
xml = "";
}
return xml;
}
在这里,我先看看,是否获得了微信的语音识别结果,如果获得,那么这个时候,就是和处理用户文本输入的操作差不多了,因此把它转给textdispatch的处理类进行处理。
其中这里面的处理逻辑如下所示。
首先我根据识别结果,寻找是否用户读出了微信门户的菜单名称,如果根据语音结果找到对应的菜单记录,那么我们执行菜单事件(如果是url的view类型菜单,我们没办法重定向到指定的链接,因此给出一个链接文本提示,给用户单击进入;如果没有找到菜单记录,那么我们就把语音识别结果作为一般的事件进行处理,如果事件逻辑没有处理,那么我们最后给出一个默认的语音应答提示结果就可以了。
具体的处理代码如下所示。
/// <summary>
/// 如果用户用语音读出菜单的内容,那么我们应该先根据菜单对应的事件触发,最后再交给普通事件处理
/// </summary>
/// <param name="info"></param>
/// <returns></returns>
public string handlevoicetext(basemessage info, string voicetext)
{
string xml = "";
menuinfo menuinfo = bllfactory<menu>.instance.findbyname(voicetext);
if (menuinfo != null)
{
#region 如果找到菜单对象的处理
if (menuinfo.type == "click")
{
//模拟单击事件
requesteventclick eventinfo = new requesteventclick();
eventinfo.createtime = info.createtime;
eventinfo.eventkey = menuinfo.key;
eventinfo.fromusername = info.fromusername;
eventinfo.tousername = info.tousername;
xml = base.dealevent(eventinfo, eventinfo.eventkey);
}
else
{
//由于无法自动切换到连接,
//转换为连接文本供用户进入
string content = string.format("请单击链接进入<a href=\"{0}\">{1}</a> ", menuinfo.url, menuinfo.name);
responsetext textinfo = new responsetext(info);
textinfo.content = content;
xml = textinfo.toxml();
}
#endregion
}
else
{
//交给事件机制处理
if (string.isnullorempty(xml))
{
xml = handletext(info, voicetext);
}
}
//最后如果没有处理到,那么提示用户的语音内容
if (string.isnullorempty(xml))
{
responsetext textinfo = new responsetext(info);
textinfo.content = string.format("非常抱歉,您输入的语音内容没有找到对应的处理方式。您的语音内容为:{0}", voicetext);
xml = textinfo.toxml();
}
return xml;
}
微信门户测试界面效果如下所示。
为了方便对客户会话的记录,我的微信门户后台,会记录用户的语音输入内容,如下所示。
当然,微信后台的管理界面,也能够查到相应的语音记录,界面如下所示。
以上就是我对微信语音的消息定义和事件处理的逻辑,其实语音是一个重要的输入,如果正确的识别内容,比手工输入的效果更好,给用户提供另外一种高效的输入和事件处理操作。
这样的处理模式,能够使得我们整个微信门户框架,不管是对于用户的语音输入,还是文本输入,还是菜单事件的处理,都可以融为一体,实现更加完美的衔接。
更多c#开发微信门户及应用使用语音处理。
