使用统软云低代码开发平台讯飞SDK快速实现语音识别演示
手机APP开发
APP开发
浏览:1296 次

语音识别是一项非常流行的功能,它可以在特定情况下为人们带来便捷的交互体验,例如在开车时使用语音唤醒手机、各种智能音频产品、声控智能电视等。
本文介绍了如何使用统软云快速实现语音识别。
iflyRecognition模块封装了讯飞SDK的语音听写和在线语音合成功能。(一般来说,它是语音识别和文本阅读。)
模块文档地址:统软云 iflyRecognition模块–手机APP开发、APP生产、APP定制平台
这个小演示实现了将语音转换为文本并在页面上显示的功能。
使用过程:
1.转到科大讯飞开放平台nbsp;IFLYTEK开放平台-以语音交互为核心的AI开放平台;注册帐户。
2.在科大讯飞开放平台上创建app,并添加语音听写和在线语音合成服务。
3.创建Android自定义模块。有关相关说明,请参阅模块文档。
从科大讯飞下载的合成sdk如下所示:
根据文档提示定制模块。
重新压缩后,将其上载到自定义模块并将其添加到项目中。
根据模块文档调用接口:
1。& nbsp;
创建实用程序
创建讯飞引擎
createUtility({params},回调(ret,err))
参数
android_app:
类型:字符串
描述:从科大讯飞开放平台获得的appid(android端)
ios_appid:
类型:字符串
描述:从科大讯飞开放平台获得的appid(iOS)
例子:
var iflyRecognition=api.require('flyRecognition');
iflyRecognition.create实用程序({
ios_appid:'6041***', ; ;//填写在科大讯飞平台上获得的appidnbsp; ; ;
android_ appid:'6041***' ;//填写在科大讯飞平台上获得的appid;
},函数(ret,err){
if(ret.status){
每个警报({
msg:'创建成功';
});
}其他{
每个警报({

msg:“创建失败”
});
}
});
2.
记录
识别语音返回文本
记录({params},回调(ret,err))
参数
瓦多斯语:
类型:编号
描述:(可选)前断点时间(静音时间,即用户不发言超时处理的时间)。范围为0-10000单位/秒
默认值:5000
瓦迪奥斯:
类型:编号
描述:(可选)断点后时间(静音时间,即用户不发言超时处理的时间),单位:毫秒,范围:0-10000
默认值:5000
费率:
类型:编号
说明:(可选)采样率(支持160008000)
默认值:16000
asrptt文件:
类型:编号
说明:(可选)返回的语句是否有标点符号。值范围:0-无,1-有
默认值:1
音频路径:
类型:字符串
描述:(可选)保存录制的音频文件的路径(例如,fs://123/pcm,确保添加后缀;确保添加后缀,仅允许第一级目录,不允许第二级机器的第二级以上的目录,例如,fs://test/123/pcm不允许),并且不支持小部件协议。注意:由于iOS平台上讯飞SDK的限制,仅支持pcm格式的音频保存
注意:如果未传输,则不保存
回调(ret-err)
回复:
类型:JSON对象
内部字段:
{
;状态:真nbsp; ;//布尔型;操作成功状态值,true|false
;wordStr: ; ; ; ;//字符串类型;语音识别后的文本

;事件类型:'';, ; ;//字符串类型;交互事件类型:
 nbsp; ; ; ; ; ; ; ; ;//record_ End:录制结束事件(仅支持ios)
 nbsp; ; ; ; ; ; ; ; ;//识别_结束:识别结束事件
 nbsp; ; ; ; ;//识别_开始:识别开始事件(仅支持Android)
}
例子:
var iflyRecognition=api.require('flyRecognition');
iflyRecognition.record({
vadbos:5000,
vadeos:2000,
比率:16000,
asrptt:1,
audioPath:“fs://myapp/speech.pcm”
},函数(ret,err){
if(ret.status){
如果(ret.wordStr){
让wordStr=ret.wordStr;
即.data.items.push(wordStr);
该数据。isOk=真;
//flag=假;
}
}其他{
//每个警报({
// nbsp;消息:错误.msg
// });
}
});
完整代码如下:
<模板>
<安全区域>