BaiduSpeech 拓展:百度语音识别与语音唤醒

« 返回首页

logo BaiduSpeech 拓展

基于百度语音 Android SDK 的在线语音识别与语音唤醒扩展(文档)。

语音合成(TTS)暂不提供:百度语音合成为另一套 SDK 且授权较贵,本扩展只做识别与唤醒。

使用前需在百度智能云创建“语音技术”应用,获取 AppId / ApiKey / SecretKey。语音唤醒已内置示例唤醒词文件 WakeUp.bin,开箱即用;也可换成百度生成的自定义唤醒词。

打包架构:arm64-v8a + armeabi-v7a(覆盖绝大多数真实安卓手机)。

  • .aix 拓展下载:

cn.fun123.BaiduSpeech.aix


属性

AppId
百度智能云应用的 AppId。
ApiKey
百度智能云应用的 API Key。
SecretKey
百度智能云应用的 Secret Key。
Pid
识别语言模型 PID:1537=普通话(近场)、1737=英语、1637=粤语、1936=普通话(远场)等。
WakeWordFile
唤醒词文件路径(assets:///文件名 或设备绝对路径),由百度生成。
EnablePartial
是否回传临时(不稳定)识别结果(PartialResult 事件)。

事件

RecognizeReady()
识别引擎就绪,可以开始说话。
SpeechBegin()
检测到用户开始说话。
SpeechEnd()
检测到用户停止说话。
PartialResult(text)
临时(不稳定)识别结果,持续触发。
Result(text,raw)
稳定识别结果。text 为识别文本,raw 为完整 JSON。
VolumeChanged(volumePercent)
实时音量回调(0~100)。
RecognizeError(errorCode,subError,message)
识别出错。
RecognizeFinish()
本次识别正常结束。
WakeUpSuccess(word)
命中唤醒词,word 为识别到的唤醒词。
WakeUpError(errorCode,message)
唤醒出错。

方法

StartRecognize()
开始在线语音识别(需录音权限)。引擎就绪后触发 RecognizeReady,过程中触发 PartialResult / Result。
StopRecognize()
停止识别(结束说话,等待最终结果)。
CancelRecognize()
取消识别(立即丢弃,不返回结果)。
StartWakeUp()
开始语音唤醒(持续监听唤醒词,命中触发 WakeUpSuccess)。
StopWakeUp()
停止语音唤醒。

使用流程

  1. 设计器放入 BaiduSpeech,填 AppId / ApiKey / SecretKey。
  2. 识别:调用 StartRecognize,在 RecognizeReady 后说话,PartialResult 实时显示、Result 取稳定文本,StopRecognize 结束。
  3. 唤醒:扩展已内置示例唤醒词(WakeWordFile 默认 assets:///WakeUp.bin),调用 StartWakeUp,命中触发 WakeUpSuccess,可在其中再启动识别;如需自定义唤醒词,把百度生成的文件放入素材并设置 WakeWordFile。
文档反馈