BaiduSpeech 拓展
基于百度语音 Android SDK 的在线语音识别与语音唤醒扩展(文档)。
语音合成(TTS)暂不提供:百度语音合成为另一套 SDK 且授权较贵,本扩展只做识别与唤醒。
使用前需在百度智能云创建“语音技术”应用,获取 AppId / ApiKey / SecretKey。语音唤醒已内置示例唤醒词文件 WakeUp.bin,开箱即用;也可换成百度生成的自定义唤醒词。
打包架构:arm64-v8a + armeabi-v7a(覆盖绝大多数真实安卓手机)。
- .aix 拓展下载:
属性
- AppId
- 百度智能云应用的 AppId。
- ApiKey
- 百度智能云应用的 API Key。
- SecretKey
- 百度智能云应用的 Secret Key。
- Pid
- 识别语言模型 PID:1537=普通话(近场)、1737=英语、1637=粤语、1936=普通话(远场)等。
- WakeWordFile
- 唤醒词文件路径(
assets:///文件名或设备绝对路径),由百度生成。 - EnablePartial
- 是否回传临时(不稳定)识别结果(PartialResult 事件)。
事件
- RecognizeReady()
- 识别引擎就绪,可以开始说话。
- SpeechBegin()
- 检测到用户开始说话。
- SpeechEnd()
- 检测到用户停止说话。
- PartialResult(text)
- 临时(不稳定)识别结果,持续触发。
- Result(text,raw)
- 稳定识别结果。text 为识别文本,raw 为完整 JSON。
- VolumeChanged(volumePercent)
- 实时音量回调(0~100)。
- RecognizeError(errorCode,subError,message)
- 识别出错。
- RecognizeFinish()
- 本次识别正常结束。
- WakeUpSuccess(word)
- 命中唤醒词,word 为识别到的唤醒词。
- WakeUpError(errorCode,message)
- 唤醒出错。
方法
- StartRecognize()
- 开始在线语音识别(需录音权限)。引擎就绪后触发
RecognizeReady,过程中触发PartialResult/Result。 - StopRecognize()
- 停止识别(结束说话,等待最终结果)。
- CancelRecognize()
- 取消识别(立即丢弃,不返回结果)。
- StartWakeUp()
- 开始语音唤醒(持续监听唤醒词,命中触发
WakeUpSuccess)。 - StopWakeUp()
- 停止语音唤醒。
使用流程
- 设计器放入 BaiduSpeech,填
AppId/ApiKey/SecretKey。 - 识别:调用
StartRecognize,在RecognizeReady后说话,PartialResult实时显示、Result取稳定文本,StopRecognize结束。 - 唤醒:扩展已内置示例唤醒词(
WakeWordFile默认assets:///WakeUp.bin),调用StartWakeUp,命中触发WakeUpSuccess,可在其中再启动识别;如需自定义唤醒词,把百度生成的文件放入素材并设置WakeWordFile。
扫码添加客服咨询