FastGPT的语音输入功能支持用户在前台对话界面进行语音录入,并自动将语音识别转换为文字,适用于移动端、客服、现场记录等不方便手动打字的场景。该功能的配置入口位于应用编辑页的「语音输入」配置项中,点击配置项右侧的设置按钮,即可打开语音输入配置弹窗进行相关设置。
配置参数详解
- 开启语音输入:勾选后,前台对话的输入框会显示语音录入入口。用户点击后可开始录音,录音完成后系统自动将语音识别为文字;若浏览器或当前环境不支持语音录入,前台会弹出提示「浏览器不支持语音输入」。
- 自动发送:勾选后,用户完成语音录入并识别为文字后,系统会自动发送该内容,无需手动点击发送按钮;若关闭该选项,用户可在发送前检查识别的文字内容,确认无误后再手动发送。
- 自动语音回复:勾选后,通过语音输入发送的问题,AI生成的回复会自动以语音形式播放。需要注意的是,该功能需同时开启语音播报配置,若未开启语音播报,AI仍会正常生成文字回复,但不会自动播放语音。
快速配置步骤与使用建议
快速配置步骤
- 登录FastGPT后台,进入目标应用的编辑页面;
- 在页面中找到「语音输入」配置项,点击其右侧的设置按钮,打开配置弹窗;
- 根据业务需求勾选对应配置项:例如面向移动端或现场记录场景,可同时开启语音输入、自动发送和自动语音回复;若对语音识别的准确性要求较高,建议关闭自动发送,让用户先确认识别文本;
- 保存配置后,前台对话界面即可生效。
使用建议
面向移动端或现场场景的应用,开启语音输入可有效提升用户输入效率;对识别准确性要求较高的场景,建议关闭自动发送,让用户先检查并确认识别的文字内容;需要进行连续语音交互的场景,可以同时开启自动发送和自动语音回复,实现流畅的语音对话体验。
来源:https://doc.fastgpt.cn/zh-CN/guide/build/general/voiceInput