教程官方文档2 分钟阅读教程/部署

配置与使用FastGPT应用的语音输入功能

FastGPT的语音输入功能支持用户在前台对话中通过语音录入并自动转换为文字,适用于移动端、客服、现场记录等不方便打字的场景。

FastGPT的语音输入功能支持用户在前台对话中通过语音录入并自动转换为文字,适用于移动端、客服、现场记录等不方便打字的场景。该功能存在明确的使用边界:若浏览器或当前环境不支持语音录入,前台会直接提示浏览器不支持语音输入;开启自动语音回复时,必须同时开启语音播报配置,否则AI仅会生成文字回复,不会自动播放语音回复。

配置步骤与参数说明

进入目标应用的编辑页,找到「语音输入」配置项,点击右侧的设置按钮即可打开语音输入配置弹窗。弹窗内包含三个核心配置项:

  1. 开启语音输入:勾选后,前台对话的输入框将显示语音录入入口,支持用户点击录音并自动转文字。
  2. 自动发送:勾选后,语音识别为文字后系统将自动发送该内容,无需用户手动点击发送按钮;取消勾选则需用户在发送前检查并确认识别的文字内容。
  3. 自动语音回复:勾选后,通过语音输入发送的问题,AI生成的回复将自动以语音形式播放。

使用建议与易错提醒

面向移动端或现场记录场景的应用,可开启语音输入功能以提升用户输入效率。对语音识别准确性要求较高的场景,建议关闭自动发送选项,让用户先确认识别的文字内容后再发送。若需要连续的语音交互流程,可同时开启自动发送和自动语音回复功能。需要注意的是,自动语音回复功能依赖语音播报配置,未开启语音播报时,即使勾选自动语音回复,也不会自动播放AI回复的语音内容。

来源:https://doc.fastgpt.cn/zh-CN/guide/build/general/voiceInput