Skip to main content
袋袋支持语音输入,让你可以用说话的方式与专家交流。语音会被实时转写为文字,然后作为文本消息发送给专家。

如何使用

1

点击麦克风图标

在输入框右侧找到麦克风图标,点击开始录音。首次使用时,浏览器会请求麦克风权限——点击「允许」即可。
2

开始说话

看到录音指示后,对着麦克风说出你的需求。说话时语音会被实时转写为文字,你可以在输入框中看到转写的内容。
3

完成录制

说完后,点击停止按钮结束录音。转写完成的文字会自动填入输入框。
4

编辑并发送

转写的文字出现在输入框后,你可以在发送前进行编辑修正。确认无误后按下发送按钮。

支持的语言

语音输入支持多种语言,包括:
  • 中文(普通话)
  • 英文
  • 中英混合
如果你的表述中包含中英混合的专业术语(如「帮我优化这个 React component 的 performance」),语音转写能够自动识别并正确处理两种语言。

语音输入 vs 语音朗读

袋袋的音频能力分为两个独立方向: 语音输入是你向专家表达需求的方式,专家的回复默认仍然是文字。如果你想让专家的回复也以语音播放,可以点击每条回复旁边的朗读图标。

使用建议

语音转写的准确率取决于发音清晰度。建议在安静的环境中使用,避免背景噪音影响识别效果。
对于较长的需求,可以分成几段来说。每段表达一个完整的意思,这样转写效果更好。
语音转写后,你可以在输入框中手动修正可能的识别错误,或补充文字无法口述的内容(如代码片段、链接等)。语音和文本输入可以自由混合使用。
技术术语和缩写词(如 API、CSS、JSON)的识别效果可能不稳定。如果发现转写不准确,发送前手动修正即可。

常见问题

请检查浏览器是否已授予麦克风权限。在浏览器地址栏左侧通常有权限管理图标,确保袋袋的麦克风权限为「允许」。
平台侧没有设时长上限——录音会一直持续到你手动停止,界面上的秒数只是计时显示,不会自动截断。但这不等于可以无限录:转写请求要把整段音频一次性上传,实际上限由上游转写服务的单请求体积决定(常见为 25 MB 量级)。超出时会转写失败而不是被提前打断,所以长内容建议分段录入。
不消耗。转写接口不走计费链路,不扣积分。消耗积分的是转写完成之后——转写结果作为文字进入对话,那轮对话按所选模型的 token 费率计费。所以语音输入和手动打字的成本是一样的。
核对日期 2026-08-11。来源:apps/web/src/hooks/useAudioRecorder.ts(无自动停止定时器)、services/core/src/routes/audio/index.tsPOST /transcribe 无体积校验、无计费调用)。
语音输入需要有效的网络连接。离线环境下语音转写功能不可用。