增加语音输入时长上限,或支持自动分段处理

目前语音转文字功能的单次录音上限只有 5 分钟。实际使用中,我经常会用它进行较长时间的思考、表达和整理思路,5 分钟很容易被强制中断,导致表达不完整,后续还需要等待语音转文字和润色完成后再重新开始,使用体验上比较割裂。

希望可以考虑增加以下几个功能:

1. 提高或取消 5 分钟录音上限

如果技术和成本允许,希望可以把单次语音输入的时长上限提高,比如提升到 10 分钟、15 分钟,或者支持用户自定义更长时间。对于长文本表达、会议记录、想法整理、口述写作等场景来说,5 分钟确实偏短。

2. 如果内部仍然受 5 分钟限制,希望支持自动分段

如果底层语音识别服务本身有单次 5 分钟的限制,也希望软件可以在用户无感的情况下自动分段处理。

比如可以将录音自动切成:

  • 0~4分30秒

  • 4分30秒~9分钟

  • 9分钟~13分30秒

每段之间可以保留少量重叠内容,避免刚好在句子中间被切断。最后再由 AI 自动合并、去重、润色,让用户最终看到的是一整段连续、完整的文本。

这样即使底层接口仍然有时间限制,用户侧也不会明显感知到中断。

3. 增加录音时长提示

现在录音窗口里缺少明显的时间提示,希望可以在录音界面底部或黑色录音框中显示当前已经录制了多久,比如:

当前录音:03:42 / 05:00

或者如果支持更长录音,也可以显示:

已录制:08:26

这样用户在使用时可以感知当前录音进度,避免说到一半突然被截断。

Please authenticate to join the conversation.

Upvoters
Status

In Review

Board
💡

Feature Request

Date

16 days ago

Author

jj w

Subscribe to post

Get notified by email when there are changes.