点击链接,打开图片,微信扫码加入
https://shandianshuo.cn/wechat-qr.png
欢迎大家加入闪电说用户交流群反馈问题或者建议
自定义语音识别服务商问题
当输入https://api.groq.com/openai/v1自定义地址,闪电说默认的是https://api.groq.com/openai/v1/chat/completions,而asr的地址是https://api.groq.com/openai/v1/audio/transcriptions,这样搞的话不可能测试成功,/chat/completions这是一个大语言模型,对话模型,在自定义大语言模型里,这是可以测试成功的。所以应该把这个 ASR 的这个默认的地址要改一下。
快捷键唤起后偶尔无音波且无法识别语音,取消时卡顿
用快捷键唤起闪电说后,大约 10 次里有 4 次看不到音波波动;遇到这种情况时,闪电说也无法识别我说的语音,所以不只是音波动画不显示。取消时偶尔会有卡顿。 附件是两张当时的截图,分别显示「直接说」和「思考中」状态,供排查。麻烦检查快捷键唤起后的录音/识别状态、音波显示,以及取消操作的响应。而且再补一下,不是单纯的这种看不到音波的波动,而是他也没有办法去识别语音
快捷键唤起后偶发无音波且无法识别语音,取消时卡顿
使用快捷键唤起闪电说后,大约 10 次里有 4 次看不到音波波动;遇到这种情况时,闪电说也无法识别我说的语音,并非只有波形动画不显示。取消时偶尔会卡顿。 附上两张截图,展示「直接说」和「思考中」状态,供排查。请帮忙检查快捷键唤起后的录音及语音识别状态、音波展示和取消操作的响应 。
改进“帮我说”
在使用“帮我说”的功能时,如果在叙述过程中加入了问句,大模型就直接回答问题了而不是把单纯整理语音转成的文字。当然可以通过调整叙述来改善,但还是希望源头上改进一下,比如说加个系统提示词啥的?
希望能彻底关闭上下文参考
win,小米Mimo-v2.5-asr,快速和高级都是deepseekv4f,在关闭屏幕上下文参考的情况下,使用“帮我说”高级模整理的时,在 txt 中,它会直接参考屏幕上下文。在一些其他的应用中,它有时会显示”没有屏幕上下文的参考权限”从而打断语音进程。这就说明在关闭屏幕上下文参考的情况下,它还是会参考。希望可以调整功能,能够做到彻底关闭屏幕上下文参考。
建议在那个无光标的时候,说完在桌面显示能复制
就是我在说的时候,我可能光标不会一直停留在这个聊天的这块啊。 就是建议去调研一下,Tableau 是怎么弄的啊? 就是你说完之后,直接在那个直接说的那个小窗口那块展示出来,然后去复制,点复制就行了呗。 现在还得打开你的软件去找那条,很麻烦呀
Multi-Device Synchronization
Why can't content that has been entered previously be synchronized across different devices when logging in with the same account?
请求添加词库多端自动云同步功能
作者您好,辛苦了,没有什么bug,只是想提交一个希望做的功能。就是登录账号后,能自动同步各端的词库(词典),尤其是我这种mac Windows ios Android都有的人,每个软件单独同步词句太麻烦了!这个不切实际的,也不方便,希望能加个这个功能。以后手机端在说话过程中觉得有问题,我随手就录入软件词库了,希望电脑上或者其他端能同步这段录入,这样就会方便舒服很多。
关于会员购买加量包
这个会员可以购买加量包,那不是会员,为什么不可以购买加量包。我想要使用语音功能,购买加量包又购买不了,这钱不想赚是吧?我又用不到Agent功能,我只需要语音功能,不可能为了语音功能充值一个那么贵的会员。 目前只能凑合用本地模型配合其他模型api,但是总感觉差点意思,没有你们自己做的语音模型快,识别效果也没有闪电说模型好。 所以,为啥没有会员lite?反正我只需要语音功能。我说白了,闪电说目前这个会员机制太差,还在玩老一套的会员套路,捆绑型一大堆销售。 其实说到底,所有的功能都是api,所以直接充值api不就行了。充值完,我用语音就扣语音钱,我用Agent,你就扣Agent的前。但是计费统一全用的一个单位,只是两者调用资费不同。 很多应用端,应该都是用这种方式吧,比如一些Agent助手,为了衡量不同模型调用资费,都使用积分作为资费单位,贵的模型消耗积分高,低的模型消耗积分低。虽然他们充值也是月包会员,但本质上就是充值了api!
About the Rounded Corners of the Floating Window
I'm seriously sick of this. Could you at least pay a little attention to the UI? Look at these jagged "rounded corners"—who could possibly keep a straight face? Such an obvious problem—hasn't anyone ever pointed it out?
情绪标签
闪电说本地SenseVoice当前似乎在 sensevoice_onnx.rs 后处理中删除了语言、情绪和声音事件token。希望增加“SenseVoice富文本输出”选项,保留并结构化返回 language、emotion、events 和 text。默认关闭,不影响普通输入;开启后允许在最近记录或自定义技能中访问这些字段。个人语音日记场景需要利用 、 、 、 、 等模型已经生成的标签,而不只是最终纯文本。