它能做什么

语音模式

对它说话,让它开口回答。

Chat 侧边栏里的语音对话是说出来的对话,不是听写。它持续聆听,判断你说完了没有,出声回答,也允许你打断。

它还在 beta,这话是认真的。它需要一块像样的显卡和一副耳机。用笔记本外放时,它偶尔会回答自己。

Draggy 的语音设置:哪个模型负责朗读回答、在系统语音和 Natural 语音之间的选择、使用哪个语音,以及语速。

那个光球

它的样子含义
随你的声音变大正在聆听
一个点加一道旋转的弧正在思考,或搜索
平稳地脉动正在说话
只剩轮廓麦克风已静音

按键

按键动作
Esc结束对话
M静音麦克风
C显示字幕
空格跳过这段回答剩下的部分

声音

系统用你操作系统已有的声音:即开即用,听起来就是你的系统。 自然是本机运行的神经网络声音,首次约 90 MB,仅支持英语,明显更好听。语速可在 0.9x 到 1.25x 之间调整。

说出来的一切都留在本机。识别用的是跑在你电脑上的 Whisper,音频从不上传,也从不写入磁盘。联网搜索是唯一会发出去的东西。

效果不好的时候

  • 它打断自己。它自己的声音又进了麦克风。戴耳机。
  • 它很慢。看毫秒计数。超过 1500 毫秒说明语音模型太大了。
  • 显示「基础检测」。神经网络语音检测没加载成功;简单的那套更容易被背景噪音骗到。