它能做什么
语音模式
对它说话,让它开口回答。
Chat 侧边栏里的语音对话是说出来的对话,不是听写。它持续聆听,判断你说完了没有,出声回答,也允许你打断。
它还在 beta,这话是认真的。它需要一块像样的显卡和一副耳机。用笔记本外放时,它偶尔会回答自己。
那个光球
| 它的样子 | 含义 |
|---|---|
| 随你的声音变大 | 正在聆听 |
| 一个点加一道旋转的弧 | 正在思考,或搜索 |
| 平稳地脉动 | 正在说话 |
| 只剩轮廓 | 麦克风已静音 |
按键
| 按键 | 动作 |
|---|---|
Esc | 结束对话 |
M | 静音麦克风 |
C | 显示字幕 |
空格 | 跳过这段回答剩下的部分 |
声音
系统用你操作系统已有的声音:即开即用,听起来就是你的系统。 自然是本机运行的神经网络声音,首次约 90 MB,仅支持英语,明显更好听。语速可在 0.9x 到 1.25x 之间调整。
说出来的一切都留在本机。识别用的是跑在你电脑上的 Whisper,音频从不上传,也从不写入磁盘。联网搜索是唯一会发出去的东西。
效果不好的时候
- 它打断自己。它自己的声音又进了麦克风。戴耳机。
- 它很慢。看毫秒计数。超过 1500 毫秒说明语音模型太大了。
- 显示「基础检测」。神经网络语音检测没加载成功;简单的那套更容易被背景噪音骗到。