할 수 있는 일
음성 모드
말을 걸면 소리 내어 답합니다.
Chat 사이드바의 대화는 받아쓰기가 아니라 말로 하는 대화입니다. 계속 듣고, 말이 끝났는지 판단하고, 소리 내어 답하고, 끼어들 수 있게 해 줍니다.
베타이고, 그 표시는 솔직한 것입니다. 괜찮은 그래픽 카드와 헤드폰이 필요합니다. 노트북 스피커로는 가끔 자기 말에 답합니다.
구체
| 모습 | 뜻 |
|---|---|
| 목소리에 따라 커짐 | 듣고 있습니다 |
| 점과 도는 호 | 생각 중이거나 검색 중 |
| 일정하게 맥동 | 말하고 있습니다 |
| 윤곽선만 | 마이크 음소거 |
단축키
| 키 | 동작 |
|---|---|
Esc | 대화 끝내기 |
M | 마이크 음소거 |
C | 자막 보기 |
스페이스 | 남은 답변 건너뛰기 |
목소리
시스템은 운영체제에 이미 있는 목소리를 씁니다. 바로 나오고, 운영체제 그대로의 소리입니다. 자연스러움은 이 컴퓨터에서 도는 신경망 음성으로, 처음에만 90 MB 정도이고, 영어만 지원하며, 훨씬 낫습니다. 속도는 0.9배에서 1.25배까지.
말한 내용은 전부 이 컴퓨터에 남습니다. 인식은 이 컴퓨터의 Whisper로 돌고, 음성은 업로드되지도 디스크에 기록되지도 않습니다. 밖으로 나가는 것은 웹 검색뿐입니다.
잘 안 될 때
- 자기 말을 자릅니다. 자기 목소리가 마이크로 돌아옵니다. 헤드폰을 쓰세요.
- 느립니다. 밀리초 숫자를 보세요. 1500 ms를 넘으면 음성 모델이 너무 큽니다.
- "기본 감지"라고 나옵니다. 신경망 음성 감지가 로드되지 않았고, 단순한 쪽은 배경 소음에 더 잘 속습니다.