할 수 있는 일

음성 모드

말을 걸면 소리 내어 답합니다.

Chat 사이드바의 대화는 받아쓰기가 아니라 말로 하는 대화입니다. 계속 듣고, 말이 끝났는지 판단하고, 소리 내어 답하고, 끼어들 수 있게 해 줍니다.

베타이고, 그 표시는 솔직한 것입니다. 괜찮은 그래픽 카드와 헤드폰이 필요합니다. 노트북 스피커로는 가끔 자기 말에 답합니다.

Draggy의 음성 설정. 소리 내어 답하는 모델, 시스템 음성과 Natural 음성 중 선택, 사용할 음성, 그리고 속도.

구체

모습
목소리에 따라 커짐듣고 있습니다
점과 도는 호생각 중이거나 검색 중
일정하게 맥동말하고 있습니다
윤곽선만마이크 음소거

단축키

동작
Esc대화 끝내기
M마이크 음소거
C자막 보기
스페이스남은 답변 건너뛰기

목소리

시스템은 운영체제에 이미 있는 목소리를 씁니다. 바로 나오고, 운영체제 그대로의 소리입니다. 자연스러움은 이 컴퓨터에서 도는 신경망 음성으로, 처음에만 90 MB 정도이고, 영어만 지원하며, 훨씬 낫습니다. 속도는 0.9배에서 1.25배까지.

말한 내용은 전부 이 컴퓨터에 남습니다. 인식은 이 컴퓨터의 Whisper로 돌고, 음성은 업로드되지도 디스크에 기록되지도 않습니다. 밖으로 나가는 것은 웹 검색뿐입니다.

잘 안 될 때

  • 자기 말을 자릅니다. 자기 목소리가 마이크로 돌아옵니다. 헤드폰을 쓰세요.
  • 느립니다. 밀리초 숫자를 보세요. 1500 ms를 넘으면 음성 모델이 너무 큽니다.
  • "기본 감지"라고 나옵니다. 신경망 음성 감지가 로드되지 않았고, 단순한 쪽은 배경 소음에 더 잘 속습니다.