Was es kann
Sprachmodus
Sprich mit ihm, und lass es laut antworten.
Sprechen in der Chat-Seitenleiste ist ein gesprochenes Gespräch, kein Diktat. Es hört durchgehend zu, merkt, wann du fertig bist, antwortet laut und lässt sich unterbrechen.
Es ist Beta, und das ist ehrlich gemeint. Es will eine ordentliche Grafikkarte und Kopfhörer. Über Laptop-Lautsprecher antwortet es sich gelegentlich selbst.
Die Kugel
| Was sie tut | Was es heißt |
|---|---|
| Wächst mit deiner Stimme | Hört zu |
| Ein Punkt mit kreisendem Bogen | Denkt nach, oder sucht |
| Pulsiert gleichmäßig | Spricht |
| Nur ein Umriss | Mikrofon stumm |
Tasten
| Taste | Wirkung |
|---|---|
Esc | Gespräch beenden |
M | Mikrofon stummschalten |
C | Mitschrift anzeigen |
Leertaste | Rest der Antwort überspringen |
Stimmen
System nutzt die Stimmen, die dein Betriebssystem schon hat: sofort da, und sie klingen nach deinem System. Natürlich ist eine neuronale Stimme, etwa 90 MB beim ersten Mal, nur Englisch, und deutlich besser. Das Tempo reicht von 0,9x bis 1,25x.
Alles Gesprochene bleibt auf dem Rechner. Die Erkennung läuft mit Whisper bei dir, und Audio wird nie hochgeladen und nie auf die Platte geschrieben. Websuchen sind das Einzige, was hinausgeht.
Wenn es schiefgeht
- Es unterbricht sich selbst. Seine eigene Stimme kommt ins Mikrofon zurück. Nimm Kopfhörer.
- Es ist langsam. Sieh auf den Millisekundenzähler. Über 1500 ms ist das Sprechmodell zu groß.
- „Einfache Erkennung“. Die neuronale Sprachaktivitätserkennung wurde nicht geladen; Hintergrundgeräusche täuschen die einfachere leichter.