Was es kann

Sprachmodus

Sprich mit ihm, und lass es laut antworten.

Sprechen in der Chat-Seitenleiste ist ein gesprochenes Gespräch, kein Diktat. Es hört durchgehend zu, merkt, wann du fertig bist, antwortet laut und lässt sich unterbrechen.

Es ist Beta, und das ist ehrlich gemeint. Es will eine ordentliche Grafikkarte und Kopfhörer. Über Laptop-Lautsprecher antwortet es sich gelegentlich selbst.

Draggys Spracheinstellungen: welches Modell laut antwortet, eine Wahl zwischen der Systemstimme und der Stimme Natural, welche Stimme, und ihre Geschwindigkeit.

Die Kugel

Was sie tutWas es heißt
Wächst mit deiner StimmeHört zu
Ein Punkt mit kreisendem BogenDenkt nach, oder sucht
Pulsiert gleichmäßigSpricht
Nur ein UmrissMikrofon stumm

Tasten

TasteWirkung
EscGespräch beenden
MMikrofon stummschalten
CMitschrift anzeigen
LeertasteRest der Antwort überspringen

Stimmen

System nutzt die Stimmen, die dein Betriebssystem schon hat: sofort da, und sie klingen nach deinem System. Natürlich ist eine neuronale Stimme, etwa 90 MB beim ersten Mal, nur Englisch, und deutlich besser. Das Tempo reicht von 0,9x bis 1,25x.

Alles Gesprochene bleibt auf dem Rechner. Die Erkennung läuft mit Whisper bei dir, und Audio wird nie hochgeladen und nie auf die Platte geschrieben. Websuchen sind das Einzige, was hinausgeht.

Wenn es schiefgeht

  • Es unterbricht sich selbst. Seine eigene Stimme kommt ins Mikrofon zurück. Nimm Kopfhörer.
  • Es ist langsam. Sieh auf den Millisekundenzähler. Über 1500 ms ist das Sprechmodell zu groß.
  • „Einfache Erkennung“. Die neuronale Sprachaktivitätserkennung wurde nicht geladen; Hintergrundgeräusche täuschen die einfachere leichter.