Anstatt jede Eingabe in ChatGPT, Claude oder Gemini einzutippen, sprechen immer mehr Menschen diese einfach aus. Was in Entwicklerkreisen mit Tools wie Wispr Flow begann, hat sich mittlerweile auf alltägliche Arbeitsabläufe ausgeweitet, und Fußpedale sind zum bevorzugten Auslöser für freihändiges Sprachdiktat geworden.
Sprechen geht etwa dreimal schneller als Tippen. Dieser Unterschied spielt bei KI eine Rolle, da längere, detailliertere Eingabeaufforderungen in der Regel schon beim ersten Versuch zu besseren Antworten führen und weniger Folgefragen erfordern.
Abgesehen von der Geschwindigkeit entlastet die Diktatfunktion jeden, der den ganzen Tag tippt. Für Menschen mit RSI, motorischen Einschränkungen oder chronischen Schmerzen macht die freihändige Eingabe KI-Tools auf eine Weise zugänglich, wie es Tastaturen nicht können.
Dies funktioniert systemweit: in KI-Chatfenstern, per E-Mail, in Code-Editoren und in Slack. Dadurch ist es flexibler als die integrierten Sprachfunktionen einer einzelnen KI-Plattform.
Das Pedal ist nur der Auslöser. Diese Werkzeuge erledigen die Arbeit:
Wispr Flow nutzt eine Cloud-Transkription mit KI-gestützter Nachbearbeitung. Halten Sie die Fn-Taste (Mac) oder Strg+Win (Windows) gedrückt, um zu sprechen. Es gibt eine kostenlose Version sowie kostenpflichtige Tarife für etwa 12–15 $ pro Monat.
Superwhisper läuft lokal auf dem Mac, sodass die Audiodaten auf Ihrem Rechner verbleiben. Halten Sie Option+Leertaste gedrückt, um zu sprechen. Einmaliger Kaufpreis von etwa 250 $.
VoiceInk ist eine Open-Source-Lösung, die für etwa 40 US-Dollar erhältlich ist und mehrere Größen des Whisper-Modells bietet.
Die Diktatfunktion des Betriebssystems ist unter macOS (zweimaliges Drücken von Globe/Fn) und Windows (Win+H) kostenlos, wird jedoch durch kurzes Drücken statt durch Gedrückthalten aktiviert, und die Genauigkeit lässt bei Fachbegriffen nach.
Generische USB-Pedale (19–30 US-Dollar) von iKKEGOL oder PCsensor verarbeiten einen einzelnen Tastendruck. Sie sind funktional und unkompliziert, beschränken sich jedoch auf eine einzige Aktion und verfügen über keine Software zur Verwaltung von Profilen oder zur Erweiterung der Funktionalität.
Das Wispr Pedal (99–199 US-Dollar) lässt sich über Bluetooth verbinden und ist bereits für Wispr Flow vorkonfiguriert, wobei ein Jahr Flow Pro im Lieferumfang enthalten ist. Es wurde speziell für Diktate entwickelt, ist jedoch auf eine App und einen Anwendungsfall beschränkt.
Stream Deck Pedal ist ein USB-Controller mit drei Pedalen, einer robusten Metallgrundplatte und austauschbaren Federn zur Einstellung der Pedalkraft. Ein Pedal dient als Push-to-Talk-Funktion. Die beiden anderen können Ihr Mikrofon stummschalten, Makros auslösen, den Audioausgang umschalten oder jede andere von Ihnen zugewiesene Funktion ausführen. Smart Profiles aktualisieren alle drei Pedale automatisch, wenn Sie zwischen Apps wechseln. Und dank des Zugriffs auf den Elgato Marketplace geht es weit über einfache Hotkeys hinaus.
Der Hauptunterschied liegt in der Flexibilität. Drei Pedale statt eines, Profile, die je nach App wechseln, und ein Plugin-Ökosystem, das über die Diktatfunktion hinausgeht.
Jedes der oben genannten Diktat-Tools lässt sich auch über eine Tastenkombination bedienen: Taste gedrückt halten, sprechen, Taste loslassen. ChatGPT und Gemini verfügen ebenfalls über Mikrofon-Schaltflächen in ihren Textfeldern, allerdings gibt es für diese keine Tastenkombinationen. Claude im Web bietet überhaupt keine integrierte Diktatfunktion, daher empfiehlt sich dort die Verwendung eines systemweiten Tools.
So oder so: Der schnellste Weg, um herauszufinden, ob Sprachbefehle zu Ihrer Arbeitsweise passen, ist, mit einem Tastenkürzel zu beginnen.
Die Genauigkeit der Transkription hängt von Namen, Fachjargon und der Syntax des Codes ab. Die Push-to-Talk-Funktion hilft bei Hintergrundgeräuschen, doch ein gutes Mikrofon in Mundnähe ist wichtiger als jede Softwareeinstellung. Und wenn Ihnen der Datenschutz wichtig ist, sollten Sie ein lokales Tool wie Superwhisper oder VoiceInk den cloudbasierten Optionen vorziehen.
Installieren Sie die kostenlose Version von Wispr Flow oder nutzen Sie die Diktatfunktion Ihres Betriebssystems, weisen Sie ihr eine Tastenkombination zu und sprechen Sie Ihren nächsten Befehl, anstatt ihn einzutippen. Wenn Sie regelmäßig diktieren, übernimmt das Stream Deck Pedal die Push-to-Talk-Funktion und bietet Ihnen gleichzeitig zwei zusätzliche Pedale für den Rest Ihres Arbeitsablaufs. In unserer Anleitung zur Einrichtung von Stream Deck-Tastenkombinationen wird die Konfiguration Schritt für Schritt erläutert.
PRODUKTE IM ARTIKEL
Stay up to date with Elgato. Get our latest News, Guides, and Product Updates in your Google feeds.
Add Elgato as a preferred sourceThanks for helping us improve this article.