
TL;DR: „WhisperFlow ist Diktat auf Hotkey – funktioniert in jedem Textfeld auf macOS/Windows, korrigiert Füllwörter automatisch und ist 3–4× schneller als Tippen. Pflicht-Stack für Builder, die viel mit AI-Tools prompten."
— Till FreitagWarum Sprache der nächste Default-Input wird
Wer 2025 mit AI-Tools baut, schreibt mehr Prompts als Code. ChatGPT, Claude, Lovable, Cursor, Linear, Slack – jeder Workflow ist ein Strom aus Anweisungen, Kontext und Reviews. Tippen wird zum Bottleneck.
Lovable Voice löst das innerhalb des Editors. Aber sobald du den Tab wechselst, bist du wieder auf der Tastatur. Genau diese Lücke schließt WhisperFlow: ein systemweiter Speech-to-Text-Layer, der in jedem Textfeld funktioniert – egal welche App.
Was WhisperFlow ist
WhisperFlow läuft als Hintergrundprozess auf macOS und Windows. Du drückst einen Hotkey (Standard: Fn oder eine Modifier-Kombination), sprichst, lässt los – der transkribierte Text wird an der aktuellen Cursorposition eingefügt. In jeder App. Lovable-Chat, Cursor-Composer, ChatGPT-Webfenster, Slack-DM, Mail, Notion, Google Doc.
Unter der Haube: Whisper-basierte Modelle (OpenAI Whisper Large v3 und Forks), wahlweise lokal oder Cloud. Die Genauigkeit liegt auf Deutsch und Englisch bei 95 %+ – inklusive Code-Switching und Fachbegriffen.
Der entscheidende Unterschied zu nativer Diktat-Funktion (macOS Dictation, Windows Voice Access):
- Cleanup ist eingebaut: WhisperFlow entfernt Füllwörter ("ähm", "also"), korrigiert Satzbau und glättet halbe Sätze.
- Custom Vocabulary: Du kannst Eigennamen, Produktnamen, Akronyme hinterlegen, damit "Lovable Cloud" nicht zu "lovable cloud" oder "loveable cloud" wird.
- Kontext-aware Prompting: Manche Tarife geben einen aktiven Hinweis mit ("ich diktiere einen Prompt für ein Code-Tool"), was die Cleanup-Qualität nochmal hebt.
Setup in 5 Minuten
- Download & Install: whisperflow.app → macOS-DMG oder Windows-Installer.
- Mikrofon-Permission erteilen, Accessibility-Permission erteilen (damit der Text in beliebige Apps eingefügt werden darf).
- Hotkey festlegen: Default ist Fn-Taste. Wir nutzen meist eine doppelte Modifier-Kombination (z. B. Right Option doppelt drücken), weil das in keinem Tool kollidiert.
- Sprache wählen: Deutsch + Englisch parallel aktivieren – WhisperFlow erkennt automatisch und macht Code-Switching sauber.
- Custom Vocabulary füllen: Firmenname, Tool-Namen, häufige Personen. Bei uns z. B.
Lovable,monday.com,Cal.com,Vibe Coding,Niclas,Malte. - Cleanup-Level wählen: Wir empfehlen "Medium" – aggressives Cleanup schreibt manchmal Aussagen um, die du so gemeint hattest.
Optional: Lokales Modell aktivieren, wenn du keine Audio-Uploads in die Cloud willst. Läuft auf jedem M1+ Mac flüssig, auf Windows brauchst du eine halbwegs aktuelle GPU.
Der Builder-Workflow
So sieht ein typischer Tag aus, wenn WhisperFlow läuft:
Morgens – Prompt-Drafts
Lovable-Projekt offen, Hotkey drücken, sprechen:
"Bau auf der Pricing-Page einen Vergleichs-Slider zwischen Stripe und Paddle. Drei Spalten – Setup-Aufwand, Auszahlungsfrequenz, EU-Steuer-Handling. Unter der Tabelle eine FAQ mit fünf Items. Mobile stapelt sich alles. Nutze die bestehenden Card- und Accordion-Komponenten."
Loslassen, Prompt steht im Chat, Build läuft. Tipp-Aufwand: null.
Mittags – Stakeholder-Mails
Kunde fragt nach Status, du gehst spazieren, antwortest per Sprachnotiz – aber direkt im Mail-Client, mit sauberem Schriftbild. Drei Absätze in einer Minute, kein Korrekturlauf nötig.
Nachmittags – Cursor / Code-Review
Cursor-Composer offen, Sprache wechselt zu Englisch (Modelle reagieren besser auf englische Prompts in Code-Kontext):
"Refactor this hook so the polling interval is configurable via a prop, default 5000ms, and add a useEffect cleanup."
Funktioniert auch hier, weil WhisperFlow im aktiven Textfeld einfügt, egal welche App.
Abends – Slack & Notion
Standup-Update in Slack, Doku in Notion, LinkedIn-Post-Draft – alles per Sprache, alles ohne Tippen. Der Tag fühlt sich am Ende deutlich kürzer an.
Best-Practice-Beispiele
1. Lange Context-Prompts
Sprache schlägt Tastatur immer dann, wenn du mehr als zwei Sätze Kontext mitgeben willst. Beispiel:
"Wir haben eine Landing Page für ein Webinar. Die Hero hat aktuell nur eine Headline und einen CTA. Mach daraus eine Hero mit links Speaker-Foto, rechts Headline, Datum, Location, CTA, darunter ein kleiner Trust-Bar mit den drei wichtigsten Firmenlogos. Datum-Format Deutsch, CTA-Text 'Platz sichern'."
70 Wörter in 12 Sekunden. Getippt: über eine Minute, mit Tippfehlern.
2. Pair Sessions
Stakeholder spricht laut, du nickst und kontrollierst nur, dass WhisperFlow es korrekt eingefügt hat. Geschäftsführer fühlen sich gehört, weil ihre eigenen Worte im System landen – nicht deine Übersetzung davon.
3. Mobile + Desktop Hybrid
Unterwegs nutzt du das Grammarly Mobile Keyboard mit Speech-to-Text, am Schreibtisch WhisperFlow. Beide Tools haben eingebautes Cleanup – der Stil deiner Texte bleibt konsistent, egal von welchem Device sie kommen.
4. Diktat-Replace statt Voice-Memo
Wenn du Notizen machst, sprich sie direkt ins Zieldokument (Notion, Apple Notes), statt einen Voice-Memo aufzunehmen und später zu transkribieren. Spart den ganzen Cleanup-Loop.
Wann WhisperFlow nicht das richtige Tool ist
- Code direkt diktieren: Wenn du
bg-primary/10brauchst, tipp es. Sprache rät hier zuverlässig falsch. - Selektoren, IDs, Variablennamen: Gleiches Spiel – jedes
_, jeder Camel-Case wird zur Glücksache. - Sehr kurze Inputs: Für "ja", "ok", "danke" lohnt sich der Hotkey nicht.
- Sensible Audio-Inhalte: Wenn Compliance keine Cloud-Transkription erlaubt, lokales Modell zwingend einschalten.
Faustregel (dieselbe wie bei Lovable Voice): Konzept → Sprache. Token → Tastatur.
Kostenrahmen
WhisperFlow ist Freemium:
- Free: limitierte Minuten pro Monat, Cloud-Transkription.
- Pro (~15 €/Monat): unlimitiert, lokales Modell, Custom Vocabulary, Team-Features.
Für einen Builder, der täglich mehrere Stunden in AI-Tools verbringt, amortisiert sich Pro nach der ersten Woche. Wir rechnen intern mit 30–60 Minuten Zeitersparnis pro Tag – das ist die meiste Tool-Investition wert.
Was das im Stack bedeutet
WhisperFlow ist kein Ersatz für Lovable Voice, sondern die Ergänzung außerhalb des Lovable-Editors. Unsere aktuelle Empfehlung für den Voice-Stack 2025:
| Kontext | Tool |
|---|---|
| Lovable-Editor (Web + Mobile) | Lovable Voice (ElevenLabs Scribe, eingebaut) |
| Alles andere am Desktop | WhisperFlow |
| Unterwegs am Smartphone | Grammarly Mobile Keyboard |
| Lange Voice-Memos zu Text | macOS Notizen / Otter.ai für Meetings |
Wer diesen Stack aufsetzt, hat in jedem Workflow Sprache als Default-Input. Tippen wird dann zur Spezialaufgabe – nicht mehr zum Default.
Fazit
Sprache als Eingabekanal ist 2025 reif. Die Modelle sind gut genug, die Latenz ist niedrig, das Cleanup funktioniert. WhisperFlow ist das Tool, das Sprache aus den AI-Apps in jedes Textfeld bringt.
Wer in Vibe Coding und AI-First-Workflows ernsthaft unterwegs ist, kommt mittelfristig nicht drum herum. Die 15 €/Monat sind eine der besten Tool-Investitionen, die wir 2025 gemacht haben.
→ Lovable Voice Mode: Per Mikrofon prompten → Unsere Vibe-Coding-Services → Lovable Mobile App: Was geht, was nicht








