Audio verlässt deinen Mac nie. whisper.cpp läuft direkt auf deiner Hardware — keine Cloud, kein Server, kein Ping nach außen.
Kein Abo, kein Konto
Einmal bauen, dauerhaft nutzen. Keine Registrierung, keine Subscription, kein Tracking. Das Tool gehört dir.
Open Source — AGPL v3
Vollständiger Quellcode auf Codeberg. Eigenständige Implementierung auf Basis von whisper.cpp, FluidAudio (Parakeet, Apache 2.0) und Ollama.
Features
Was Voxista kann
Native macOS-Menüleisten-App — schmal, präzise, ohne Ballast.
Drei Erkennungs-Engines
Wähle deine Engine: Whisper (beste Qualität), Parakeet (nahezu sofort auf der Neural Engine, 25 europäische Sprachen) oder Apple-Erkennung (auf dem Gerät, ohne Download). Einstellungen → Modelle erklärt die Unterschiede — alle laufen lokal. Heruntergeladene Modelle werden gegen eine bekannte Prüfsumme kontrolliert.
Doppeltipp, Halten oder die fn-Taste
Standard: Doppeltipp — kollidiert nicht mit ⌥-Sonderzeichen wie @. Alternativ Push-to-talk (Halten) oder die fn/🌐 Globus-Taste. Frei belegbares Kürzel, z. B. ⌥ Leer. Esc verwirft die Aufnahme.
Veredelungs-Modi
Roh · Aufräumen · Als E-Mail · Ins Englische — und eigene Aktionen im Editor. Optional: Cloud-Provider (Langdock / OpenAI-kompatibel) statt Ollama lokal.
Warm-Modus
„Modell im Speicher halten" startet whisper-server im Hintergrund — Transkription beginnt sofort, kein Modell-Ladezeit beim ersten Diktat.
Live-Vorschau beim Diktieren
Beta (Parakeet): Das Aufnahme-Fenster zeigt deine Worte während des Sprechens — Wellenform, Auto-Scroll, einlaufender Text. Eingefügt wird am Ende immer das vollständige, saubere Ergebnis.
Wörterbuch, Bereinigung & Textbausteine
Automatische Wortersetzung (dictionary.txt), Eigennamen-Liste (vocabulary.txt) fürs LLM und Textbausteine via Trigger-Wort. Neu: optionale Textbereinigung ganz ohne KI — Füllwörter entfernen und gesprochene Satzzeichen umwandeln.
Verlauf
Die letzten Transkriptionen im Fenster und direkt im Menüleisten-Menü einsehbar. Suche, Anpinnen, Einzellöschen, Drag & Drop heraus.
Meeting-Erkennung
Nutzt eine andere App das Mikrofon (Teams, Zoom & Co.), bietet Voxista das automatische Mitschreiben an — deine Gesprächsseite landet als Take. Transkript und KI-Protokoll gehen auf Wunsch in die Zwischenablage; die automatische Kopie lässt sich für beides getrennt abschalten.
Aufnahme-HUD mit Wellenform
Schwebe-Pill zeigt den Zustand in Echtzeit: Live-Wellenform, Wort-Counter „✓ 128 Wörter eingefügt", 10-s-Countdown bei Stille.
Automation & CLI
Dieselbe Binary als Kommandozeilen-Tool — für die Kurzbefehle-App, URL-Scheme voxista:// (Token-geschützt), optionaler Webhook (z. B. n8n).
Updates installieren sich selbst
Ein Klick auf „Version … installieren“ — Voxista lädt das Paket, prüft dessen Signatur und startet neu. Beim Update erscheint keine Gatekeeper-Abfrage mehr. Liegt eines bereit, zeigt das Menüleisten-Symbol ein kleines Abzeichen.
Pipeline
So funktioniert's
Vier Schritte vom Hotkey bis zum Text in der aktiven App — alles auf deinem Mac.
Aufnahme
Hotkey & Mikrofon
⌥ halten oder doppeltippen — Voxista nimmt mit 16 kHz WAV auf. Das Menüleisten-Icon pulsiert rot. Esc bricht ab.
Transkription
Deine gewählte Engine, lokal
Whisper, Parakeet oder Apple-Erkennung — alle laufen ausschließlich auf deiner Hardware. Lange Aufnahmen werden an Stille-Stellen aufgeteilt und mit Fortschritt transkribiert.
Optional
LLM-Veredelung
Ollama (qwen2.5) bereinigt, formatiert oder übersetzt den Rohtext — je nach gewähltem Modus. Wörterbuch und Vocabulary werden angewendet.
Ausgabe
⌘V in die aktive App
Text landet via Zwischenablage + ⌘V genau dort, wo der Cursor steht. Optional mit automatischem Enter.
Automation
Scripting & Integration
Voxista als Werkzeug in deiner Automatisierungs-Kette — Kurzbefehle, Shell-Skripte, Webhooks.
Terminal
# ./build.sh --install richtet den Befehl automatisch einvoxista --transcribe interview.mp3 # Audio → Text (lokal)voxista --enhance "ähm das meeting ist morgen" --mode clean
voxista --list-modes # verfügbare Modi anzeigen
URL-Scheme
voxista:// — startet Aktionen direkt aus anderen Apps, Kurzbefehlen und Skripten. Für den Start eines Diktats (start, toggle, mode) gehört dein persönliches Token dazu: zu finden unter Einstellungen → Automation, inklusive fertiger Beispiel-URL. stop und cancel gehen ohne.
Webhook
Jedes fertige Diktat wird optional an einen Webhook gesendet (z. B. n8n) — absicherbar per Bearer-Token im macOS-Schlüsselbund.
Kurzbefehle-App
Aktion „Shell-Skript ausführen" — nutzt dieselbe Engine und dieselben Einstellungen wie die laufende App.
Installation
Einrichten
Der schnellste Weg ist der fertige Download. Wer mag, baut stattdessen aus dem Quellcode — beides unten beschrieben.
Variante A — Download (empfohlen)
3 Schritte
# 1. ZIP laden & entpacken, Voxista.app nach /Applications ziehen:# → codeberg.org/kleinschmidt/Voxista/releases/latest# 2. Erster Start: Rechtsklick auf die App → „Öffnen" → „Öffnen"# (Voxista ist selbst-signiert, nicht notarisiert — daher die Einmal-Hürde)# Alternativ im Terminal:xattr -dr com.apple.quarantine /Applications/Voxista.app# 3. Whisper-Modell lädt die App beim ersten Start selbst (geführtes Setup)
whisper ist im Download bereits eingebettet — Homebrew wird nicht benötigt. Ab da hält sich die App selbst aktuell: täglicher Versions-Check, und ein Klick lädt die neue Version, prüft deren Signatur und startet neu — ohne Gatekeeper-Abfrage.
Variante B — Aus dem Quellcode · 1 — Voraussetzungen
Terminal — einmalig
# Homebrew (brew.sh) und Swift Command Line Tools werden benötigt# Kein volles Xcode nötig# Spracherkennungbrew install whisper-cppmkdir -p ~/whisper-modelscurl -L -o ~/whisper-models/ggml-large-v3-turbo-q5_0.bin \
https://huggingface.co/ggerganov/whisper.cpp/resolve/main/ggml-large-v3-turbo-q5_0.bin
# Optionale LLM-Veredelung (lokal)brew install --cask ollama-appollama pull qwen2.5:7b
2 — Bauen & installieren
Terminal
git clone https://codeberg.org/kleinschmidt/Voxistacd Voxista./setup-signing.sh# einmalig: stabiles Signing-Zertifikat./make-icon.sh# App-Icon erzeugen./build.sh --install# nach /Applications bauen# Fertige App läuft ohne Homebrew (whisper ist eingebettet)
Erster Start: In Systemeinstellungen → Datenschutz & Sicherheit Voxista unter Bedienungshilfen erlauben (globaler Hotkey + Einfügen) und beim ersten Diktieren das Mikrofon freigeben.
Weitergabe als ZIP: Voxista ist selbst-signiert (Ad-hoc), nicht notarisiert. Empfänger müssen die Gatekeeper-Sperre einmalig lösen:
xattr -dr com.apple.quarantine /Applications/Voxista.app
Oder: Rechtsklick auf die App → „Öffnen" → „Öffnen".
Versionshistorie
Changelog
Was in jeder Version dazugekommen ist — neueste zuerst.
1.265. August 2026
Wichtig für Automationen: voxista:// verlangt jetzt ein Token für start, toggle und mode — du findest es unter Einstellungen → Automation, inklusive fertiger Beispiel-URL. Ohne Token konnte jede Webseite eine Aufnahme starten und sich den Text in ihr eigenes Fenster einfügen lassen. stop und cancel funktionieren weiterhin ohne
Behoben: Voxista beenden während einer laufenden Meeting- oder Diktat-Aufnahme hinterließ eine unlesbare Datei — die Aufnahme wird jetzt korrekt abgeschlossen
Behoben: Eine fehlgeschlagene Transkription nennt jetzt den Grund (kein Modell, abgebrochen, Zeitüberschreitung), statt wie „nichts gesagt“ auszusehen — und die Aufnahme bleibt erhalten, damit nichts verloren geht
Behoben: Schlägt ein Teil einer langen Transkription fehl, wird die Lücke im Text markiert, statt kommentarlos zu verschwinden
Behoben: Eine beschädigte Einstellungsdatei (Textbausteine, Wörterbuch, Modi, Verlauf) wird nicht mehr mit einer leeren überschrieben — deine Daten bleiben wiederherstellbar
Neu: Meeting-Transkript jederzeit manuell in die Zwischenablage kopieren, und die automatische Kopie abschalten, wenn sie stört — getrennt für Transkript und KI-Protokoll
Neu: Heruntergeladene Spracherkennungs-Modelle werden gegen eine bekannte Prüfsumme kontrolliert
1.255. August 2026
Neu: Voxista installiert seine Updates selbst — ein Klick auf „Version … installieren“ lädt das Paket, prüft dessen Signatur und startet neu. Beim Update erscheint keine Gatekeeper-Abfrage mehr (wirkt ab der nächsten Version, da diese hier noch von Hand installiert werden muss)
Neu: Das Menüleisten-Symbol zeigt ein kleines Download-Abzeichen, wenn ein Update bereitliegt
Behoben: Nach dem Erteilen von Bildschirmaufnahme oder Bedienungshilfen beendet macOS Voxista, damit die Berechtigung greift — Voxista sagt das jetzt vorher an und kommt von allein zurück, statt weg zu bleiben
1.2415. Juli 2026
Neu (Beta): Live-Vorschau beim Diktieren mit Parakeet — das Aufnahme-Fenster zeigt den Text einlaufend, mit Wellenform und Auto-Scroll (eingefügt wird immer das vollständige Endergebnis)
Neu: Textbereinigung ohne KI — Füllwörter entfernen und gesprochene Satzzeichen umwandeln (Einstellungen → Wörterbuch, opt-in, sprachbewusst)
Neu: fn-/Globus-Taste als Diktat-Hotkey
Neu: Parakeet-Modellwahl (v3 oder v2)
Behoben: Das Beenden der App hängt nicht mehr am Spracherkennungs-Server
1.2313. Juli 2026
Neu: Wähle deine Erkennungs-Engine — Whisper (beste Qualität), Parakeet (nahezu sofort auf der Neural Engine, 25 europäische Sprachen) oder Apple-Erkennung (ohne Download). Einstellungen → Modelle erklärt die Unterschiede
Meeting-Transkripte und KI-Protokolle landen jetzt auch im Verlauf — und das Ergebnis-Fenster bekommt einen „Im Finder zeigen“-Knopf
Einrichtung: sofort diktieren ohne Modell-Download, plus ein Ausprobieren-Feld
Hinweis: ab dieser Version wird macOS 14 (Sonoma) oder neuer benötigt
1.227. Juli 2026
Verbessert: Die Meeting-Erkennung beobachtet jetzt alle Mikrofone, nicht nur das Standardmikrofon — Meetings, die über ein Headset laufen, werden zuverlässig erkannt
1.216. Juli 2026
Neu: Debug-Protokoll-Schalter im Menü — einschalten, einmal neu starten, und Voxista schreibt alles (inkl. Fehler) in ein Protokoll, das sich mit einem Klick an den Entwickler senden lässt („Protokoll an Entwickler senden“)
1.206. Juli 2026
Neu: „Meeting jetzt mitschneiden“ in der Menüleiste und in den Einstellungen — startet einen Meeting-Mitschnitt von Hand, auch wenn die automatische Erkennung nicht anspringt (z. B. ein nicht als Standard gesetztes Mikrofon oder eine nicht gelistete App)
1.192. Juli 2026
Sicherheits-Runde nach Code-Review: der Webhook-Token geht nur noch über HTTPS/localhost, der Update-Link wird vor dem Öffnen validiert
Absturz behoben, wenn ein eigener Modellname Leer- oder Sonderzeichen enthielt; eigene Einträge können den Modell-Ordner nicht mehr verlassen
whisper-server wird bei Neustarts sauber beendet — sein Port kann nicht mehr blockiert bleiben („Modell im Speicher halten“ fällt nicht mehr still zurück)
1.1816.06.2026
Behoben: Das Meeting-Mitschnitt-Panel erscheint jetzt zuverlässig, wenn ein Meeting erkannt wird (Teams, Zoom, FaceTime …) — vorher war es unsichtbar
Damit funktioniert der komplette Ablauf: Stereo-Mitschnitt, sprecher-getrenntes Transkript (Ich / Andere) und KI-Protokoll auf Knopfdruck
1.1714.06.2026
Drittanbieter-Lizenztexte jetzt mitgeliefert und im Über-Tab verlinkt (plus Gewährleistungsausschluss)
Kontaktadresse auf hello@heinemann.media aktualisiert
1.1612.06.2026
Terminal (CLI), Fehlermeldungen und Erststart-Vorlagen vollständig zweisprachig
KI-Prompts und Meeting-Sprecher-Marker folgen der App-Sprache
Stabilität: Kontext-Erfassung gegen seltene Abstürze abgesichert
Alle Menüs, Panels und Dialoge vollständig zweisprachig
Eingebaute KI-Prompts und Meeting-Sprecher-Marker folgen der App-Sprache
1.1412.06.2026
Voxista gibt es jetzt zum Download: fertige Releases auf Codeberg (ZIP, signiert)
Update-Hinweis: die App prüft täglich auf neue Versionen — ein Klick im Menü führt zum Download (kein Auto-Install)
Über-Tab: „Nach Updates suchen“-Knopf
1.1312.06.2026
Umbenennung: aus Voxify wird Voxista — Logo und Funktionen bleiben
Alle Daten (Einstellungen, Wörterbuch, Takes, Verlauf, API-Keys) werden automatisch übernommen
CLI heißt jetzt „voxista“; URL-Scheme voxista:// (voxify:// bleibt als Alias)
1.1212.06.2026
Meeting-Mitschnitt (Phase 2): nimmt jetzt auch die Gegenseite auf — Stereo-Take (links du, rechts die anderen)
Sprecher-Transkript: „Ich:“ / „Andere:“ zeitlich verschränkt, direkt aus dem Meeting-Panel (auch per CLI)
KI-Protokoll auf Knopfdruck: Themen, Entscheidungen, Aufgaben, offene Punkte (neuer Modus „Meeting-Protokoll“)
1.1111.06.2026
Meeting-Erkennung (Phase 1): Nutzt eine andere App das Mikrofon und läuft Teams/Zoom & Co., bietet Voxista das Mitschreiben an — die eigene Mikrofon-Seite landet als Take
Neues Arbeitslogo: Voxista-Marke als App-Icon, im Über-Tab und Onboarding (vektorisiert in Branding/)
1.1011.06.2026
Lange Aufnahmen (> 5 min) werden an Stille-Stellen in Teile geschnitten und mit Fortschritt („Teil 2 von 5") transkribiert — deutlich zuverlässiger als am Stück
HUD-Position wählbar: unten oder oben mittig
Webhook absicherbar per Auth-Token (Bearer, Schlüsselbund); Spenden-Button im Über-Tab
1.911.06.2026
Diktat-Sprache (Deutsch/Englisch/Automatisch) direkt im Menü umschaltbar
Textbausteine: Trigger-Wort diktieren (z. B. „Signatur") → Baustein wird eingefügt
Automation: CLI mit --json/--stats/--export-history, URL-Scheme voxista://, optionaler Webhook (n8n)
Politur: Bestätigungs-Dialoge vor dem Löschen, Auto-Speichern beim Verlassen, sichtbare Fehler
HUD zählt mit: „✓ 128 Wörter eingefügt"
1.811.06.2026
Takes-Liste: jede Aufnahme bleibt erhalten (Zeitstempel), mit Player, Transkribieren, Export und Einzellöschen
Stille-Auto-Stopp: nach längerer Ruhe zählt das HUD 10 s herunter — Weitersprechen bricht ab (Limit einstellbar)
1.711.06.2026
Live-Vorschau im HUD (experimentell): Zwischenstand alle ~2,5 s — mit Warm-Modus
Frei belegbarer Hotkey (z. B. ⌥ Leer) zusätzlich zu rechten Modifier-Tasten
Esc bricht laufende Aufnahme ab; „✓ Eingefügt"-Bestätigung nach dem Diktat
Menüleisten-Icon zeigt den Zustand (rot pulsierend bei Aufnahme)
Verlauf: Suche, Anpinnen, Einzellöschen, Einträge per Drag & Drop herausziehen
Aktionen-Editor: „Ausprobieren" testet den Prompt mit Beispieltext
Cloud-Provider für KI-Veredelung (Langdock/Custom, Keys im Schlüsselbund)
Editierbare Vorschau vor dem Einfügen
CLI-Modus für Kurzbefehle
1.2 / 1.310.06.2026
Doppeltipp-Aktivierung
Einstellungs-Fenster
Eigene Modelle
App-spezifische Modi
Kontext aus markiertem Text
Verlauf
Pegelanzeige
1.110.06.2026
Wörterbuch & Vocabulary
Hybrid-Hotkey
VAD (Voice Activity Detection)
Modell-Verwaltung
Sound-Feedback
1.010.06.2026
Erste Version
Push-to-talk-Diktat
4 Modi (Roh, Aufräumen, Als E-Mail, Ins Englische)
Lokales Whisper + Ollama
Unterstützen
Voxista bleibt frei
Voxista ist Open Source (AGPL v3) und kommt ohne Abo, ohne Konto, ohne versteckte Kosten.
Wenn dir das Tool im Alltag nützt, freue ich mich über eine Unterstützung via Liberapay —
vollständig freiwillig und anonym möglich.