Alles lokal. Das Whisper-Modell läuft komplett in deinem Browser (WebGPU, sonst CPU/WASM).
Nach dem einmaligen Download bleibt das Modell im Browser-Cache — danach funktioniert die Erkennung
offline, und kein Audio verlässt je diesen Rechner. Keine API, keine laufenden Kosten.