Alles lokal. Das Whisper-Modell läuft komplett in deinem Browser (WebGPU, sonst CPU/WASM). Nach dem einmaligen Download bleibt das Modell im Browser-Cache — danach funktioniert die Erkennung offline, und kein Audio verlässt je diesen Rechner. Keine API, keine laufenden Kosten.
Zum Betrieb: Öffne die Datei über localhost (nicht file://) —
Mikrofon, WebGPU und der Module-Worker brauchen einen sicheren Kontext. Als Einzeiler:
python3 -m http.server 8000 im Ordner, dann http://localhost:8000/whisper-lokal.html.
Für echten Air-Gap: @huggingface/transformers und die Modelldateien selbst hosten und
env.allowRemoteModels = false setzen.