Zurück zum Desktop-Download
OfflineVorschau

Lokale Privatsphäre

Nur Audio- und Videodateien auf diesem Computer. Kein Konto. Spracherkennung und Zusammenfassung bleiben auf dem Gerät, nichts wird hochgeladen.

Noch in Arbeit. Zum Ausprobieren geeignet, kein fertiges Produkt.

Das Installationspaket ist noch nicht veröffentlicht. Bitte später erneut versuchen.

Grundausstattung

macOS. macOS 13 oder neuer, Apple-Chip (M1 oder neuer). Das Textmodell nutzt die GPU dieses Macs (Metal), eine separate Grafikkarte ist nicht nötig. 16 GB gemeinsamer Arbeitsspeicher sind angenehm; mit 8 GB startet es, wird aber spürbar langsamer.

Windows. Windows 10 (1903 oder neuer) oder Windows 11, 64-Bit. In diesem Build läuft das Textmodell auf der CPU, NVIDIA CUDA ist nicht enthalten. Deshalb liegt die Latte höher als beim Mac: 32 GB RAM und eine aktuelle 8-Kern-CPU sind angenehm, 16 GB ist die Untergrenze. Eine separate Grafikkarte ist nicht nötig. Der Download ist ein Setup. Das Textmodell wird beim ersten Öffnen geladen.

Linux. 64-Bit-Linux. Die Sprachmodelle sind im Installer. Das Textmodell gibt es derzeit nur unter macOS und Windows, und es wird beim ersten Öffnen geladen.

Enthalten sind SenseVoice Small (Chinesisch, Japanisch, Koreanisch, Kantonesisch) und Whisper Small (andere Sprachen). Das 4-bit-Textmodell Qwen3.5-4B (etwa 2,74 GB) steckt nicht im Installer: Es wird beim ersten Öffnen einmal geladen. App-Updates laden es nicht erneut, nur wenn sich die Modelldatei ändert. Stärkere Modelle lassen sich nachladen oder als eigene Datei bzw. eigener Ordner auswählen.