⚠️ TEST-MODUS — Zahlungen sind nicht echt. Diese Seite befindet sich im Test.
100% lokal · Keine Cloud · Kein Audio-Upload
Läuft das auf deinem Rechner?
Celerando Spracheingabe — komplett offline, zwei Engines zur Wahl, drei Hardware-Stufen vom Office-Notebook bis zur GPU-Workstation. Diese Seite zeigt dir genau, was du brauchst.
2
Engines
6
Modelle
99
Sprachen (Whisper)
0
Cloud-Aufrufe
Self-Check
In welcher Stufe stehst du?
Drei Klicks — und du weißt, welche Engine, welches Modell und welcher Beschleunigungspfad zu deiner Maschine passt. Empfehlung in Echtzeit.
Eingabe
Beschreib deine Maschine
Werte aktualisieren das Ergebnis sofort.
Ergebnis
Stufe: Empfohlen
CPU
RAM — 8 GB
481632
Reicht bis Whisper Medium
GPU
→ Was du nutzen kannst
Heuristische Empfehlung — die App prüft die Hardware bei Aktivierung der Spracheingabe noch einmal exakt und schaltet die passenden Pfade frei.
01 — Engine
Welche Engine passt zu dir?
Beide laufen lokal. Wähl nach Sprachbedarf und vorhandener Hardware: Whisper ist in jeder Edition dabei — kostenlos mit dem Base-Modell in deiner Systemsprache, ab Pro mit freier Modellwahl und allen 99 Sprachen. Parakeet ist ab Business enthalten.
Default
Whisper
Whisper.net 1.9.0 — ggml
Maximale Sprachvielfalt. Höchste Genauigkeit.
🌍99 unterstützte Sprachen
📐Fünf Modellgrößen — Tiny bis Large v3 Turbo
⚡NVIDIA-CUDA-Beschleunigung optional
🛡Breit erprobte Open-Source-Engine
CPUVulkanCUDA
Empfohlen für maximale Sprachabdeckung & NVIDIA-Hardware
Optional
Parakeet
sherpa-onnx 1.12.38 — ONNX
Niedrige Latenz. GPU-agnostisch.
🇪🇺25 europäische Sprachen, automatische Erkennung
⚡Niedrige Latenz, Streaming-tauglich
🎮Läuft auf jeder DX12-GPU ohne Treiber-Sorgen
🆕Aktuelle NVIDIA-NeMo-Generation
CPUDirectML
Empfohlen für AMD/Intel-GPUs & geringste Latenz
02 — Hardware
Drei Stufen. Klare Wahl.
Vom Office-Notebook bis zur GPU-Workstation. Such dir die Karte, die deiner Maschine am ehesten entspricht.
Stufe 1
Mindestvoraussetzung
Damit es überhaupt läuft
CPU
x86-64 (Pre-AVX-Fallback nur Whisper-CPU)
RAM
4 GB
GPU
— (CPU genügt)
Speicher
100 MB + Modellgröße
OS
Windows 10 Build 19041 (Mai 2020) oder Windows 11
z.B. Office-Notebook, gelegentliche Notizen
Sweet Spot
Stufe 2
Empfohlen
Angenehmer Alltagsbetrieb
CPU
x86-64 mit AVX2 (Intel ab Haswell, AMD ab Excavator)
NVIDIA ≥ 4 GB VRAM (CUDA) oder moderne GPU ≥ 6 GB VRAM (Smart Modes)
Speicher
Bis zu 10 GB
OS
Windows 10/11 aktuell + aktueller GPU-Treiber
z.B. Power-User mit GPU-Workstation
03 — Modelle
Sechs Modelle. Whisper & Parakeet.
Whisper
OpenAI · 5 Modelle · 99 Sprachen
CPUVulkanCUDA
Tiny
39 M~75 MB
Sehr schnelle Notizen, schwächste Genauigkeit
DEFAULT
Base
74 M~141 MB
Solider Allrounder für CPU-only Geräte
Small
244 M~466 MB
Gute Genauigkeit, noch CPU-tauglich
Medium
769 M~1,5 GB
Hohe Genauigkeit, GPU empfohlen
Large v3 Turbo
809 M~1,6 GB
Beste Genauigkeit, GPU dringend empfohlen
Parakeet
NVIDIA NeMo · 1 Modell · 25 Sprachen
CPUDirectML
DEFAULT
parakeet-tdt-0.6b-v3
~2,5 GB4 Dateien
25 europäische Sprachen mit automatischer Spracherkennung — DE, EN, ES, FR, IT, PT, NL, PL u.a. Niedrige Latenz, Streaming-tauglich.
04 — Smart Modes · Optional
Lokale LLMs, wenn Diktat Form annehmen soll.
Optional bereinigt, formatiert oder strukturiert ein lokales Sprachmodell den transkribierten Text — „in eine E-Mail formulieren“, „in Stichpunkte gliedern“.
Hinweis: Die großen Smart-Mode-Modelle brauchen eine DX12-GPU mit ausreichend VRAM. Ohne eine solche bleibt das kleine CPU-Modell (Qwen 2.5 0.5B) — es reicht für Interpunktion und leichte Glättung, nicht für anspruchsvolles Umformulieren. Die Spracheingabe selbst läuft in jedem Fall unverändert weiter.
Llama 3.2 3B Instruct
INT4
Größe
~3 GB
VRAM
≥ 4 GB
Backend
DirectML
Mistral 7B Instruct
v0.3 INT4
Größe
~4,3 GB
VRAM
≥ 6 GB
Backend
DirectML
Datenschutz
Deine Stimme verlässt diesen Rechner nicht.
🔒
Vollständig lokal
Alle Modelle laufen auf deinem Endgerät. Keine externe Verarbeitung.
☁
Keine Cloud
Audio- und Textdaten verlassen deinen Rechner nicht.
⬇
Einmaliger Download
Modelle werden einmalig direkt von Hugging Face geladen (nur die optionale CUDA-Laufzeit kommt vom Menterium-CDN) — danach offline-fähig.
05 — Häufige Fragen
Antworten in einem Satz.
Celerando fällt automatisch auf Vulkan zurück. Kein Fehler, kein Abbruch.
Ja. Whisper-Tiny und -Base laufen auf reiner CPU. Pre-AVX-Fallback existiert nur für Whisper-CPU.
Anwendung 100 MB plus aktivierte Modelle. Whisper-Base ist Standard (141 MB). Wer alles parallel nutzt, sollte 10 GB freihalten.
Nein. Modelle werden einmalig direkt von Hugging Face geladen; die optionale CUDA-Laufzeit wird vom Menterium-CDN nachgeladen. Updates kommen mit der nächsten App-Version, nicht im Hintergrund.
AVX2 — moderner CPU-Befehlssatz. DirectML — Microsofts GPU-API für ML. CUDA — NVIDIAs GPU-Compute-API.
Jetzt herunterladen.
14 Tage kostenlos testen. Modelle werden bei Aktivierung der Spracheingabe einmalig nachgeladen.