Warum ist das 100% kostenlos?
Cloud-Dienste verlangen Geld für Zeichen und Tokens. Du zahlst für die GPU-Server, auf denen dein Audio berechnet wird.
Diese Seite arbeitet anders. Die KI-Modelle laufen auf deinem Prozessor (CPU) oder deiner Grafikkarte (GPU).
Wir haben keine Serverkosten und müssen dich daher nicht einschränken. Kein Abo, keine Anmeldung, keine Limits.
Vergleich der TTS-Engines
Vier Engines, vier Qualitätsstufen. Wähle die, die zu deiner Hardware und deinem Einsatz passt.
| Merkmal | Kokoro TTS | Piper TTS | Kitten TTS | eSpeak NG |
|---|---|---|---|---|
| Stimmqualität | Ultra-realistisch | Natürlich, klar | Leicht, flüssig | Robotisch, klassisch |
| Hardware | Mittel (WebGPU empfohlen) | Niedrig (CPU) | Sehr niedrig | Minimal (läuft überall) |
| Modellgröße | ~326 MB | ~60 MB | ~23 MB | Kein Download |
| Einsatz | Hörbücher, Video | Ansagen, Assistenten | Schwache Geräte | Barrierefreiheit |
Häufige Fragen (FAQ)
Wird mein Text irgendwo gespeichert?
Nein. Alle Engines laufen lokal über WebAssembly (WASM) und WebGPU. Deine Daten werden auf keinen Server gesendet.
Warum dauerte die erste Erzeugung etwas?
Beim ersten Einsatz einer Stimme lädt der Browser die Modelldatei (ca. 23-326 MB). Danach ist jede Erzeugung sofort da, aus dem Cache.
Kann ich die Audiodatei herunterladen?
Ja. Du bekommst fertiges Audio als .wav oder .mp3 ohne Wasserzeichen. Auch kommerzielle Nutzung ist erlaubt.