Piper (offline)
Lightweight offline neural TTS based on Piper. 158 voices across 49 languages; per-voice models range 20-110 MB.
Settings Add-ons Piper TTS (offline) Install
Subtitld downloads it, checks its SHA-256, and keeps it updated.
- Languages
- 49
- Voices
- 158
- Add-on download
- 48–70 MB
- RAM, at least
- 512 MB
Voices
158 voices in 49 languages.
ar-jo2bg-bg1ca-es3cs-cz2cy-gb2da-dk1de-de10el-gr2en-gb11en-us26es-ar1es-es5es-mx2eu-es2fa-ir5fi-fi2fr-fr7hi-in3hu-hu3id-id1is-is4it-it2ka-ge1kk-kz3ku-tr1lb-lu1lv-lv1ml-in2ne-np3nl-be4nl-nl6no-no2pl-pl5pt-br4pt-pt1ro-ro1ru-ru4sk-sk1sl-si1sq-al1sr-rs1sv-se3sw-cd1te-in3tr-tr1uk-ua2ur-pk1vi-vn3zh-cn4
Options
In Settings › Add-ons › Piper TTS (offline) › Configure.
Folder where downloaded .onnx voices are stored. Defaults to ~/.local/share/subtitld/addons/piper-tts/models/
Languages
ar-jobg-bgca-escs-czcy-gbda-dkde-deel-gren-gben-uses-ares-eses-mxeu-esfa-irfi-fifr-frhi-inhu-huid-idis-isit-itka-gekk-kzku-trlb-lulv-lvml-inne-npnl-benl-nlno-nopl-plpt-brpt-ptro-roru-rusk-sksl-sisq-alsr-rssv-sesw-cdte-intr-truk-uaur-pkvi-vnzh-cn
Platforms
| System | Download |
|---|---|
| Linux x86-64 | 70.0 MB |
| macOS (universal) | 51.9 MB |
| Windows x86-64 | 48.1 MB |
License
MIT (add-on glue) + GPL-3.0-or-later (Piper, OHF-voice/piper1-gpl) + per-model licenses (often CC-BY)
Versions
- 1.0.3
Automated release for piper-tts v1.0.3.
Other Voices add-ons
-
Kokoro Offline
Lightweight offline neural TTS. ~80 MB model, sub-second per line on CPU, 54 preset voices across 9 languages.…
-
Supertonic Offline
Lightning-fast on-device multilingual TTS. 99M-parameter ONNX model, ~400 MB download, 31 languages, 10 preset…
-
sanoTTS Offline
Offline neural text-to-speech at 294k-2.3M parameters — pure numpy, no torch, no GPU. 28 voices across 14 languages,…
-
Parler-TTS Offline
Prompt-driven offline TTS. 34 named consistent speakers + free-text voice description. ~2 GB model, ~10-30s per…
-
Qwen3-TTS Clone
Multilingual neural TTS with 9 premium timbres + 3-second voice cloning. Heavy: ~3.5 GB model, 8+ GB RAM, CPU or…
-
Coqui XTTS Clone
Multilingual neural TTS with 6-second voice cloning. Heavy: ~2 GB model, CPU or CUDA.
-
F5-TTS Clone
Voice-clone neural TTS. Single 'f5-clone' voice; every request needs a 6-15s reference clip. ~1.5 GB model, en+zh…