0%
选择引擎和语音,输入文字,然后点击按钮。浏览器可能会短暂卡住。这说明模型正在生成音频。不要关闭窗口,请稍等。
为什么完全免费?
云端服务按字符和 token 收费。你为计算音频的 GPU 服务器付费。
本站不一样。AI 模型运行在你的处理器(CPU)或显卡(GPU)上。
我们没有服务器成本,所以不需要限制你。无需订阅、无需注册、没有限制。
TTS 引擎对比
四个引擎,四种质量。选择适合你设备和用途的那一个。
| 项目 | Kokoro TTS | Piper TTS | Kitten TTS | eSpeak NG |
|---|---|---|---|---|
| 语音质量 | 超真实 | 自然、清晰 | 轻量、流畅 | 机器人音 |
| 硬件要求 | 中等(需要 WebGPU) | 低(CPU) | 非常低 | 极低(到处可运行) |
| 模型大小 | ~326 MB | ~60 MB | ~23 MB | 无需下载 |
| 用途 | 有声书、视频 | 提示音、助手 | 低端设备 | 无障碍 |
常见问题(FAQ)
我的文字会被保存吗?
不会。所有引擎都通过 WebAssembly(WASM)和 WebGPU 在本地运行。你的数据不会发送到任何服务器。
为什么第一次生成花了几秒?
首次使用某个语音时,浏览器会下载模型文件(约 23 到 326 MB)。之后每次生成都会从缓存中瞬间完成。
可以下载音频文件吗?
可以。你会得到没有水印的 .wav 或 .mp3 文件,也可以用于商业用途。