ComfyUI: Text to Speech
Saya sudah membuat workflow **Text-to-Speech Bahasa Indonesia** paling sederhana:
[Download workflow JSON ComfyUI TTS Indonesia](sandbox:/mnt/data/comfyui_tts_bahasa_indonesia_sederhana.json)
Workflow hanya menggunakan dua node:
```text Edge TTS → Save Audio ```
Node menggunakan suara perempuan Indonesia **Gadis**, kecepatan normal, dan menyimpan hasil sebagai WAV. Custom node tersebut juga menyediakan suara laki-laki Indonesia **Ardi**, serta pengaturan kecepatan dan tinggi nada. ([GitHub][1])
- 1. Instal custom node
Pada server:
```bash cd /opt/ai-stack ```
Jalankan:
```bash docker compose exec -u root comfyui bash -lc ' set -e
cd /opt/ComfyUI/custom_nodes
if [ ! -d ComfyUI-EdgeTTS ]; then
git clone https://github.com/1038lab/ComfyUI-EdgeTTS.git
fi
python -m pip install --no-cache-dir \
-r ComfyUI-EdgeTTS/requirements.txt
' ```
Kemudian restart:
```bash docker compose restart comfyui ```
Repositori resminya memang mengarahkan instalasi ke folder `custom_nodes`, dilanjutkan dengan pemasangan `requirements.txt`. ([GitHub][2])
Periksa apakah berhasil:
```bash docker compose logs --tail=100 comfyui ```
Cari apakah node berikut berhasil dimuat:
```text EdgeTTS Save_Audio ```
- 2. Upload workflow
Buka:
```text http://192.168.0.230:8188 ```
Kemudian seret file berikut ke canvas ComfyUI:
```text comfyui_tts_bahasa_indonesia_sederhana.json ```
Workflow JSON merupakan format resmi untuk menyimpan graph, node, widget, dan hubungan antar-node ComfyUI. ([ComfyUI][3])
- 3. Jalankan TTS
Pada node **Edge TTS**, ubah teks:
```text Halo, selamat datang. Ini adalah contoh text to speech sederhana dalam Bahasa Indonesia menggunakan ComfyUI. ```
Suara default:
```text [Indonesian] id-ID Gadis ```
Untuk suara laki-laki, pilih:
```text [Indonesian] id-ID Ardi ```
Lalu tekan:
```text Ctrl + Enter ```
atau klik **Queue**.
- 4. Lokasi hasil
File akan tersimpan sebagai:
```text /opt/ComfyUI/output/TTS/indonesia-0001.wav ```
Nomor akan bertambah otomatis:
```text indonesia-0002.wav indonesia-0003.wav indonesia-0004.wav ```
Node `Save_Audio` memang menyimpan keluaran di direktori output ComfyUI dan memberikan nomor urut ketika opsi overwrite dimatikan. ([GitHub][4])
- Catatan:** workflow ini menggunakan layanan Microsoft Edge TTS secara online, sehingga container ComfyUI memerlukan akses internet ketika menghasilkan suara. Tidak memerlukan API key. ([GitHub][5])
[1]: https://github.com/1038lab/ComfyUI-EdgeTTS/blob/main/ailab_edgeTTS.py "ComfyUI-EdgeTTS/ailab_edgeTTS.py at main · 1038lab/ComfyUI-EdgeTTS · GitHub" [2]: https://github.com/1038lab/ComfyUI-EdgeTTS "GitHub - 1038lab/ComfyUI-EdgeTTS: ComfyUI-EdgeTTS is a powerful text-to-speech node for ComfyUI, leveraging Microsoft's Edge TTS capabilities. It enables seamless conversion of text into natural-sounding speech, supporting multiple languages and voices. Ideal for enhancing user interactions, this node is easy to integrate and customize, making it perfect for various applications. · GitHub" [3]: https://docs.comfy.org/specs/workflow_json_0.4?utm_source=chatgpt.com "Workflow JSON 0.4 - ComfyUI" [4]: https://github.com/1038lab/ComfyUI-EdgeTTS/blob/main/ailab_audio.py "ComfyUI-EdgeTTS/ailab_audio.py at main · 1038lab/ComfyUI-EdgeTTS · GitHub" [5]: https://github.com/rany2/edge-tts?utm_source=chatgpt.com "GitHub - rany2/edge-tts: Use Microsoft Edge's online text-to-speech service from Python WITHOUT needing Microsoft Edge or Windows or an API key · GitHub"