# 음성 생성 AI

[원문](https://www.linkymeadow.com/w/a9ad03/)

마지막 수정: 2026-10-04 19:30 (KST)

텍스트를 음성으로 바꾸고 내레이션·더빙을 만드는 웹 서비스와 로컬 실행 도구·모델을 모았습니다.

## 웹 서비스

- [ElevenLabs](https://elevenlabs.io/text-to-speech)

  텍스트를 여러 언어의 음성으로 변환해 영상 내레이션·오디오북·대화 음성을 만들 수 있습니다.
- [타입캐스트](https://typecast.ai/kr/)

  대본과 원하는 목소리·감정 표현을 바탕으로 음성을 만들고 영상·자막과 함께 편집할 수 있습니다.
- [클로바더빙](https://clovadubbing.naver.com/)

  입력한 대본을 음성으로 변환해 영상에 더빙을 추가하는 네이버의 서비스입니다.

## 로컬 실행 도구·모델

- [Qwen3-TTS](https://github.com/QwenLM/Qwen3-TTS)

  한국어를 포함한 여러 언어의 음성 생성과 텍스트 지시를 통한 목소리·감정 제어를 지원하며 로컬 실행 코드를 제공합니다.
- [F5-TTS](https://github.com/SWivid/F5-TTS)

  참고 음성과 대본을 바탕으로 새 음성을 생성하는 모델로, 로컬 웹 화면과 명령줄 실행 도구를 제공합니다.
- [Kokoro](https://github.com/hexgrad/kokoro)

  텍스트를 선택한 목소리의 음성으로 바꾸는 모델과 Python 실행 라이브러리를 제공합니다.

## 관련 문서

- [이미지 생성 AI](https://www.linkymeadow.com/w/7b8f20/)
- [영상 생성 AI](https://www.linkymeadow.com/w/630a6b/)
- [음악 생성 AI](https://www.linkymeadow.com/w/f50609/)
- [3D 생성 AI](https://www.linkymeadow.com/w/a9378e/)
- [AI·에이전트](https://www.linkymeadow.com/w/dd12dc/)
