O VoiceStudio é um programa de código aberto que faz no seu computador o que serviços como o ElevenLabs fazem na nuvem: clonar uma voz a partir de uma gravação, criar vozes do zero, dublar vídeo para outro idioma, transcrever, fazer ditado e montar audiobook com capítulos, em 646 idiomas.
A diferença é onde roda. Tudo acontece na sua máquina: sem chave de API, sem cobrança por caractere e sem mandar o seu áudio para servidor de ninguém. O preço é o seu computador fazer o trabalho pesado.
Este guia mostra o que ele faz, como instalar, como clonar a primeira voz e o que esperar do seu hardware. Números conferidos na API do GitHub em 04/10/2026: 53.032 estrelas, licença AGPL-3.0.
Os links
- Repositório: https://github.com/debpalash/VoiceStudio
- Site: https://voicestudio.sh
- Download direto (Windows, Mac e Linux): https://github.com/debpalash/VoiceStudio/releases/latest
O que ele faz
- Clonar voz. A partir de uma gravação limpa de referência, gera fala nova com aquela voz.
- Criar voz. Você descreve as características e ele monta uma voz que não existe.
- Dublar vídeo. Transcreve, traduz e gera a fala no novo idioma, encaixada no tempo do vídeo.
- Transcrever e ditar. Inclusive com um widget flutuante para ditar em qualquer programa.
- Audiobook. Texto longo vira áudio dividido em capítulos.
- Conectar com agentes. Tem API local e servidor MCP (o conector que liga o Claude a ferramentas externas), então dá para pedir ao Claude para gerar áudio por ele.
O motor padrão é o OmniVoice, mas dá para instalar outros motores de voz e de transcrição pelo catálogo do próprio programa.
Como instalar
Windows: abra o PowerShell e rode:
irm https://voicestudio.sh/install | iex
Mac e Linux: no terminal:
curl -fsSL https://voicestudio.sh/install | sh
Ou baixe o instalador pronto (.exe, .dmg, .AppImage ou .deb) na página de releases.
Também dá para pedir ao Claude Code para instalar, colando:
Install the VoiceStudio Electron app on this device and verify it works, following
https://github.com/debpalash/VoiceStudio/blob/main/docs/install/agent.md
Clonando a primeira voz
- Grave uma referência limpa. Entre 10 e 30 segundos, ambiente silencioso, sem música de fundo, falando no seu ritmo normal.
- Abra a área "Voice cloning" e adicione a gravação.
- Escreva o texto que você quer que a voz fale.
- Gere. Na primeira vez, o programa pede para baixar o modelo; aceite e espere.
- Ajuste e repita. Se a voz sair robótica, a referência costuma ser o problema: grave de novo com menos ruído.
O que o seu computador precisa ter
| Computador | Como roda |
|---|---|
| Placa de vídeo NVIDIA (Windows/Linux) | Rápido, com aceleração |
| Mac com chip Apple (M1 em diante) | Rápido, com aceleração |
| Sem placa de vídeo dedicada | Funciona, mais devagar; precisa de uns 5 GB livres |
| Mac antigo com Intel | Só a interface; o processamento precisa ficar em outra máquina |
Resumo: qualquer computador razoável roda. Com placa de vídeo, a espera cai muito.
Os limites
- Clonar a voz de alguém só com autorização. O próprio projeto pede isso e tem trava contra imitação de pessoas. Voz de outra pessoa sem consentimento esbarra em direito de imagem e pode virar fraude.
- Uso comercial: confira a licença do modelo. O programa é AGPL-3.0, mas cada motor de voz tem a própria licença. Se o áudio vai para vídeo pago ou cliente, leia a do motor que você usou.
- Qualidade depende do motor e da referência. Serviço pago ainda pode sair na frente em alguns idiomas. Teste com o seu caso antes de cancelar qualquer assinatura.