Eu passei os ultimos meses construindo uma coisa que eu queria ter ha muito tempo: um estudio de voz que nao depende de nuvem, nao cobra por caractere e nao guarda a minha voz no servidor de ninguem. Chama ELEVEN AUDIO. Esta aberto, com o codigo e a documentacao tecnica inteira. E como ele nao tem video de apresentacao ainda, eu vou explicar aqui do jeito que interessa: o que ele faz, como ele funciona por dentro, o que foi medido de verdade e onde estao as armadilhas. LINKS DIRETOS Repositorio completo: https://github.com/gabrielkendy/eleven-audio Baixar o pacote, link fixo, sempre a versao mais nova: https://github.com/gabrielkendy/eleven-audio/releases/latest/download/eleven-audio.zip Prompt para colar na sua IA e ela instalar sozinha: https://github.com/gabrielkendy/eleven-audio/blob/main/PROMPT-INSTALAR.md POR QUE ISSO EXISTE Toda ferramenta de voz boa cobra por caractere. Voce escreve um texto, gera, e o credito acaba no meio do mes. Quando voce mais precisa, esta esperando o plano virar. E existe uma camada mais seria: a sua voz e um dado biometrico. Uma vez clonada num servidor de outra empresa, voce nao controla mais nada dela. O ELEVEN AUDIO resolve as duas coisas trazendo o estudio para dentro da maquina. Sem conta, sem assinatura, sem credito, sem telemetria. Depois da instalacao, o audio nao precisa sair do seu PC para lugar nenhum. E nao e um prototipo. E um app com 30 modulos de backend, 159 testes passando, 10 de 10 no protocolo de seguranca, e uma documentacao tecnica de 10 documentos que descreve cada decisao. O QUE ELE FAZ, FUNCAO POR FUNCAO CLONAGEM DE VOZ. Voce manda um clipe da sua voz, de 5 segundos a 3 minutos, e o app cria um perfil. O clipe ideal sao 30 segundos de fala limpa. Aqui esta o primeiro detalhe tecnico que faz diferenca: o app nao passa o seu clipe direto para o motor. Ele processa antes.