Gerador de voz IA
em português

Narração, diálogo, voiceover.
Tudo local. Tudo ilimitado.

36+ estilos vocais emocionais na sua própria GPU. Sem nuvem. Sem créditos. Ninguém mais toca no seu áudio. Clone vozes, alterne entre 10 idiomas e produza quanto precisar.

Local no seu PC 36+ emoções Clonagem de voz Sem créditos ou limites

Verificado pelo Windows Defender Privado por padrão Geração ilimitada

Ouça o Foundry em movimento

Uma visão direta do Demodokos Foundry: fala real em vários idiomas, bases musicais e efeitos vocais de estúdio, tudo gerado localmente em uma única máquina. Pressione o alto-falante para ativar o som.

Por que o local vence

Toda ferramenta de voz na nuvem tem os mesmos três problemas. Esta não tem nenhum deles.

Seus arquivos nunca saem do PC

Seus roteiros, seus clones de voz, seu áudio. Tudo fica no seu disco. Nada é enviado. Ninguém mais armazena seu trabalho. Ninguém treina modelos com ele.

Rápido porque é local

Sua GPU renderiza a voz. Clipes curtos levam segundos. Você não espera servidor e não divide fila com ninguém.

Sem créditos. Sem contagem.

Gere quantas tomadas quiser. Refaça uma linha dez vezes. Teste cada emoção. Não há medidor rodando e nada para acabar.

Trabalho real de áudio se paga na primeira semana

Autores, creators e estúdios usam Foundry para substituir contas cloud por caractere, abandonar limites de texto e publicar mais rápido do que um estúdio tradicional consegue marcar sessão.

Usado por autores indie, YouTubers e estúdios de jogos. 100% local. Sem limites de uso.

Autores e self-publishers

Autores e self-publishers

Narre um romance inteiro em uma noite em vez de pagar $3.000+ por estúdio. Regrave qualquer linha em segundos. Seu manuscrito nunca sai da máquina, então o rascunho inédito fica privado.

YouTubers e criadores de conteúdo

YouTubers e criadores de conteúdo

Produza voiceovers limpos, hooks e shorts em escala. Gere dez leituras alternativas, teste thumbnails com vozes diferentes e deixe uma semana de vídeos pronta em uma tarde. Sem custo por palavra.

Estúdios de jogos e agências

Estúdios de jogos e agências

Prototipe diálogos de NPC, tomadas alternativas e copy multilíngue sem reservar talentos de voz. Ajuste tom e emoção até a fala funcionar, depois exporte localmente.

Comece seu teste grátis de 7 dias

Sem cobrança durante o teste. Cancele quando quiser. Roda no seu PC Windows com GPU NVIDIA.

Da página em branco ao áudio pronto em 5 passos simples

Sem reservar estúdio. Sem cobrança por caractere. Todo o fluxo, voz e música, roda no seu PC com Windows em menos de um minuto por página.

É a sua primeira vez aqui? Assista ao tutorial de 4 minutos sobre instalação e primeira execução antes de começar.
1/ 5
Passo 1

Escolha ou crie uma voz

Use os presets de voz que já vêm no app, clone a sua voz ou uma amostra de referência, ou gere uma voz totalmente nova. Vozes clonadas ficam no seu disco e nunca passam por um servidor.

2/ 5
Passo 2

Cole o roteiro e escale cada personagem

Jogue dentro um capítulo, um livro inteiro, o roteiro de um vídeo ou um arquivo de diálogos. O editor de roteiro redesenhado divide tudo em falas no momento em que você cola, então cada personagem ganha a própria voz e você dirige um elenco inteiro, não só um narrador.

3/ 5
Passo 3

Dirija a emoção linha por linha

Marque qualquer parágrafo como calmo, empolgado, sussurrado, irritado, sarcástico ou qualquer ponto entre eles, com 5 níveis de intensidade por emoção. A voz continua sendo o mesmo personagem, o que muda é o sentimento.

4/ 5
Passo 4

Gere música em qualquer estilo, em 50 idiomas

Trilhas originais, loops de ambiente, músicas completas com vocais, bases instrumentais. Qualquer gênero, qualquer clima, cantado em qualquer um dos 50 idiomas. Faça a trilha da sua narração ou escreva uma faixa independente e arraste direto para a sua timeline. Sem uma segunda ferramenta e sem outra assinatura.

5/ 5
Passo 5

Esculpa cada fala com DSP e efeitos de voz

Aplique efeitos de qualidade de estúdio em uma única fala ou na faixa inteira. Transforme um narrador em alienígena, demônio ou transmissão de rádio antiga com um clique, e depois use reverb, EQ, auto-tune, deslocamento de formantes e glitch, tudo não destrutivo. Um rack de DSP completo, embutido, sem plugins e sem DAW externa.

O que você vai precisar

Foundry roda em Windows com uma GPU NVIDIA. Aqui está uma visão geral rápida.

Sistema operacional

Windows 10 ou 11, 64 bits
Otimizado para estações Windows
Disco SSD/NVMe recomendado

Placa de vídeo

GPU NVIDIA com 6 GB+ VRAM
qualquer RTX, incl. GTX 1080, 12 GB+ recomendado

Níveis de VRAM

6–8 GB: desempenho reduzido
16 GB+: + Creative AI multilingue
24 GB+: + Creative AI brilhante
32 GB+: + desempenho extremo

Bom saber

Instalador: ~70 MB
Pack de modelos no primeiro uso: ~20–25 GB
Mais packs disponíveis depois

Perguntas frequentes

O Demodokos Foundry funciona offline?

Sim. Toda geração por IA, clonagem de voz e processamento de áudio acontece localmente na sua GPU. Prompts, roteiros, amostras de voz e áudio gerado não são enviados para um serviço em nuvem. Ainda é necessária uma conexão com a internet para login e verificação da licença. O Foundry pode sair da sua conta se não conseguir alcançar o servidor de autenticação por um período prolongado.

O Demodokos Foundry envia meus arquivos de áudio para a nuvem?

Não. Seus arquivos de áudio, amostras de voz, prompts, roteiros, dados de projeto e conteúdo gerado permanecem no seu computador. O Foundry não envia conteúdo criativo para um serviço de IA em nuvem para geração ou processamento.

Que GPU preciso para rodar o Demodokos Foundry?

Uma GPU NVIDIA com pelo menos 4 GB de VRAM pode executar alguns modelos de Speech com qualidade reduzida. 6 GB são um ponto de partida mais prático, enquanto 12 GB ou mais são recomendados para o melhor desempenho geral de Music e Speech. GPUs AMD com pelo menos 8 GB de VRAM podem executar Music e Speech via Vulkan, embora o suporte a AMD continue experimental. NVIDIA com CUDA é a opção recomendada.

Tenho uma GPU AMD. Vai funcionar?

Sim. GPUs AMD com pelo menos 8 GB de VRAM podem executar Music e Speech via Vulkan. O suporte a AMD continua experimental e pode ser menos consistente que NVIDIA/CUDA, que oferece a experiência Foundry mais madura.

O Demodokos Foundry funciona no macOS ou Linux?

O Foundry está disponível atualmente para Windows 10 e Windows 11 de 64 bits. Ainda não há versões nativas para macOS ou Linux.

Quanto custa o Demodokos Foundry?

O plano Creator custa $15.00/mês e o plano Professional $49.00/mês. Também há faturamento anual com desconto. Os dois planos incluem geração local ilimitada de música e voz por IA, sem créditos por geração; os limites do plano se aplicam ao tamanho e à duração dos projetos e aos recursos avançados. Está incluído um teste gratuito de 7 dias.

Existe teste grátis?

Sim. O Demodokos Foundry oferece um teste gratuito de 7 dias com todos os recursos da licença selecionada. Ele é ativado pelo PayPal com uma autorização de $0, e você não é cobrado se não mantiver a assinatura depois do fim do teste. Cancele a qualquer momento antes do vencimento.

Posso cancelar minha assinatura a qualquer momento?

Sim, a qualquer momento, em Faturamento > Cancelar. O cancelamento interrompe a próxima renovação e entra em vigor no fim do período de cobrança atual: o mês em curso para planos mensais ou o ano em curso para planos anuais. Você mantém o acesso completo até lá. Pagamentos já realizados não são reembolsados e não há taxa de cancelamento. Durante o teste gratuito, você pode cancelar a qualquer momento sem cobrança.

Posso clonar minha própria voz com o Demodokos Foundry?

Sim. Importe uma gravação curta da sua voz - ou de outra voz que você tenha autorização para usar - e o Foundry cria o clone localmente no seu computador. Vozes clonadas podem usar mais de 40 emoções e estilos de fala, cada um com cinco níveis de intensidade, sem cobrança por caractere ou por geração.

Quais idiomas o Demodokos Foundry suporta?

O Demodokos Foundry suporta geração de música e letras em 50 idiomas e geração de fala e voz em 10 idiomas. O agente Creative AI é otimizado para conversas em inglês. Modelos Creative AI maiores, disponíveis em sistemas com mais VRAM, entendem idiomas adicionais e oferecem recursos multilíngues mais fortes para escrever letras, analisar textos e preparar narrações.

O Demodokos Foundry usa modelos de IA open source ou proprietários?

O Demodokos Foundry usa sistemas de IA proprietários e modelos adaptados desenvolvidos a partir de bases open source. A Demodokos modifica, amplia e adapta extensivamente essas bases antes de integrá-las à sua arquitetura proprietária de música, fala e produção de áudio.

O motor Music v4 parte de uma base ACE-Step 1.5 modificada, com estabilização guiada por fluxo espectral integrada diretamente ao processo de geração. O Speech v4 avança o Qwen3-TTS por meio de novas adaptações e amplas mudanças arquitetônicas, enquanto o Creative AI usa modelos de linguagem Qwen3 restritos em um pipeline agêntico personalizado. A Demodokos também reengenheirou a tecnologia AudioSeal da Meta para criar o Tonotope, um sistema leve de marcação de origem de IA incorporado diretamente ao áudio gerado e mantido inaudível.

Toda inferência de IA é executada localmente por meio de uma pilha de inferência C++ personalizada baseada em GGML e ONNX.

O Demodokos Foundry é apenas uma camada sobre modelos de IA open source?

Não. Uma simples camada normalmente adiciona uma nova interface a um modelo existente e deixa praticamente inalterados a tecnologia e o fluxo de trabalho subjacentes. O Foundry vai muito além.

A Demodokos modifica e amplia os próprios modelos e depois constrói ao redor deles sistemas proprietários de geração, consistência vocal, orquestração e processamento de áudio. Music v4 e Speech v4 incluem mudanças que afetam diretamente a estabilidade musical, a identidade do locutor, a expressão e a consistência em conteúdos longos.

A diferença fica especialmente clara no rico Speech Editor. Ele combina uma experiência familiar de escrita em documentos com ferramentas criadas especificamente para produção falada: indicações visuais de locutor e interpretação, música de fundo e inserções sonoras, diálogos sobrepostos, crosstalk natural, temporização precisa em nível de amostra e efeitos DSP ajustáveis visualmente. Cada frase pode ser ouvida, editada ou regenerada em contexto, com controle individual de ritmo, tom, volume e interpretação.

Os pipelines agênticos do Foundry podem processar livros inteiros, dividi-los em capítulos, resumir e analisar o conteúdo, examinar imagens e texto por OCR, identificar locutores, criar vozes a partir de descrições de personagens geradas por IA e preparar a narração. Um pipeline separado de narração pode adaptar o texto, escolher o locutor adequado e selecionar emoções apropriadas linha por linha.

Depois, os projetos podem seguir para geração de música, separação de stems, reparo de trechos, arranjo na timeline, mixagem e exportação final. O Foundry não é uma interface para modelos de terceiros, mas um ambiente local e integrado de produção de áudio que leva textos longos do documento ao som finalizado.

Como o Demodokos Foundry é diferente do ElevenLabs?

O ElevenLabs é uma plataforma em nuvem baseada em créditos mensais de uso. O Demodokos Foundry é um ambiente local de produção de áudio para Windows: a geração roda na sua própria GPU, seus roteiros, vozes e áudios permanecem no seu computador e a produção não é medida por caracteres nem por créditos de geração.

O Foundry também foi criado para produções completas, não para gerações isoladas. Seu rico Speech Editor permite escrever em uma interface familiar de documento, atribuir locutores, dirigir emoção e interpretação linha por linha, inserir música e sons, criar diálogos sobrepostos e crosstalk, regenerar qualquer frase em contexto e ajustar ritmo, tom, volume, temporização e DSP sem sair do documento. Fluxos agênticos podem preparar livros inteiros segmentando capítulos, analisando texto e imagens, identificando locutores, projetando vozes e dirigindo a narração.

Geração de música, separação de stems, reparo de trechos, mixagem na timeline e automação estão integrados no mesmo aplicativo desktop. A diferença principal é um estúdio local, privado e integrado, em vez de um serviço em nuvem cujo uso é medido em créditos.

O Demodokos Foundry é seguro para empresas e compatível com o GDPR?

Sim. O Demodokos Foundry foi projetado para oferecer suporte a fluxos de trabalho compatíveis com o GDPR. Toda geração por IA, clonagem de voz e processamento de áudio acontece no seu próprio hardware, portanto conteúdo empresarial, áudio de clientes, gravações de voz proprietárias, roteiros internos e narrações confidenciais permanecem no seu ambiente em vez de serem enviados a um provedor de IA em nuvem. Nenhum provedor de IA em nuvem recebe ou retém seu conteúdo criativo. Isso dá à sua organização controle direto e soberania de dados sobre o processo de geração, tornando o Foundry especialmente adequado para empresas, equipes jurídicas, saúde, agências de mídia e outros trabalhos sensíveis.

O Demodokos Foundry está em conformidade com o AI Act da UE?

Sim. O Demodokos Foundry foi projetado para atender aos requisitos de transparência aplicáveis do AI Act da UE. O áudio gerado é identificado nos metadados como criado por IA e recebe o Tonotope, a marca d´água robusta e inaudível da Demodokos que indica sua origem por IA.