Escolha ou crie uma voz
Use os presets de voz que já vêm no app, clone a sua voz ou uma amostra de referência, ou gere uma voz totalmente nova. Vozes clonadas ficam no seu disco e nunca passam por um servidor.
Narração, diálogo, voiceover.
Tudo local. Tudo ilimitado.
36+ estilos vocais emocionais na sua própria GPU. Sem nuvem. Sem créditos. Ninguém mais toca no seu áudio. Clone vozes, alterne entre 10 idiomas e produza quanto precisar.
Local no seu PC 36+ emoções Clonagem de voz Sem créditos ou limites
Verificado pelo Windows Defender Privado por padrão Geração ilimitada
Uma visão direta do Demodokos Foundry: fala real em vários idiomas, bases musicais e efeitos vocais de estúdio, tudo gerado localmente em uma única máquina. Pressione o alto-falante para ativar o som.
Toda ferramenta de voz na nuvem tem os mesmos três problemas. Esta não tem nenhum deles.
Seus roteiros, seus clones de voz, seu áudio. Tudo fica no seu disco. Nada é enviado. Ninguém mais armazena seu trabalho. Ninguém treina modelos com ele.
Sua GPU renderiza a voz. Clipes curtos levam segundos. Você não espera servidor e não divide fila com ninguém.
Gere quantas tomadas quiser. Refaça uma linha dez vezes. Teste cada emoção. Não há medidor rodando e nada para acabar.
Autores, creators e estúdios usam Foundry para substituir contas cloud por caractere, abandonar limites de texto e publicar mais rápido do que um estúdio tradicional consegue marcar sessão.
Usado por autores indie, YouTubers e estúdios de jogos. 100% local. Sem limites de uso.

Narre um romance inteiro em uma noite em vez de pagar $3.000+ por estúdio. Regrave qualquer linha em segundos. Seu manuscrito nunca sai da máquina, então o rascunho inédito fica privado.

Produza voiceovers limpos, hooks e shorts em escala. Gere dez leituras alternativas, teste thumbnails com vozes diferentes e deixe uma semana de vídeos pronta em uma tarde. Sem custo por palavra.

Prototipe diálogos de NPC, tomadas alternativas e copy multilíngue sem reservar talentos de voz. Ajuste tom e emoção até a fala funcionar, depois exporte localmente.
Sem cobrança durante o teste. Cancele quando quiser. Roda no seu PC Windows com GPU NVIDIA.
Sem reservar estúdio. Sem cobrança por caractere. Todo o fluxo, voz e música, roda no seu PC com Windows em menos de um minuto por página.
É a sua primeira vez aqui? Assista ao tutorial de 4 minutos sobre instalação e primeira execução antes de começar.Use os presets de voz que já vêm no app, clone a sua voz ou uma amostra de referência, ou gere uma voz totalmente nova. Vozes clonadas ficam no seu disco e nunca passam por um servidor.
Jogue dentro um capítulo, um livro inteiro, o roteiro de um vídeo ou um arquivo de diálogos. O editor de roteiro redesenhado divide tudo em falas no momento em que você cola, então cada personagem ganha a própria voz e você dirige um elenco inteiro, não só um narrador.
Marque qualquer parágrafo como calmo, empolgado, sussurrado, irritado, sarcástico ou qualquer ponto entre eles, com 5 níveis de intensidade por emoção. A voz continua sendo o mesmo personagem, o que muda é o sentimento.
Trilhas originais, loops de ambiente, músicas completas com vocais, bases instrumentais. Qualquer gênero, qualquer clima, cantado em qualquer um dos 50 idiomas. Faça a trilha da sua narração ou escreva uma faixa independente e arraste direto para a sua timeline. Sem uma segunda ferramenta e sem outra assinatura.
Aplique efeitos de qualidade de estúdio em uma única fala ou na faixa inteira. Transforme um narrador em alienígena, demônio ou transmissão de rádio antiga com um clique, e depois use reverb, EQ, auto-tune, deslocamento de formantes e glitch, tudo não destrutivo. Um rack de DSP completo, embutido, sem plugins e sem DAW externa.
Foundry roda em Windows com uma GPU NVIDIA. Aqui está uma visão geral rápida.
Windows 10 ou 11, 64 bits
Otimizado para estações Windows
Disco SSD/NVMe recomendado
GPU NVIDIA com 6 GB+ VRAM
qualquer RTX, incl. GTX 1080, 12 GB+ recomendado
6–8 GB: desempenho reduzido
16 GB+: + Creative AI multilingue
24 GB+: + Creative AI brilhante
32 GB+: + desempenho extremo
Instalador: ~70 MB
Pack de modelos no primeiro uso: ~20–25 GB
Mais packs disponíveis depois
Gere voz e música sem limites no seu próprio PC.
Cancele quando quiser · Roda 100% local · App desktop Windows
Sim. Toda geração por IA, clonagem de voz e processamento de áudio acontece localmente na sua GPU. Prompts, roteiros, amostras de voz e áudio gerado não são enviados para um serviço em nuvem. Ainda é necessária uma conexão com a internet para login e verificação da licença. O Foundry pode sair da sua conta se não conseguir alcançar o servidor de autenticação por um período prolongado.
Não. Seus arquivos de áudio, amostras de voz, prompts, roteiros, dados de projeto e conteúdo gerado permanecem no seu computador. O Foundry não envia conteúdo criativo para um serviço de IA em nuvem para geração ou processamento.
Uma GPU NVIDIA com pelo menos 4 GB de VRAM pode executar alguns modelos de Speech com qualidade reduzida. 6 GB são um ponto de partida mais prático, enquanto 12 GB ou mais são recomendados para o melhor desempenho geral de Music e Speech. GPUs AMD com pelo menos 8 GB de VRAM podem executar Music e Speech via Vulkan, embora o suporte a AMD continue experimental. NVIDIA com CUDA é a opção recomendada.
Sim. GPUs AMD com pelo menos 8 GB de VRAM podem executar Music e Speech via Vulkan. O suporte a AMD continua experimental e pode ser menos consistente que NVIDIA/CUDA, que oferece a experiência Foundry mais madura.
O Foundry está disponível atualmente para Windows 10 e Windows 11 de 64 bits. Ainda não há versões nativas para macOS ou Linux.
O plano Creator custa $15.00/mês e o plano Professional $49.00/mês. Também há faturamento anual com desconto. Os dois planos incluem geração local ilimitada de música e voz por IA, sem créditos por geração; os limites do plano se aplicam ao tamanho e à duração dos projetos e aos recursos avançados. Está incluído um teste gratuito de 7 dias.
Sim. O Demodokos Foundry oferece um teste gratuito de 7 dias com todos os recursos da licença selecionada. Ele é ativado pelo PayPal com uma autorização de $0, e você não é cobrado se não mantiver a assinatura depois do fim do teste. Cancele a qualquer momento antes do vencimento.
Sim, a qualquer momento, em Faturamento > Cancelar. O cancelamento interrompe a próxima renovação e entra em vigor no fim do período de cobrança atual: o mês em curso para planos mensais ou o ano em curso para planos anuais. Você mantém o acesso completo até lá. Pagamentos já realizados não são reembolsados e não há taxa de cancelamento. Durante o teste gratuito, você pode cancelar a qualquer momento sem cobrança.
Sim. Importe uma gravação curta da sua voz - ou de outra voz que você tenha autorização para usar - e o Foundry cria o clone localmente no seu computador. Vozes clonadas podem usar mais de 40 emoções e estilos de fala, cada um com cinco níveis de intensidade, sem cobrança por caractere ou por geração.
O Demodokos Foundry suporta geração de música e letras em 50 idiomas e geração de fala e voz em 10 idiomas. O agente Creative AI é otimizado para conversas em inglês. Modelos Creative AI maiores, disponíveis em sistemas com mais VRAM, entendem idiomas adicionais e oferecem recursos multilíngues mais fortes para escrever letras, analisar textos e preparar narrações.
O Demodokos Foundry usa sistemas de IA proprietários e modelos adaptados desenvolvidos a partir de bases open source. A Demodokos modifica, amplia e adapta extensivamente essas bases antes de integrá-las à sua arquitetura proprietária de música, fala e produção de áudio.
O motor Music v4 parte de uma base ACE-Step 1.5 modificada, com estabilização guiada por fluxo espectral integrada diretamente ao processo de geração. O Speech v4 avança o Qwen3-TTS por meio de novas adaptações e amplas mudanças arquitetônicas, enquanto o Creative AI usa modelos de linguagem Qwen3 restritos em um pipeline agêntico personalizado. A Demodokos também reengenheirou a tecnologia AudioSeal da Meta para criar o Tonotope, um sistema leve de marcação de origem de IA incorporado diretamente ao áudio gerado e mantido inaudível.
Toda inferência de IA é executada localmente por meio de uma pilha de inferência C++ personalizada baseada em GGML e ONNX.
Não. Uma simples camada normalmente adiciona uma nova interface a um modelo existente e deixa praticamente inalterados a tecnologia e o fluxo de trabalho subjacentes. O Foundry vai muito além.
A Demodokos modifica e amplia os próprios modelos e depois constrói ao redor deles sistemas proprietários de geração, consistência vocal, orquestração e processamento de áudio. Music v4 e Speech v4 incluem mudanças que afetam diretamente a estabilidade musical, a identidade do locutor, a expressão e a consistência em conteúdos longos.
A diferença fica especialmente clara no rico Speech Editor. Ele combina uma experiência familiar de escrita em documentos com ferramentas criadas especificamente para produção falada: indicações visuais de locutor e interpretação, música de fundo e inserções sonoras, diálogos sobrepostos, crosstalk natural, temporização precisa em nível de amostra e efeitos DSP ajustáveis visualmente. Cada frase pode ser ouvida, editada ou regenerada em contexto, com controle individual de ritmo, tom, volume e interpretação.
Os pipelines agênticos do Foundry podem processar livros inteiros, dividi-los em capítulos, resumir e analisar o conteúdo, examinar imagens e texto por OCR, identificar locutores, criar vozes a partir de descrições de personagens geradas por IA e preparar a narração. Um pipeline separado de narração pode adaptar o texto, escolher o locutor adequado e selecionar emoções apropriadas linha por linha.
Depois, os projetos podem seguir para geração de música, separação de stems, reparo de trechos, arranjo na timeline, mixagem e exportação final. O Foundry não é uma interface para modelos de terceiros, mas um ambiente local e integrado de produção de áudio que leva textos longos do documento ao som finalizado.
O ElevenLabs é uma plataforma em nuvem baseada em créditos mensais de uso. O Demodokos Foundry é um ambiente local de produção de áudio para Windows: a geração roda na sua própria GPU, seus roteiros, vozes e áudios permanecem no seu computador e a produção não é medida por caracteres nem por créditos de geração.
O Foundry também foi criado para produções completas, não para gerações isoladas. Seu rico Speech Editor permite escrever em uma interface familiar de documento, atribuir locutores, dirigir emoção e interpretação linha por linha, inserir música e sons, criar diálogos sobrepostos e crosstalk, regenerar qualquer frase em contexto e ajustar ritmo, tom, volume, temporização e DSP sem sair do documento. Fluxos agênticos podem preparar livros inteiros segmentando capítulos, analisando texto e imagens, identificando locutores, projetando vozes e dirigindo a narração.
Geração de música, separação de stems, reparo de trechos, mixagem na timeline e automação estão integrados no mesmo aplicativo desktop. A diferença principal é um estúdio local, privado e integrado, em vez de um serviço em nuvem cujo uso é medido em créditos.
Sim. O Demodokos Foundry foi projetado para oferecer suporte a fluxos de trabalho compatíveis com o GDPR. Toda geração por IA, clonagem de voz e processamento de áudio acontece no seu próprio hardware, portanto conteúdo empresarial, áudio de clientes, gravações de voz proprietárias, roteiros internos e narrações confidenciais permanecem no seu ambiente em vez de serem enviados a um provedor de IA em nuvem. Nenhum provedor de IA em nuvem recebe ou retém seu conteúdo criativo. Isso dá à sua organização controle direto e soberania de dados sobre o processo de geração, tornando o Foundry especialmente adequado para empresas, equipes jurídicas, saúde, agências de mídia e outros trabalhos sensíveis.
Sim. O Demodokos Foundry foi projetado para atender aos requisitos de transparência aplicáveis do AI Act da UE. O áudio gerado é identificado nos metadados como criado por IA e recebe o Tonotope, a marca d´água robusta e inaudível da Demodokos que indica sua origem por IA.