한국어 AI
음성 생성기

내레이션, 대화, 보이스오버.
모두 로컬. 모두 무제한.

내 GPU에서 36+ 감정형 음성 스타일을 생성하세요. 클라우드 없음. 크레딧 없음. 다른 사람이 내 오디오를 만지지 않습니다. 음성을 클론하고, 10개 언어를 전환하며, 필요한 만큼 제작하세요.

내 PC에서 로컬 실행 36+ 감정 음성 클로닝 크레딧과 한도 없음

Windows Defender 검증 완료 기본 비공개 무제한 생성

Foundry가 작동하는 소리

Demodokos Foundry를 실제로 확인하세요. 여러 언어의 실제 음성, 배경 음악, 스튜디오 보이스 효과가 모두 한 대의 컴퓨터에서 로컬로 생성됩니다. 스피커를 눌러 소리를 켜세요.

로컬이 이기는 이유

모든 클라우드 음성 도구에는 같은 세 가지 문제가 있습니다. Foundry에는 없습니다.

파일은 절대 PC를 떠나지 않습니다

스크립트, 음성 클론, 오디오가 모두 하드 드라이브에 남습니다. 업로드되지 않습니다. 다른 사람이 작업물을 저장하지 않습니다. 학습에도 사용되지 않습니다.

로컬이라 빠릅니다

내 GPU가 음성을 렌더링합니다. 짧은 클립은 몇 초면 됩니다. 서버를 기다리거나 다른 사람과 큐를 나눠 쓰지 않습니다.

크레딧 없음. 카운트 없음.

필요한 만큼 테이크를 생성하세요. 한 줄을 열 번 다시 만들어도 됩니다. 모든 감정을 시험하세요. 돌아가는 미터도, 소진될 것도 없습니다.

실제 오디오 작업은 첫 주에 비용을 회수합니다

작가, 크리에이터, 스튜디오는 Foundry로 문자당 클라우드 비용을 대체하고, 글자 제한을 버리며, 전통 스튜디오 예약보다 빠르게 출시합니다.

인디 작가, YouTuber, 게임 스튜디오가 사용 중입니다. 100% 로컬. 사용량 제한 없음.

작가와 셀프 퍼블리셔

작가와 셀프 퍼블리셔

$3,000+ 스튜디오 비용 대신 저녁 한 번에 장편 소설 전체를 내레이션으로 만들 수 있습니다. 어떤 줄이든 몇 초 만에 다시 녹음하세요. 원고는 내 컴퓨터를 떠나지 않아 미공개 초안이 비공개로 남습니다.

YouTuber와 콘텐츠 크리에이터

YouTuber와 콘텐츠 크리에이터

깔끔한 보이스오버, 훅, 쇼츠를 대량으로 만드세요. 대체 리딩 열 가지를 만들고, 다른 목소리로 썸네일을 A/B 테스트하고, 오후 한 번에 일주일치 영상을 준비하세요. 단어당 비용은 없습니다.

게임 스튜디오와 광고 대행사

게임 스튜디오와 광고 대행사

성우 예약 없이 NPC 대사, 대체 테이크, 다국어 광고 카피를 프로토타입하세요. 톤과 감정을 라인이 맞을 때까지 조정한 뒤 로컬로 내보냅니다.

무료 7일 체험 시작

체험 기간에는 요금이 청구되지 않습니다. 언제든 취소하세요. NVIDIA GPU가 있는 Windows PC에서 실행됩니다.

백지에서 완성된 오디오까지, 5단계면 충분합니다

스튜디오 예약도, 문자당 요금도 없습니다. 음성과 음악을 아우르는 전체 파이프라인이 사용자의 Windows PC에서 페이지당 1분 이내로 돌아갑니다.

처음 오셨나요? 시작하기 전에 설치와 첫 실행을 다룬 4분짜리 튜토리얼을 확인하세요.
1/ 5
1단계

목소리를 고르거나 새로 만들기

기본 제공되는 보이스 프리셋에서 고르거나, 본인 목소리나 참고 샘플을 클로닝하거나, 완전히 새로운 목소리를 생성할 수 있습니다. 클로닝한 목소리는 사용자 디스크에만 저장되며 서버로 전송되지 않습니다.

2/ 5
2단계

대본을 붙여넣고 화자를 배정하기

챕터 하나, 책 한 권, 영상 구성안, 대화 파일을 그대로 넣으세요. 새로 설계된 대본 편집기가 붙여넣는 즉시 문장 단위로 나눠 주기 때문에, 캐릭터마다 다른 목소리를 지정하고 내레이터 한 명이 아니라 출연진 전체를 연출할 수 있습니다.

3/ 5
3단계

문장 단위로 감정 연출하기

어떤 문단이든 차분함, 들뜸, 속삭임, 분노, 비꼼, 그 사이의 어떤 상태로든 태그할 수 있고 감정마다 5단계 강도를 지원합니다. 목소리는 같은 캐릭터 그대로, 감정만 바뀝니다.

4/ 5
4단계

50개 언어로 어떤 스타일의 음악이든 생성하기

오리지널 스코어, 앰비언트 루프, 보컬이 들어간 완성곡, 연주 배경까지. 어떤 장르든, 어떤 분위기든, 50개 언어 중 어떤 언어로도 노래할 수 있습니다. 내레이션에 음악을 입히거나 독립된 트랙을 만든 뒤 타임라인으로 바로 끌어다 놓으세요. 두 번째 도구도, 별도 구독도 필요 없습니다.

5/ 5
5단계

DSP와 보이스 이펙트로 문장을 다듬기

한 문장에만, 또는 트랙 전체에 스튜디오급 이펙트를 걸 수 있습니다. 클릭 한 번으로 내레이터를 외계인, 악마, 옛날 라디오 방송 목소리로 바꾸고, 리버브, EQ, 오토튠, 포먼트 시프팅, 글리치까지 모두 비파괴 방식으로 더하세요. 완전한 DSP 랙이 내장되어 있어 플러그인도, 외부 DAW도 필요 없습니다.

필요한 것

Foundry는 NVIDIA GPU가 장착된 Windows에서 실행됩니다. 간단한 개요입니다.

운영 체제

Windows 10 또는 11, 64비트
Windows 워크스테이션에 최적화
SSD/NVMe 디스크 권장

그래픽 카드

6 GB+ VRAM의 NVIDIA GPU
모든 RTX 시리즈, GTX 1080 포함, 12 GB+ 권장

VRAM 단계

6–8 GB: 성능 저하
16 GB+: + 다국어 Creative AI
24 GB+: + 뛰어난 Creative AI
32 GB+: + 극한 성능

알아두면 좋아요

설치 파일: ~70 MB
첫 실행 모델 팩: ~20–25 GB
추후 더 많은 모델 팩 제공

자주 묻는 질문

Demodokos Foundry는 오프라인으로 작동하나요?

네. 모든 AI 생성, 음성 클로닝, 오디오 처리는 GPU에서 로컬로 실행됩니다. 프롬프트, 스크립트, 음성 샘플, 생성된 오디오는 클라우드 서비스에 업로드되지 않습니다. 다만 로그인과 라이선스 확인에는 인터넷 연결이 필요합니다. Foundry가 인증 서버에 장시간 연결하지 못하면 로그아웃될 수 있습니다.

Demodokos Foundry가 내 오디오 파일을 클라우드에 업로드하나요?

아니요. 오디오 파일, 음성 샘플, 프롬프트, 스크립트, 프로젝트 데이터, 생성 콘텐츠는 컴퓨터에 그대로 남습니다. Foundry는 생성이나 처리를 위해 창작 콘텐츠를 클라우드 AI 서비스에 업로드하지 않습니다.

Demodokos Foundry를 실행하려면 어떤 GPU가 필요한가요?

VRAM 4 GB 이상의 NVIDIA GPU에서는 일부 Speech 모델을 낮은 품질로 실행할 수 있습니다. 6 GB가 더 실용적인 시작점이며, Music과 Speech의 전반적인 품질과 성능을 높이려면 12 GB 이상을 권장합니다. VRAM 8 GB 이상의 AMD GPU도 Vulkan을 통해 Music과 Speech를 실행할 수 있지만 AMD 지원은 여전히 실험적입니다. NVIDIA/CUDA를 권장합니다.

AMD GPU가 있는데 작동하나요?

네. VRAM 8 GB 이상의 AMD GPU는 Vulkan을 통해 Music과 Speech를 실행할 수 있습니다. AMD 지원은 여전히 실험적이며, 가장 성숙한 Foundry 환경을 제공하는 NVIDIA/CUDA보다 일관성이 떨어질 수 있습니다.

Demodokos Foundry는 macOS나 Linux에서 작동하나요?

Foundry는 현재 64비트 Windows 10 및 Windows 11에서 사용할 수 있습니다. macOS와 Linux용 네이티브 버전은 아직 제공되지 않습니다.

Demodokos Foundry 가격은 얼마인가요?

Creator 플랜은 월 $15.00이고 Professional 플랜은 월 $49.00입니다. 할인된 연간 결제도 제공됩니다. 두 플랜 모두 생성별 크레딧 없이 로컬 AI 음악 및 음성 생성을 무제한으로 제공하며, 프로젝트 크기와 길이 및 고급 기능에는 플랜별 제한이 적용됩니다. 무료 7일 체험이 포함됩니다.

무료 체험이 있나요?

네. Demodokos Foundry는 선택한 라이선스의 모든 기능을 사용할 수 있는 7일 무료 체험을 제공합니다. PayPal의 $0 승인으로 시작되며, 체험 종료 후 구독을 유지하지 않으면 요금이 청구되지 않습니다. 체험이 끝나기 전 언제든 취소할 수 있습니다.

구독은 언제든 취소할 수 있나요?

네. Billing > Cancel에서 언제든 취소할 수 있습니다. 취소하면 다음 갱신이 중단되고 현재 결제 기간이 끝날 때 적용됩니다. 월간 플랜은 현재 월 말, 연간 플랜은 현재 연간 기간 말에 종료됩니다. 그때까지는 모든 기능을 계속 사용할 수 있습니다. 이미 결제한 금액은 환불되지 않으며 취소 수수료는 없습니다. 무료 체험 중에는 언제든 비용 없이 취소할 수 있습니다.

Demodokos Foundry로 내 목소리를 클론할 수 있나요?

네. 본인의 목소리 또는 사용 권한이 있는 다른 목소리의 짧은 녹음을 가져오면 Foundry가 컴퓨터에서 로컬로 음성 클론을 생성합니다. 클론 음성은 40가지가 넘는 감정과 말하기 스타일을 각각 5단계 강도로 사용할 수 있으며, 문자 수나 생성 횟수에 따른 요금은 없습니다.

Demodokos Foundry는 어떤 언어를 지원하나요?

Demodokos Foundry는 50개 언어의 음악 생성과 가사 작성, 10개 언어의 말하기 및 음성 생성을 지원합니다. Creative AI 에이전트와의 대화는 영어에 최적화되어 있습니다. VRAM이 더 큰 시스템에서 사용할 수 있는 상위 Creative AI 모델은 추가 언어를 이해하며 다국어 가사 작성, 텍스트 분석, 내레이션 지원에서 더 뛰어난 성능을 제공합니다.

Demodokos Foundry는 오픈소스와 독점 AI 모델 중 무엇을 사용하나요?

Demodokos Foundry는 오픈소스 기반에서 개발한 독점 AI 시스템과 적응형 모델을 사용합니다. Demodokos는 이러한 기반을 광범위하게 수정하고 확장하며 추가로 적응시킨 뒤 독자적인 음악, 음성, 오디오 제작 아키텍처에 통합합니다.

Music v4 엔진은 수정된 ACE-Step 1.5 기반을 사용하며 스펙트럴 플럭스 기반 안정화를 생성 과정에 직접 통합합니다. Speech v4는 추가 적응과 광범위한 아키텍처 변경으로 Qwen3-TTS를 발전시켰고, Creative AI는 맞춤형 에이전틱 파이프라인 안에서 제약된 Qwen3 언어 모델을 사용합니다. Demodokos는 Meta의 AudioSeal 기술도 Tonotope로 재설계했습니다. Tonotope는 생성 오디오에 직접 삽입되면서 들리지 않는 경량 AI 출처 표시 시스템입니다.

모든 AI 추론은 GGML과 ONNX를 기반으로 구축한 맞춤형 C++ 추론 스택을 통해 로컬에서 실행됩니다.

Demodokos Foundry는 오픈소스 AI 모델을 단순히 감싼 제품인가요?

아니요. 일반적인 래퍼는 기존 모델 위에 새 인터페이스를 얹고 기반 기술과 작업 흐름은 거의 그대로 둡니다. Foundry는 훨씬 더 나아갑니다.

Demodokos는 모델 자체를 수정하고 확장한 뒤 생성, 음성 일관성, 오케스트레이션, 오디오 처리를 위한 독점 시스템을 그 주위에 구축합니다. Music v4와 Speech v4의 변경 사항은 음악적 안정성, 화자 정체성, 표현력, 장문 콘텐츠의 일관성에 직접 영향을 줍니다.

차이는 리치 문서형 Speech Editor에서 특히 분명합니다. 익숙한 문서 작성 경험과 음성 제작 전용 도구를 결합해 시각적 화자 및 연기 큐, 배경 음악과 사운드 삽입, 겹치는 대화, 자연스러운 크로스토크, 샘플 단위의 정확한 타이밍, 시각적으로 조절 가능한 DSP 효과를 제공합니다. 각 문장은 문맥을 유지한 채 듣기, 편집, 재생성할 수 있으며 속도, 피치, 볼륨, 전달 방식을 개별적으로 제어할 수 있습니다.

Foundry의 에이전틱 파이프라인은 책 전체를 처리해 장으로 나누고, 내용을 요약·분석하고, 이미지와 OCR 텍스트를 검토하고, 화자를 식별하고, AI가 만든 캐릭터 설명에서 목소리를 생성해 내레이션을 준비할 수 있습니다. 별도의 내레이션 파이프라인은 텍스트를 조정하고 적절한 화자를 선택하며 문장별로 어울리는 감정을 지정할 수 있습니다.

이후 같은 프로젝트에서 음악 생성, 스템 분리, 구간 복구, 타임라인 편집, 믹싱, 최종 내보내기까지 이어갈 수 있습니다. Foundry는 타사 모델의 프런트엔드가 아니라 장문 텍스트를 문서에서 완성된 사운드로 바꾸는 통합형 로컬 오디오 제작 환경입니다.

Demodokos Foundry는 ElevenLabs와 어떻게 다른가요?

ElevenLabs는 월별 사용 크레딧을 기반으로 하는 클라우드 플랫폼입니다. Demodokos Foundry는 Windows에서 실행되는 로컬 오디오 제작 환경으로, 생성 작업은 사용자의 GPU에서 실행되고 스크립트, 목소리, 오디오는 컴퓨터에 남으며 결과물이 문자 수나 생성별 크레딧으로 측정되지 않습니다.

Foundry는 개별 생성이 아니라 완성된 제작물을 위해 설계되었습니다. 리치 문서형 Speech Editor에서는 익숙한 문서 인터페이스로 글을 쓰고, 화자를 지정하고, 문장별 감정과 전달 방식을 지시하고, 음악과 사운드를 삽입하고, 겹치는 대화와 크로스토크를 만들고, 문맥 안에서 원하는 문장을 다시 생성하며, 문서를 벗어나지 않고 속도, 피치, 볼륨, 타이밍, DSP를 조절할 수 있습니다. 에이전틱 워크플로는 장 분할, 텍스트와 이미지 분석, 화자 식별, 음성 설계, 내레이션 연출을 통해 책 전체를 준비할 수 있습니다.

음악 생성, 스템 분리, 구간 복구, 타임라인 믹싱, 자동화도 같은 데스크톱 애플리케이션에 통합되어 있습니다. 핵심 차이는 사용량을 크레딧으로 측정하는 클라우드 서비스가 아니라 비공개 통합형 로컬 스튜디오라는 점입니다.

Demodokos Foundry는 기업용으로 안전하고 GDPR을 준수하나요?

네. Demodokos Foundry는 GDPR 준수 워크플로를 지원하도록 설계되었습니다. 모든 AI 생성, 음성 클로닝, 오디오 처리가 자체 하드웨어에서 실행되므로 비즈니스 콘텐츠, 고객 오디오, 독점 음성 녹음, 내부 스크립트, 기밀 내레이션은 클라우드 AI 공급자에게 전송되지 않고 사용자의 환경에 남습니다. 어떤 클라우드 AI 공급자도 창작 콘텐츠를 받거나 보관하지 않습니다. 조직은 생성 과정의 데이터를 직접 통제하고 데이터 주권을 유지할 수 있으므로 Foundry는 기업, 법무팀, 의료 분야, 미디어 에이전시 및 기타 개인정보 보호가 중요한 업무에 특히 적합합니다.

Demodokos Foundry는 EU AI Act를 준수하나요?

네. Demodokos Foundry는 EU AI Act의 적용 가능한 투명성 요건을 충족하도록 설계되었습니다. 생성 오디오는 메타데이터에 AI 생성으로 표시되며 Demodokos의 견고하고 들리지 않는 AI 출처 워터마크인 Tonotope가 적용됩니다.