日本語 AI
音声ジェネレーター

ナレーション、会話、ボイスオーバー。
すべてローカル。すべて無制限。

自分のGPUで36以上の感情豊かな音声スタイルを生成。クラウドなし。クレジットなし。他者があなたの音声に触れることはありません。声をクローンし、10言語を切り替え、必要なだけ制作できます。

PC上でローカル 36+ 感情 音声クローン クレジットも上限もなし

Windows Defender 検証済み デフォルトでプライベート 無制限生成

Foundry が動く音

Demodokos Foundry の実際の様子です。複数言語のリアルな音声、音楽背景、スタジオ音声エフェクトを、すべて1台のマシン上でローカル生成します。スピーカーを押すと音声を有効にできます。

ローカルが強い理由

クラウド音声ツールには同じ3つの問題があります。これはそのどれもありません。

ファイルはPCから出ません

スクリプト、音声クローン、音声データ。すべてハードドライブに残ります。アップロードなし。他社があなたの作品を保存することも、学習に使うこともありません。

ローカルだから速い

あなたのGPUが音声をレンダリングします。短いクリップは数秒です。サーバー待ちも、他ユーザーとのキュー共有もありません。

クレジットなし。数える必要なし。

必要なだけテイクを生成できます。同じ行を10回やり直せます。あらゆる感情を試せます。メーターは回らず、使い切るものもありません。

本格的な音声制作は最初の週で元が取れる

作家、クリエイター、スタジオは Foundry で文字課金のクラウド費用を置き換え、文字数制限を捨て、従来スタジオの予約より速く公開しています。

インディー作家、YouTuber、ゲームスタジオが利用。100% ローカル。使用量上限なし。

作家とセルフパブリッシャー

作家とセルフパブリッシャー

3,000ドル以上のスタジオ費用を払う代わりに、一晩で小説まるごとをナレーション化。任意の行を数秒で再録。原稿はマシンから出ないため、未公開ドラフトは非公開のままです。

YouTuber とコンテンツクリエイター

YouTuber とコンテンツクリエイター

クリーンなボイスオーバー、フック、Shorts を量産。10種類の別読みを生成し、異なる声でサムネイルをA/Bテストし、午後だけで一週間分の動画を準備できます。単語課金なし。

ゲームスタジオと広告代理店

ゲームスタジオと広告代理店

声優の予約なしでNPC台詞、別テイク、多言語広告コピーを試作。トーンと感情を納得いくまで調整し、最終音声をローカルで書き出せます。

7日間無料トライアルを開始

トライアル中の請求はありません。いつでもキャンセル可能。NVIDIA GPU 搭載 Windows PC で動作します。

白紙から完成音源まで、5つのシンプルなステップ

スタジオの予約も、文字単位の課金もありません。音声と音楽のパイプライン全体が、あなたの Windows マシン上で1ページあたり1分未満で動きます。

はじめての方へ 始める前に、インストールと初回起動を解説した4分間のチュートリアルをご覧ください。
1/ 5
ステップ 1

声を選ぶ、または作る

内蔵のボイスプリセットから選ぶことも、自分の声や参考音源をクローンすることも、まったく新しい声を生成することもできます。クローンした声はディスク上に保存され、サーバーに送られることはありません。

2/ 5
ステップ 2

台本を貼り付け、話者を割り当てる

章、書籍まるごと、動画の構成、会話ファイルをそのまま貼り付けてください。刷新されたスクリプトエディタが貼り付けた瞬間に行単位で分割するので、キャラクターごとに声を割り当て、ナレーター1人ではなくキャスト全体を演出できます。

3/ 5
ステップ 3

行ごとに感情を演出する

任意の段落に、落ち着き、興奮、ささやき、怒り、皮肉、そしてその中間まで、感情ごとに5段階の強度でタグ付けできます。声は同じキャラクターのまま、感情だけが変わります。

4/ 5
ステップ 4

あらゆるスタイルの音楽を50言語で生成

オリジナルスコア、アンビエントループ、ボーカル入りのフル楽曲、インストの下地。どんなジャンルでも、どんなムードでも、50言語のいずれかで歌わせられます。ナレーションに音楽を付けても、単独の楽曲を書いてもよく、そのままタイムラインにドラッグできます。2つ目のツールも、別のサブスクリプションも不要です。

5/ 5
ステップ 5

DSPとボイスエフェクトで一行ずつ作り込む

1行だけ、あるいはトラック全体にスタジオ品質のエフェクトをかけられます。ワンクリックでナレーターをエイリアンや悪魔、古いラジオ放送の声に変え、さらにリバーブ、EQ、オートチューン、フォルマントシフト、グリッチを重ねられます。すべて非破壊です。完全なDSPラックが内蔵されており、プラグインも外部DAWも必要ありません。

必要なもの

Foundry は NVIDIA GPU 搭載の Windows で動作します。簡単な概要です。

オペレーティングシステム

Windows 10 または 11、64ビット
Windows ワークステーションに最適化
SSD/NVMe 推奨

グラフィックスカード

6 GB以上 VRAM の NVIDIA GPU
RTX シリーズ、GTX 1080 含む、12 GB以上推奨

VRAM 段階

6–8 GB:性能低下
16 GB+:+ 多言語 Creative AI
24 GB+:+ 卓越した Creative AI
32 GB+:+ 究極の性能

知っておくと便利

セットアップ:約 70 MB
初回モデルパック:約 20–25 GB
追加モデルパックは後日提供

よくある質問

Demodokos Foundry はオフラインで動作しますか?

はい。AI生成、音声クローン、音声処理はすべてGPU上でローカルに実行されます。プロンプト、台本、音声サンプル、生成音声がクラウドサービスへアップロードされることはありません。ただし、ログインとライセンス確認にはインターネット接続が必要です。認証サーバーへ長時間接続できない場合、Foundryからサインアウトされることがあります。

Demodokos Foundry は音声ファイルをクラウドにアップロードしますか?

いいえ。音声ファイル、音声サンプル、プロンプト、台本、プロジェクトデータ、生成コンテンツはコンピューター上に残ります。Foundryが生成や処理のために制作コンテンツをクラウドAIサービスへアップロードすることはありません。

Demodokos Foundry を動かすにはどのGPUが必要ですか?

4 GB以上のVRAMを搭載したNVIDIA GPUでは、一部のSpeechモデルを品質を落として実行できます。実用的な開始点は6 GBで、MusicとSpeechの総合的な品質と性能を最大限に引き出すには12 GB以上を推奨します。8 GB以上のVRAMを搭載したAMD GPUでもVulkan経由でMusicとSpeechを実行できますが、AMD対応は引き続き実験的です。NVIDIA/CUDAを推奨します。

AMD GPUを持っていますが、動作しますか?

はい。8 GB以上のVRAMを搭載したAMD GPUでは、Vulkan経由でMusicとSpeechを実行できます。AMD対応は引き続き実験的で、最も成熟したFoundry環境を提供するNVIDIA/CUDAより動作が安定しない場合があります。

Demodokos Foundry はmacOSやLinuxで動作しますか?

Foundryは現在、64ビット版のWindows 10およびWindows 11に対応しています。macOS版とLinux版は現時点では提供していません。

Demodokos Foundry の料金はいくらですか?

Creatorプランは月額$15.00、Professionalプランは月額$49.00です。割引された年間払いも利用できます。どちらのプランにも、生成ごとのクレジットを使わないローカルでのAI音楽・音声生成が無制限に含まれます。プロジェクトの規模、長さ、高度な機能にはプランごとの上限があります。無料の7日間トライアルが含まれます。

無料トライアルはありますか?

はい。Demodokos Foundryには、選択したライセンスの全機能を利用できる7日間の無料トライアルがあります。PayPalの0ドル認証で開始され、トライアル終了後もサブスクリプションを継続しない限り請求されません。期限前ならいつでもキャンセルできます。

サブスクリプションはいつでもキャンセルできますか?

はい。請求 > キャンセルからいつでも手続きできます。キャンセルすると次回の更新が停止し、現在の請求期間の終了時 - 月額プランでは当月末、年額プランでは当年の契約期間末 - に有効になります。それまではすべての機能を利用できます。支払い済みの料金は返金されませんが、キャンセル料はありません。無料トライアル中はいつでも無料でキャンセルできます。

Demodokos Foundry で自分の声をクローンできますか?

はい。自分の声、または使用許可を得ている別の声の短い録音を読み込むと、Foundryが音声クローンをコンピューター上でローカルに作成します。クローン音声では40種類を超える感情や話し方をそれぞれ5段階の強度で利用でき、文字数や生成回数による追加料金はありません。

Demodokos Foundry はどの言語に対応していますか?

Demodokos Foundryは、50言語での音楽生成と歌詞制作、10言語での発話・音声生成に対応しています。Creative AIエージェントとの会話は英語向けに最適化されています。VRAM容量の大きいシステムで利用できる上位のCreative AIモデルは、さらに多くの言語を理解し、多言語の歌詞作成、テキスト分析、ナレーション支援でより高い性能を発揮します。

Demodokos Foundry はオープンソースと独自開発のどちらのAIモデルを使用していますか?

Demodokos Foundryは、オープンソースの基盤から開発した独自AIシステムと適応済みモデルを使用しています。Demodokosはこれらの基盤を大幅に変更、拡張、追加適応したうえで、独自の音楽・音声・オーディオ制作アーキテクチャへ統合しています。

Music v4エンジンは変更を加えたACE-Step 1.5を基盤とし、スペクトルフラックスによる安定化を生成処理へ直接組み込んでいます。Speech v4は追加適応と大規模なアーキテクチャ変更によってQwen3-TTSを発展させ、Creative AIは制約付きQwen3言語モデルを独自のエージェント型パイプライン内で使用します。また、DemodokosはMetaのAudioSeal技術をTonotopeへ再設計しました。Tonotopeは、生成音声へ直接埋め込まれながら聴感上は聞こえない、軽量なAI由来マーキングシステムです。

すべてのAI推論は、GGMLとONNXを基盤とする独自のC++推論スタックを通じてローカルで実行されます。

Demodokos Foundry はオープンソースAIモデルの単なるラッパーですか?

いいえ。一般的なラッパーは既存モデルに新しい画面を追加するだけで、基盤技術やワークフローはほとんど変えません。Foundryはそれを大きく超えています。

Demodokosはモデル自体を変更・拡張し、その周囲に生成、音声一貫性、オーケストレーション、音声処理の独自システムを構築しています。Music v4とSpeech v4には、音楽の安定性、話者の同一性、表現力、長時間コンテンツの一貫性に直接影響する変更が含まれます。

違いが特に分かりやすいのが、リッチドキュメント型のSpeech Editorです。使い慣れた文書編集の感覚に、音声制作専用の機能を組み合わせています。視覚的な話者・演技キュー、背景音楽と効果音の挿入、重なる会話、自然なクロストーク、サンプル精度のタイミング、視覚的に調整できるDSPエフェクトを利用できます。各文は文脈を保ったまま試聴、編集、再生成でき、速度、ピッチ、音量、演技を個別に制御できます。

Foundryのエージェント型パイプラインは、書籍全体を処理して章に分割し、内容を要約・分析し、画像やOCRテキストを確認し、話者を抽出し、AIが作成した人物説明から声を生成してナレーションを準備できます。別のナレーションパイプラインでは、文章を調整し、適切な話者を選び、行ごとに合う感情を指定できます。

その後、音楽生成、ステム分離、部分修復、タイムライン配置、ミキシング、最終書き出しまで同じ環境で進められます。Foundryは第三者モデルのフロントエンドではなく、長文を文書から完成音声へ変える統合型のローカル音声制作環境です。

Demodokos Foundry はElevenLabsとどう違いますか?

ElevenLabsは月ごとの使用クレジットを基準にしたクラウドプラットフォームです。Demodokos FoundryはWindows上で動作するローカル音声制作環境で、生成は自分のGPU上で実行され、台本、声、音声データは自分のマシンに残り、文字数や生成ごとのクレジットで出力が計測されません。

Foundryは単発の生成ではなく、完成した作品を作るために設計されています。リッチドキュメント型のSpeech Editorでは、使い慣れた文書画面で執筆し、話者を割り当て、行ごとに感情や演技を指示し、音楽や効果音を挿入し、会話の重なりやクロストークを作り、任意の文を文脈内で再生成し、速度、ピッチ、音量、タイミング、DSPを文書内で調整できます。エージェント型ワークフローは、章分け、文章と画像の分析、話者抽出、声の設計、ナレーション指示まで行い、書籍全体を準備できます。

音楽生成、ステム分離、部分修復、タイムラインミキシング、自動化も同じデスクトップアプリに統合されています。最大の違いは、クレジットで利用量を測るクラウドサービスではなく、プライベートで統合されたローカルスタジオであることです。

Demodokos Foundry は企業利用に安全で、GDPRに準拠していますか?

はい。Demodokos Foundryは、GDPRに準拠したワークフローを支援するよう設計されています。AI生成、音声クローン、音声処理はすべて自社または自分のハードウェア上で実行されるため、業務コンテンツ、顧客音声、独自の音声録音、内部台本、機密ナレーションはクラウドAI事業者へ送信されず、自分の環境に残ります。クラウドAI事業者が制作コンテンツを受け取ったり保持したりすることはありません。組織は生成ワークフローのデータを直接管理し、データ主権を維持できるため、企業、法務部門、医療分野、メディア制作会社など、プライバシーを重視する用途に適しています。

Demodokos Foundry はEU AI Actに準拠していますか?

はい。Demodokos Foundryは、EU AI Actで適用される透明性要件を満たすよう設計されています。生成音声はメタデータでAI生成と明示され、Demodokosの堅牢で聞こえないAI由来ウォーターマークTonotopeが付与されます。