Yerel ses üretimi, kusursuz bir akışta

Ses klonlama.
Varsayılan olarak yerel.

Uzun transkriptleri yeniden kullanılabilir sesler ve zengin tanılama araçlarıyla konuşmaya dönüştüren, tüm iş akışını bilgisayarınızda tutan terminal odaklı bir CLI.

llmvoice — illustrative local demo
Önce yerelAçık kaynakUzun içeriklere hazırCUDA hızlandırmasıGizlilik odaklıWindows CLI
Kararlı sürüm v0.1.7
Windows için hazır

İzole runtime. Tek bir güvenilir installer.

LLMVoice global Python kurulumunu kirletmeden CUDA veya CPU profilini otomatik seçer ve yalnızca kendi bin klasörünü kullanıcı PATH’ine ekler.

  1. 1FFmpeg Shared’i kurun
  2. 2LLMVoice installer’ı indirin
  3. 3Installer’ı çalıştırın
  4. 4Yeni bir terminal açın
  5. 5llmvoice doctor çalıştırın
Kurulum rehberi SHA256 doğrulamalı release
01 · FFmpeg Shared
winget install --id Gyan.FFmpeg.Shared -e
02 · Installer’ı indir ve çalıştır
irm https://llmvoice.yusufdere.com/install.ps1 -OutFile install.ps1
powershell -NoProfile -ExecutionPolicy Bypass -File .\install.ps1
03 · Kurulumu doğrula
llmvoice doctor
Installer indirilir ve ayrı bir komutla çalıştırılır. Uzak script doğrudan pipe edilmez.
Amaca özel iş akışı

Üretim döngüsünün ihtiyaç duyduğu her şey.
Fazlası değil.

LLMVoice, yerel iş akışını okunabilir, dayanıklı ve kullanımı keyifli hale getirirken arayüzü sade tutar.

Önce yerel iş akışı

Transkriptler, referans sesler ve üretilen ses dosyaları bilgisayarınızda kalır.

Referans ses klonlama

Temiz bir referans WAV dosyasından tek komutla adlandırılmış sesler ekleyin ve yeniden kullanın.

Uzun içeriklere hazır

Parçalama, duraklamalar, birleştirme ve kodlama tek bir güvenilir akışta yönetilir.

Temiz CLI deneyimi

Okunabilir çıktılar, anlamlı ilerleme bilgileri ve çözümü gösteren hatalar.

NVIDIA CUDA veya CPU

Desteklendiğinde NVIDIA CUDA hızlandırmasını, diğer sistemlerde CPU yedeğini kullanır.

Yerleşik tanılama

Doctor, dry-run ve debug modları yerel ortamı şeffaf ve incelenebilir kılar.

Açık mimari

Servis katmanı olmadan, odaklı bir Python CLI yüzeyine sahip MIT lisanslı kaynak kodu.

Güvenli çıktı yönetimi

Açık üzerine yazma davranışı, disk kontrolleri ve öngörülebilir çıktı yolları.

Yapılandırılabilir tasarım

Ses, dil, aygıt, hız, parça boyutu ve duraklama varsayılanlarını belirleyin.

Dört net adım

Referans içeri girer. Tamamlanmış ses çıkar.

01

Bir ses ekleyin

Temiz referans sesten adlandırılmış yerel bir ses oluşturun.

02

Transkripti verin

Kısa veya uzun bir metin dosyasını CLI aracına gösterin.

03

Yerel olarak üretin

XTTS-v2, CUDA veya CPU yedeği üzerinden çalışır.

04

MP3 çıktısını alın

Parçalar temiz ve oynatmaya hazır tek dosyada birleşir.

Terminal odaklı

Bir bakışta anlayabileceğiniz iş akışı.

Sistemi inceleyin, bir ses kaydedin, varsayılanı belirleyin ve üretin. Her komut tek bir iş yapar ve sonucu açıkça bildirir.

Tüm komutları inceleyin
workflow.sh ready
01$ llmvoice doctorEnvironment ready
02$ llmvoice voice add friday reference.wavVoice registered
03$ llmvoice config set default_voice fridayDefault updated
04$ llmvoice start transcript.txtGeneration started
Gizlilik mimarinin kendisidir

Sesinizin odadan çıkması gerekmez.

LLMVoice barındırılan bir hizmet değil, yerel bir CLI aracıdır. Dosyalarınız ile çıktınız arasında hesap, veri toplama hattı veya uzaktan inference katmanı yoktur.

Installer ve ilk XTTS-v2 model indirmesi ağ erişimi gerektirir. Referans sesler, transkriptler ve üretilen sesler inference için yüklenmez.

Bulut API’si yok
Telemetri yok
Transkript yükleme yok
Ses yükleme yok
Her şey yerel kalır
Lisans sınırını bilin

Açık kaynak kodu. Ayrı lisanslanan model.

LLMVoice kaynak kodu MIT lisanslıdır. XTTS-v2 model ağırlıkları Coqui Public Model License (CPML) kapsamında ayrı lisanslanır; MIT lisansı model kullanımına ticari hak sağlamaz. Uygun model haklarına sahip değilseniz LLMVoice yerel ve ticari olmayan kullanım içindir.

Lisanslama rehberini okuyun

Açık geliştirildi.
Yerel kalmak için tasarlandı.

Kaynak kodunu inceleyin, üretim hattını anlayın ve iş akışını kendinize göre uyarlayın.