Dokümanlar / Hızlı Başlangıç

Hızlı Başlangıç

İlk yerel ses klonlama MP3 dosyanızı oluşturun.

Ortamı kontrol edin

Kurulumdan sonra yeni bir terminal açın:

llmvoice doctor

Doctor; installer tarafından yönetilen Python runtime’ını, FFmpeg Shared’i, PyTorch’u, seçilen CUDA veya CPU profilini ve XTTS erişimini doğrular.

Bir ses ekleyin

Temiz, tek konuşmacılı bir referans kullanın. Yaklaşık 6–30 saniye önerilir.

llmvoice voice add friday reference.wav
llmvoice voice info friday

LLMVoice kaynak dosyayı değiştirmeden doğrular ve yerel referans önbelleğini hazırlar.

Varsayılanı belirleyin

llmvoice config set default_voice friday

Konuşma üretin

UTF-8 biçiminde transcript.txt dosyası oluşturun ve çalıştırın:

llmvoice start transcript.txt

Varsayılan çıktı, transkript klasöründeki transcript.mp3 dosyasıdır.

İlk sentez XTTS-v2 model ağırlıklarını indirebilir ve CPML model koşullarını kabul etmenizi isteyebilir. Model indirildikten sonra sentez yerel ve çevrimdışı çalışabilir. Referans sesler, transkriptler ve üretilen sesler inference için yüklenmez.