WavTokenizer for Farmlingua TTS Pipeline — High-quality neural audio tokenizer (codec) used in the Farmlingua Voice System for African farmers.
Fuente del modelo
Descripción de la fuente
WavTokenizer for Farmlingua TTS Pipeline — High-quality neural audio tokenizer (codec) used in the Farmlingua Voice System for African farmers.
This repository contains the WavTokenizer checkpoint + config used as the audio tokenizer in the Farmlingua multilingual TTS system (text-to-text + text-to-speech for farmers).
Fuentes
1 fuenteVerificado 2 ago
Artefactos del modelo
1 artefactowavtokenizer_large_speech_320_24k.ckpt
ckpt · 1,63 GB · SHA-256 7450020c154f…cc5a · Hugging Face
DescargarExtractos de fuentes
2 extractospip install torch torchaudio
git clone https://github.com/jishengpeng/WavTokenizer.git
cd WavTokenizer
pip install -e .
--- license: apache-2.0 base_model: novateur/WavTokenizer-large-320-24k-4096 tags: - text-to-speech - tts - audio-codec - wavtokenizer - speech-to-text - asr - conversational - agriculture - farmers - african-languages - low-resource - farmlingua pipeline_tag: audio-to-audio --- # TTS_FARMLINGUA-models **WavTokenizer for Farmlingua TTS Pipeline** — High-quality neural audio tokenizer (codec) used in the Farmlingua Voice System for African farmers. This repository contains the **WavTokenizer** checkpoint + config used as the audio tokenizer in the Farmlingua multilingual TTS system (text-to-text + text-to-speech for farmers). ## Model Details - **Base Model**: [novateur/WavTokenizer-large-320-24k-4096](https://huggingface.co/novateur/WavTokenizer-large-320-24k-4096) - **Architecture**: WavTokenizer (Vocos backbone + single quantizer) - **Sampling Rate**: 24kHz - **Tokens per second**: 75 - **Use Case**: Audio tokenization for TTS in low-resource African languages (Hausa, Yoruba, etc.) ## How to Use (Direct Loading) ### 1. Install dependencies ```bash pip install torch torchaudio git clone https://github.com/jishengpeng/WavTokenizer.git cd WavTokenizer pip install -e .
Source context: 0 downloads · 0 likes · Pipeline audio-to-audio · Repo Remostartdev/TTS_FARMLINGUA-models