Transcripción de WhisperX
WhisperX es la ruta de transcripción local recomendada y apta para principiantes.
Configuración
Section titled “Configuración”Ejecuta estos comandos desde la raíz del repositorio de TomoriBot, la carpeta donde clonaste TomoriBot. El primer comando entra a la carpeta del servidor de voz a texto:
Windows PowerShell
Section titled “Windows PowerShell”cd servers/sttpython -m venv .venv.\.venv\Scripts\Activate.ps1python -m pip install --upgrade pippip install -r requirements.txtpython whisperx_server.pyLinux/macOS Bash
Section titled “Linux/macOS Bash”cd servers/sttpython3 -m venv .venvsource .venv/bin/activatepython -m pip install --upgrade pippython -m pip install -r requirements.txtpython whisperx_server.pyMantén esa terminal abierta mientras TomoriBot esté usando WhisperX. La URL del punto de conexión predeterminado es http://127.0.0.1:8021.
Registro en TomoriBot
Section titled “Registro en TomoriBot”Ejecuta /providers, elige Agregar nuevo punto de conexión personalizado y usa la compatibilidad de API de transcripción:
- Compatibilidad de API:
openai-compatible-transcription endpoint_url:http://127.0.0.1:8021
Después de guardar la conexión, selecciónala y usa su menú desplegable de modelos para agregar large-v3, o a lo que sea que esté configurado WHISPERX_MODEL, como un modelo de Transcripción.
Usa /providers para el registro del endpoint y la configuración del modelo. Luego abre /config > Modelos > Cambiar modelos para seleccionar y activar el endpoint registrado.
Uso de transcripciones
Section titled “Uso de transcripciones”Después del registro, TomoriBot transcribe los archivos adjuntos de audio en segundo plano y agrega el texto al contexto del chat. Usa /config > Motor > Avisos solo si también quieres que las transcripciones se publiquen visiblemente en el chat.