De voz a texto (Motores locales)
TomoriBot trata la conversión de voz a texto como la capacidad del endpoint personalizado transcription. Los archivos adjuntos de audio se transcriben en segundo plano y se añaden al contexto de la conversación cuando existe un endpoint de transcripción activo.
La publicación visible de transcripciones es independiente. /config > Motor > Avisos solo controla si las transcripciones de mensajes de voz se publican en el chat; no activa ni desactiva la conversión de voz a texto en segundo plano.
Motores disponibles
Flujo de configuración
- Inicia un servidor de voz a texto desde las guías de motores anteriores.
- En
/providers, elige Agregar nuevo punto de conexión personalizado y usa la compatibilidad de APIopenai-compatible-transcription. - Selecciona el endpoint guardado y usa su menú desplegable de modelos para agregar el código del modelo reportado por el servidor.
- Abre
/config> Modelos > Cambiar modelos para seleccionar y activar el endpoint registrado.
Flujo de transcripciones
Cuando un endpoint de transcripción está activo, TomoriBot lee los archivos adjuntos de audio compatibles en segundo plano y agrega la transcripción al contexto del chat. No se necesita asignar ninguna persona.
Usa /config > Motor > Avisos solo si también quieres que esas transcripciones se publiquen visiblemente en el chat.
Los usuarios de ElevenLabs deben elegir Agregar nuevo proveedor y ElevenLabs en /providers; esto registra la transcripción junto con la voz.