Skip to content

De voz a texto (Motores locales)

TomoriBot trata la conversión de voz a texto como la capacidad del endpoint personalizado transcription. Los archivos adjuntos de audio se transcriben en segundo plano y se añaden al contexto de la conversación cuando existe un endpoint de transcripción activo.

La publicación visible de transcripciones es independiente. /config > Motor > Avisos solo controla si las transcripciones de mensajes de voz se publican en el chat; no activa ni desactiva la conversión de voz a texto en segundo plano.

Motores disponibles

Flujo de configuración

  1. Inicia un servidor de voz a texto desde las guías de motores anteriores.
  2. En /providers, elige Agregar nuevo punto de conexión personalizado y usa la compatibilidad de API openai-compatible-transcription.
  3. Selecciona el endpoint guardado y usa su menú desplegable de modelos para agregar el código del modelo reportado por el servidor.
  4. Abre /config > Modelos > Cambiar modelos para seleccionar y activar el endpoint registrado.

Flujo de transcripciones

Cuando un endpoint de transcripción está activo, TomoriBot lee los archivos adjuntos de audio compatibles en segundo plano y agrega la transcripción al contexto del chat. No se necesita asignar ninguna persona.

Usa /config > Motor > Avisos solo si también quieres que esas transcripciones se publiquen visiblemente en el chat.

Los usuarios de ElevenLabs deben elegir Agregar nuevo proveedor y ElevenLabs en /providers; esto registra la transcripción junto con la voz.