Skip to main content

flujo de voz

Descripción general

VoiceFlux convierte una respuesta de texto persistente de un empleado de IA en audio sintetizado contextual para WhatsApp, Baileys, Telegram, Messenger e Instagram. El texto original sigue siendo la respuesta de recuperación siempre que la síntesis, la asignación, el almacenamiento o la entrega no se puedan completar de forma segura. VoiceFlux requiere un plan Pro o superior, un complemento VoiceFlux activo, activación de organización, activación de empleado de IA y activación de conversación. El uso se mide en segundos de audio generado. La implementación sigue la arquitectura validada y la evidencia desde docs/voiceflux/01-current-audio-pipeline-audit.md hasta docs/voiceflux/12-orchestrator-implementation-prompt.md.

Controles de activación

Los tres controles deben estar habilitados: El control de conversación no está disponible cuando la IA está deshabilitada, el empleado de IA asignado tiene las respuestas de voz deshabilitadas, el canal no es compatible o el derecho comercial está inactivo.

Perfiles de voz

Abra la configuración de un empleado de AI para configurar su perfil VoiceFlux:
  • voz y localidad
  • tono e intensidad emocional
  • ritmo y formalidad
Un perfil de empleado de IA tiene prioridad sobre el perfil predeterminado de la organización. Sin ninguno de los perfiles, VoiceFlux utiliza sus valores predeterminados de estilo integrados y seguros. Los administradores de facturación de la organización pueden elegir el perfil predeterminado, si se conserva el audio generado y un período de retención de 1 a 30 días. El audio caducado se elimina automáticamente.

Referencia de punto final

Cargas útiles

Actualizar la configuración de la organización:
Cree un perfil de empleado de IA:
La asignación incluida está controlada por el ciclo de vida de la suscripción y no se puede aumentar a través de la API de configuración.

Ejemplos

Modelo y Política de Confiabilidad

gemini-3.1-flash-tts-preview es el único modelo estable, operativo y comercial de VoiceFlux. Un trabajo puede llamarlo como máximo dos veces. Solo después de que ambas llamadas fallen, el backend podrá realizar una llamada de recuperación final a gemini-2.5-flash-tts. No hay ningún selector de modelo en la interfaz de usuario, la configuración del inquilino ni las variables de entorno, y el precio del modelo de recuperación no se utiliza como base comercial.

Mejores prácticas

  • Habilite VoiceFlux primero a nivel de organización, luego para el empleado de IA y luego para cada conversación prevista.
  • Mantenga los perfiles concisos y utilice opciones de estilo estructuradas en lugar de incorporar instrucciones de entrega en texto de IA.
  • Revise los segundos de audio restantes en Facturación y diagnósticos de trabajos recientes en Registros de conversación.
  • Utilizar el período de retención más corto compatible con los requisitos operativos.

Solución de problemas