flujo de voz
Descripción general
VoiceFlux convierte una respuesta de texto persistente de un empleado de IA en audio sintetizado contextual para WhatsApp, Baileys, Telegram, Messenger e Instagram. El texto original sigue siendo la respuesta de recuperación siempre que la síntesis, la asignación, el almacenamiento o la entrega no se puedan completar de forma segura. VoiceFlux requiere un plan Pro o superior, un complemento VoiceFlux activo, activación de organización, activación de empleado de IA y activación de conversación. El uso se mide en segundos de audio generado. La implementación sigue la arquitectura validada y la evidencia desdedocs/voiceflux/01-current-audio-pipeline-audit.md hasta docs/voiceflux/12-orchestrator-implementation-prompt.md.
Controles de activación
Los tres controles deben estar habilitados:
El control de conversación no está disponible cuando la IA está deshabilitada, el empleado de IA asignado tiene las respuestas de voz deshabilitadas, el canal no es compatible o el derecho comercial está inactivo.
Perfiles de voz
Abra la configuración de un empleado de AI para configurar su perfil VoiceFlux:- voz y localidad
- tono e intensidad emocional
- ritmo y formalidad
Referencia de punto final
Cargas útiles
Actualizar la configuración de la organización:Ejemplos
Modelo y Política de Confiabilidad
gemini-3.1-flash-tts-preview es el único modelo estable, operativo y comercial de VoiceFlux. Un trabajo puede llamarlo como máximo dos veces. Solo después de que ambas llamadas fallen, el backend podrá realizar una llamada de recuperación final a gemini-2.5-flash-tts. No hay ningún selector de modelo en la interfaz de usuario, la configuración del inquilino ni las variables de entorno, y el precio del modelo de recuperación no se utiliza como base comercial.
Mejores prácticas
- Habilite VoiceFlux primero a nivel de organización, luego para el empleado de IA y luego para cada conversación prevista.
- Mantenga los perfiles concisos y utilice opciones de estilo estructuradas en lugar de incorporar instrucciones de entrega en texto de IA.
- Revise los segundos de audio restantes en Facturación y diagnósticos de trabajos recientes en Registros de conversación.
- Utilizar el período de retención más corto compatible con los requisitos operativos.

