Skip to main content
#VoiceFlux

Visão geral

VoiceFlux converte uma resposta de texto persistente de um funcionário de IA em áudio contextual sintetizado para WhatsApp, Baileys, Telegram, Messenger e Instagram. O texto original continua sendo a resposta de recuperação sempre que a síntese, a concessão, o armazenamento ou a entrega não puderem ser concluídos com segurança. VoiceFlux requer um plano Pro ou superior, um complemento VoiceFlux ativo, ativação de organização, ativação de funcionário de IA e ativação de conversa. O uso é medido em segundos de áudio gerados. A implementação segue a arquitetura validada e as evidências em docs/voiceflux/01-current-audio-pipeline-audit.md até docs/voiceflux/12-orchestrator-implementation-prompt.md.

Controles de ativação

Todos os três controles devem estar habilitados: O controle de conversação não está disponível quando a IA está desativada, o funcionário da IA ​​atribuído tem respostas de voz desativadas, o canal não é compatível ou o direito comercial está inativo.

Perfis de voz

Abra as configurações de um funcionário AI para configurar seu perfil VoiceFlux:
  • voz e localidade
  • tom e intensidade emocional
  • ritmo e formalidade
Um perfil de Funcionário AI tem precedência sobre o perfil padrão da organização. Sem nenhum dos perfis, o VoiceFlux usa seus padrões de estilo integrados seguros. Os administradores de faturamento da organização podem escolher o perfil padrão, se o áudio gerado será retido e um período de retenção de 1 a 30 dias. O áudio expirado é removido automaticamente.

Referência de terminal

Cargas úteis

Atualize as configurações da organização:
Crie um perfil de funcionário AI:
A franquia incluída é controlada pelo ciclo de vida da assinatura e não pode ser aumentada por meio da API de configurações.

Exemplos

Modelo e Política de Confiabilidade

gemini-3.1-flash-tts-preview é o único modelo VoiceFlux operacional e comercial estável. Um trabalho pode chamá-lo no máximo duas vezes. Somente após a falha de ambas as chamadas o back-end poderá fazer uma chamada de recuperação final para gemini-2.5-flash-tts. Não há seletor de modelo na interface do usuário, nas configurações do locatário ou nas variáveis ​​de ambiente, e o preço do modelo de recuperação não é usado como linha de base comercial.

Melhores práticas

  • Habilite o VoiceFlux primeiro no nível da organização, depois para o funcionário de IA e depois para cada conversa pretendida.
  • Mantenha os perfis concisos e use opções de estilo estruturado em vez de incorporar instruções de entrega em texto de IA.
  • Revise os segundos de áudio restantes no faturamento e diagnósticos de trabalhos recentes nos registros de conversas.
  • Utilize o menor período de retenção compatível com os requisitos operacionais.

Solução de problemas