ESTA DOCUMENTAÇÃO ESTÁ EM DESENVOLVIMENTO E CONSTANTE ATUALIZAÇÃO.

Agente Echo — Voz & Suporte

Especificação técnica do agente de processamento de áudio, síntese de voz e assistente interativo por canal de voz.

Identidade e Configurações Padrão

  • Cor de Acento Visual: Purple (#A855F7)
  • Mecanismos Acoplados: DevCod Voice Synthesizer / DevCod Audio Transcriber (Audio TTS / STT) e DevCod AI Core 2.0 Flash.
  • Interface de Frontend: Assistente integrado via VoiceOrbOverlay.tsx e dock de voz.

Capacidades e Funcionalidades de Voz

1. Síntese de Resposta em Áudio (TTS)

O Echo processa as saídas textuais das decisões dos agentes e renderiza arquivos de áudio naturais. Ele envia o payload limpo pelo filtro Regex cleanTextForTTS para o endpoint /api/voice/speak-stream do gateway.

2. Transcrição e Reconhecimento de Voz (STT)

Ao capturar o stream de microfone do lead pela interface Web Audio do navegador, o Echo faz chamadas em streaming ao DevCod Audio Transcriber para transcrição rápida em texto (Speech-to-Text), que é repassada ao orquestrador cognitivo em menos de 400ms.

3. Cache Criptográfico de Áudios

Para evitar custos excessivos com a API do DevCod Voice Synthesizer, o Echo consulta a pasta local public/voice-cache/ filtrando pelo hash SHA-256 do texto solicitado antes de iniciar uma chamada de síntese externa.

Próximo: Agente Prime — Orquestrador Swarm →