Tecnologia

além
do pipeline de 3 etapas.

A maioria das plataformas de IA de voz depende de um pipeline de 3 etapas: um modelo de transcrição, um LLM que não raciocina e um mecanismo de síntese de voz. Cada etapa é um ponto único de falha. ThunderPhone reduz os erros ao orquestrar vários modelos ao mesmo tempo.

Quem liga disse “Alugo.”
ASR A“Alugo”
ASR B“Hugo”
LLM de áudio“Alugo”
Resultado consolidado: “Alugo”2 de 3 caminhos coincidem

Ouça de várias formas
e depois concilie os resultados.

ThunderPhone orquestra vários modelos ao mesmo tempo e permite que uns corrijam os erros dos outros.

Quem liga diz “Alugo.” — entre dentes
Outras plataformasPipeline de 3 etapas
Ouve uma vez
STT “Hugo”
Sem plano B quando o único modelo ouve errado
Responde rápido

Um LLM rápido vê apenas a transcrição.

Fala

“Olá, Hugo — como posso ajudar?”

1 transcrição + 1 LLM = resposta errada
ThunderPhoneOrquestrado
Ouve de três formas
“Alugo”“Hugo”“Alugo”
Três transcrições + áudio bruto preservados como evidência
Concilia

LLMs rápidos e de raciocínio fazem uma checagem cruzada: 2 de 3 caminhos concordam.

Fala

“Entendi — então você aluga.”

Acerta os detalhes mais difíceis logo de primeira.

Storm bate recordes de inteligência no Big Bench Audio.

O BBA testa se um modelo consegue entender prompts falados e responder corretamente a perguntas difíceis. Nossa configuração mais potente do Storm detém o recorde: 99,4% no nosso conjunto público de avaliação.

0.6% de taxa de erro

· Julho de 2026Conjunto de dados no Hugging Face
ThunderPhoneStorm · Extra Intelligence0.6%
Qwen Audio 3.0Realtime Plus0.8%
Qwen3.5 OmniPlus Realtime1.3%
Step-Audio R1.1Realtime2.4%

O resultado do ThunderPhone vem do nosso conjunto público de dados de avaliação, disponível no link acima; as demais pontuações públicas (do ranking da Artificial Analysis) são apresentadas como referência.

Você não deveria precisar montar um stack de voz manualmente.

Outras plataformas de IA de voz, como Vapi, Retell, Pipecat e LiveKit, obrigam você a tomar muitas decisões de configuração para fazer suas chamadas funcionarem. No ThunderPhone, acreditamos que o ajuste fino é responsabilidade nossa — e que fazer suas chamadas funcionarem com fluidez deve exigir o mínimo possível de você.

Outras plataformas de IA de vozMuitos parâmetros para ajustar
STTv4-largeFallback de STTLLMtemp 0.3Fallback de LLMTTSFallback de TTSVAD0.62Detecção do fim da fala240 msLimiar de interrupção−38 dBFiltro de sinais de escutaInterrupçõesTempo limite de turno800 msRedução de ruídoBuffer de jitter60 msTaxa de amostragem8 kHzEsquema de ferramentasPolítica de novas tentativas×3Fallbacks

ThunderPhone ajusta tudo isso para você

ThunderPhoneTrês decisões
1
Escolha um nível

Spark, Bolt ou Storm.

2
Escolha uma voz

Selecionada e testada em chamadas reais.

3
Escreva seu prompt

Comportamento, políticas e ferramentas — em linguagem natural.

Três decisões. E pronto — orquestração, fallbacks e ajustes já vêm integrados.

Escolhemos os melhores modelos para cada tarefa e os integramos. Modelos de ponta da OpenAI, Anthropic e Google trabalham em conjunto com modelos open source — tudo orquestrado para oferecer o melhor desempenho e preço em cada chamada, sem que você precise se preocupar com isso.

Um único prompt,
não um grafo de nós.

Os construtores de fluxo existem porque sistemas menos avançados não conseguem seguir prompts complexos. Cada etapa da conversa vira um nó que você precisa criar e manter manualmente. Storm segue instruções detalhadas a partir de um único prompt, então você não precisa se preocupar com nós e arestas.

Plataformas com construtor de fluxosConecte cada ramificação à mão
Saudação prompt · voz
Coletar telefone prompt · validação
Confirmar telefone novo prompt ×2
enroll() ferramenta · novas tentativas
Transferir para um atendente
Fallback para todos os casos inválido ×2 · erro

Seis nós para um único fluxo de cadastro — cada um com seus próprios prompts, ferramentas, transições e tratamento de falhas.

ThunderPhone StormDescreva o comportamento uma só vez
Prompt de comportamento

Cumprimente quem liga e colete o nome e o telefone. Confirme o consentimento antes de fazer a inscrição — obrigatório. Se houver alguma dúvida sobre cobrança, siga a política de cobrança abaixo. Só acione enroll() depois que todos os campos forem confirmados. Se quem liga pedir para falar com uma pessoa, transfira para um atendente.

Ramificações complexasMonitores opcionaisIteração mais simples

Um único prompt para escrever, testar e ajustar — com ramificações incluídas.

Chamadas em produção são cheias de imprevistos. ThunderPhone está pronto.

Fala embolada, conversas ao fundo, nomes e números, mistura de idiomas — ThunderPhone foi desenvolvido para os cenários em que outros sistemas falham.

Fala pouco articulada

Cruze sinais de áudio e texto em vez de confiar em uma única transcrição.

Áudio ruim na chamada

Modelos de identificação e redução de ruído limpam o sinal.

Conversas ao fundo

Detecte conversas paralelas antes que tirem o agente do rumo.

Nomes e endereços

Cruze nomes próprios, grafias, números e correções.

Mistura de idiomas na fala

Faça o roteamento por fluxos multilíngues de áudio e voz quando necessário.

Prompts longos

Use linhas de raciocínio mais robustas quando o comportamento não puder ser resumido a uma única regra.

Responder errado mais rápido não melhora a chamada.

A IA de voz precisa responder rápido — mas rapidez sem precisão só significa errar mais rápido. Os LLMs atuais precisam de um instante para raciocinar e continuar confiáveis. Por isso, ThunderPhone equilibra latência e precisão.

Spark~3saté a primeira resposta
Bolt~2saté a primeira resposta
Storm~2–3s~2 s com sinais de escuta · ~3 s sem
Medição

Outros fornecedores anunciam latência de 500 ms em condições ideais, mas, em uma chamada real, normalmente ficam perto de 2 s. Medimos nossa latência em condições reais.

Resiliência

Fornecedores de IA enfrentam picos de latência que podem comprometer chamadas. O stack orquestrado do ThunderPhone alterna para opções mais rápidas quando isso acontece.

A próxima geração da IA de voz já chegou.

Chamadas automatizadas eram sinônimo de frustração… até agora. Cada avanço tecnológico melhorou a experiência, mas nunca a ponto de torná-la realmente fluida. Isso muda com o ThunderPhone.

1990sGeração 1

URA

“Tecle 1 para vendas, tecle 2 para suporte.” Menus só conseguem encaminhar chamadas.

2010sGeração 2

Bots de intenção

Diga “vendas” ou “faturamento” e torça para o analisador de slots entender.

2024Geração 3

IA em três etapas

Transcreva, consulte um único LLM rápido e fale — cada etapa confiando na anterior.

2026 · agoraGeração 4

IA integrada

Áudio, texto, raciocínio, ferramentas, vozes e controles de segurança em um único sistema.

Feito para as chamadas que derrubam todas as outras soluções

Teste nosso stack integrado nas suas chamadas mais difíceis.

No ar em dez minutos. A partir de 2¢/min.