A maioria das plataformas de IA de voz depende de um pipeline de 3 etapas: um modelo de transcrição, um LLM que não raciocina e um mecanismo de síntese de voz. Cada etapa é um ponto único de falha. ThunderPhone reduz os erros ao orquestrar vários modelos ao mesmo tempo.
ThunderPhone orquestra vários modelos ao mesmo tempo e permite que uns corrijam os erros dos outros.
Um LLM rápido vê apenas a transcrição.
“Olá, Hugo — como posso ajudar?”
LLMs rápidos e de raciocínio fazem uma checagem cruzada: 2 de 3 caminhos concordam.
“Entendi — então você aluga.”
O BBA testa se um modelo consegue entender prompts falados e responder corretamente a perguntas difíceis. Nossa configuração mais potente do Storm detém o recorde: 99,4% no nosso conjunto público de avaliação.
0.6% de taxa de erro
O resultado do ThunderPhone vem do nosso conjunto público de dados de avaliação, disponível no link acima; as demais pontuações públicas (do ranking da Artificial Analysis) são apresentadas como referência.
Outras plataformas de IA de voz, como Vapi, Retell, Pipecat e LiveKit, obrigam você a tomar muitas decisões de configuração para fazer suas chamadas funcionarem. No ThunderPhone, acreditamos que o ajuste fino é responsabilidade nossa — e que fazer suas chamadas funcionarem com fluidez deve exigir o mínimo possível de você.
ThunderPhone ajusta tudo isso para você
Spark, Bolt ou Storm.
Selecionada e testada em chamadas reais.
Comportamento, políticas e ferramentas — em linguagem natural.
Três decisões. E pronto — orquestração, fallbacks e ajustes já vêm integrados.
Escolhemos os melhores modelos para cada tarefa e os integramos. Modelos de ponta da OpenAI, Anthropic e Google trabalham em conjunto com modelos open source — tudo orquestrado para oferecer o melhor desempenho e preço em cada chamada, sem que você precise se preocupar com isso.
Os construtores de fluxo existem porque sistemas menos avançados não conseguem seguir prompts complexos. Cada etapa da conversa vira um nó que você precisa criar e manter manualmente. Storm segue instruções detalhadas a partir de um único prompt, então você não precisa se preocupar com nós e arestas.
Seis nós para um único fluxo de cadastro — cada um com seus próprios prompts, ferramentas, transições e tratamento de falhas.
Cumprimente quem liga e colete o nome e o telefone. Confirme o consentimento antes de fazer a inscrição — obrigatório. Se houver alguma dúvida sobre cobrança, siga a política de cobrança abaixo. Só acione enroll() depois que todos os campos forem confirmados. Se quem liga pedir para falar com uma pessoa, transfira para um atendente.
Um único prompt para escrever, testar e ajustar — com ramificações incluídas.
Fala embolada, conversas ao fundo, nomes e números, mistura de idiomas — ThunderPhone foi desenvolvido para os cenários em que outros sistemas falham.
Cruze sinais de áudio e texto em vez de confiar em uma única transcrição.
Modelos de identificação e redução de ruído limpam o sinal.
Detecte conversas paralelas antes que tirem o agente do rumo.
Cruze nomes próprios, grafias, números e correções.
Faça o roteamento por fluxos multilíngues de áudio e voz quando necessário.
Use linhas de raciocínio mais robustas quando o comportamento não puder ser resumido a uma única regra.
A IA de voz precisa responder rápido — mas rapidez sem precisão só significa errar mais rápido. Os LLMs atuais precisam de um instante para raciocinar e continuar confiáveis. Por isso, ThunderPhone equilibra latência e precisão.
Outros fornecedores anunciam latência de 500 ms em condições ideais, mas, em uma chamada real, normalmente ficam perto de 2 s. Medimos nossa latência em condições reais.
Fornecedores de IA enfrentam picos de latência que podem comprometer chamadas. O stack orquestrado do ThunderPhone alterna para opções mais rápidas quando isso acontece.
Chamadas automatizadas eram sinônimo de frustração… até agora. Cada avanço tecnológico melhorou a experiência, mas nunca a ponto de torná-la realmente fluida. Isso muda com o ThunderPhone.
“Tecle 1 para vendas, tecle 2 para suporte.” Menus só conseguem encaminhar chamadas.
Diga “vendas” ou “faturamento” e torça para o analisador de slots entender.
Transcreva, consulte um único LLM rápido e fale — cada etapa confiando na anterior.
Áudio, texto, raciocínio, ferramentas, vozes e controles de segurança em um único sistema.
No ar em dez minutos. A partir de 2¢/min.