ThunderPhone 2.0 è arrivato.Parti in autonomia, da 2¢/min.Leggi l’annuncio
Tutti gli articoli

Annunciamo ThunderPhone

10 marzo 2026Alex Kolchinski

Aggiornamento, agosto 2026: Questo è il nostro annuncio di lancio originale di marzo 2026, conservato per i posteri. Da allora alcuni dettagli — in particolare prezzi e opzioni vocali — sono cambiati; consulta i prezzi attuali per le informazioni aggiornate. E l'attesa è finita: leggi l'annuncio di lancio della v2!

Oggi siamo orgogliosi di annunciare il lancio pubblico di ThunderPhone, che semplifica l'automazione delle chiamate telefoniche con l'IA. Grazie a un'architettura integrata completamente diversa da quella delle altre piattaforme di IA telefonica, ThunderPhone offre prestazioni molto più elevate, costi inferiori e meno problemi di integrazione. ThunderPhone supporta chiamate in entrata e in uscita in decine di lingue ed è conforme a HIPAA e GDPR.

Il vantaggio dell'integrazione

Altre piattaforme di IA telefonica limitano le prestazioni dei loro sistemi imponendo una struttura in 3 fasi:

  1. Un modello di trascrizione, che trasforma la voce dell'utente in testo.
  2. Un LLM, che elabora il testo dell'utente e produce una risposta.
  3. Un modello TTS, che trasforma il testo della risposta nuovamente in audio.

La maggior parte di queste piattaforme scarica inoltre il lavoro tecnico sui propri utenti, costringendoli a scegliere quali modelli utilizzare e opzioni di configurazione come i parametri di riduzione del rumore e reattività.

Abbiamo adottato un approccio diverso: abbiamo configurato quello che, secondo noi, è il miglior stack possibile con i modelli oggi disponibili, rendendolo pronto all'uso senza richiedere complesse operazioni di configurazione. Il nostro sistema utilizza molti modelli contemporaneamente e instrada in modo intelligente tra loro in base al flusso della conversazione. Questo include:

  • Combinare più modelli di trascrizione, alcuni più veloci di altri e alcuni più accurati di altri, per bilanciare velocità e accuratezza e compensare gli errori reciproci.
  • Combinare LLM con input audio, che possono avere un'intelligenza generale inferiore ma una migliore comprensione dell'audio, con LLM solo testuali, che possono commettere errori a causa di trascrizioni imprecise ma sono spesso più intelligenti.
  • Combinare LLM veloci ma poco intelligenti, in grado di generare risposte rapide, con LLM molto più intelligenti ma più lenti, che possono operare in background e assicurarsi che l'IA segua il proprio prompt e risponda correttamente a ciò che dice l'utente.
  • Combinare modelli commerciali dei principali provider, tra cui OpenAI e Google, che offrono il più alto livello di intelligenza oggi disponibile, con un'ampia selezione di modelli open source, che spesso offrono maggiore velocità a costi inferiori.
  • Utilizzare più modelli simultaneamente per classificare ed eliminare rumore di fondo, conversazioni laterali e altri rumori distraenti che altrimenti potrebbero compromettere una conversazione.

Questi componenti e molti altri sono orchestrati in modi diversi nei nostri tre livelli di servizio, Spark, Bolt e Storm — ottimizzando Spark per il costo, Bolt per la velocità e Storm per l'intelligenza, riducendo al minimo gli svantaggi di ciascuno per quanto possibile. Tutti e tre i sistemi condividono vantaggi come una comprensione incredibilmente accurata di ciò che dicono gli utenti, anche in presenza di nomi propri e ortografia.

Abbiamo constatato che questa architettura strettamente integrata offre al nostro sistema prestazioni molto più elevate a costi inferiori rispetto al rigido approccio in 3 fasi proposto da altri fornitori. In linea con la teoria della modularità di Clay Christensen, siamo ancora agli inizi nell'IA vocale, ed è ancora più importante massimizzare le prestazioni con un'architettura integrata che massimizzare la personalizzabilità con un'architettura modulare.

Decisioni ottimizzate

E per quanto riguarda la personalizzazione, siamo contrari. La maggior parte delle piattaforme di IA telefonica di oggi costringe gli utenti a destreggiarsi tra infinite scelte, dai modelli esatti utilizzati a parametri ultra-dettagliati, come la rapidità con cui l'IA interrompe l'utente.

Secondo noi, è compito NOSTRO ottimizzare queste scelte dietro le quinte, così che gli utenti di ThunderPhone possano concentrarsi su ciò che sanno fare meglio senza preoccuparsi della configurazione dettagliata dell'IA vocale. Ci vediamo un po' come Squarespace: rendiamo semplice per i nostri utenti configurare agenti telefonici con le prestazioni più elevate possibili offerte dai modelli di oggi, senza dover muovere un dito.

Facilità d'uso

ThunderPhone è anche incredibilmente facile da usare, sia che tu stia configurando un nuovo agente telefonico, sia che tu stia migrando da una piattaforma diversa o da uno stack personalizzato. Per configurare un agente telefonico su ThunderPhone, basta:

  1. Decidere se usare Spark, Bolt o Storm.
  2. Scegliere una voce.
  3. Fornirci il tuo prompt. Non servono agenti multi-prompt. Se il tuo prompt è troppo complicato per Spark o Bolt, passa a Storm, che può gestire anche casi d'uso complessi con un solo prompt.
  4. Collegare le integrazioni software (qualsiasi endpoint o l'integrazione nativa con n8n) con una procedura guidata incredibilmente facile da usare.
  5. Collegare il tuo VoIP con una procedura guidata incredibilmente facile da usare.

In genere, tutto questo richiede 10 minuti o meno.

ThunderPhone è conforme a HIPAA e GDPR e, su richiesta, firmeremo e forniremo BAA e DPA.

La nostra storia

Siamo un team di ex membri dello Stanford AI Lab e di Y Combinator che lavora sull'IA vocale dal 2024. In origine ci concentravamo su Flux Interpreting, che traduce le telefonate tra lingue diverse. Ma dopo che i clienti ci hanno chiesto ripetutamente di automatizzare le telefonate per le loro attività invece di limitarci a tradurle, abbiamo spostato l'attenzione su quello che oggi è ThunderPhone.

Il problema delle piattaforme esistenti

All'inizio, abbiamo iniziato a creare agenti telefonici per i clienti sulle piattaforme di IA telefonica di altre aziende. Abbiamo testato praticamente tutte le piattaforme di IA telefonica sul mercato, ma purtroppo le abbiamo trovate carenti, soprattutto per quanto riguarda:

  • Comprensione dell'audio: I limiti di avere un solo modello di trascrizione per trasformare l'audio dell'utente in testo facevano sì che l'IA spesso “fraintendesse” l'utente, soprattutto con nomi propri, parole non comuni e ortografie.
  • Rispetto delle istruzioni: Avere un singolo LLM veloce a svolgere il vero “lavoro mentale” della chiamata significava che le IA spesso faticavano a seguire correttamente le istruzioni e finivano fuori strada.
  • Integrazioni difficili: Le piattaforme che abbiamo provato rendevano molto difficile collegarsi a software esterni, costringendoci in genere a inserire estese configurazioni JSON per le chiamate degli strumenti e ad armeggiare ripetutamente con esse, con feedback minimo o inesistente, finché all'improvviso non iniziavano a funzionare.
  • Prezzo: Le piattaforme esistenti in genere costavano un occhio della testa: di solito 10 centesimi al minuto o più per prestazioni così così.

Costruire il nostro stack

Quando abbiamo firmato un accordo per implementare un caso d'uso di chiamate di vendita per un cliente Enterprise, siamo stati costretti a creare il nostro stack personalizzato per soddisfare le sue esigenze. Questo caso d'uso era impegnativo: a differenza dell'assistenza clienti, dove chi chiama dipende in larga misura dall'azienda, chi riceve chiamate commerciali riaggancia in fretta.

La qualità della chiamata deve essere eccellente per chiudere la vendita invece di perdere il potenziale cliente. Questo significava gestire numerosi nomi propri e ortografie, inclusi nomi e indirizzi, che per i modelli di trascrizione standard sono difficili da azzeccare. Per azzeccare questo caso d'uso, abbiamo creato quello che oggi è ThunderPhone.

Nel frattempo, continuavamo a incontrare persone della comunità dell'IA vocale di San Francisco che stavano creando aziende di agenti telefonici verticali — per veterinari, camionisti e molto altro. Sorprendentemente, la maggior parte di loro condivideva la stessa opinione: le piattaforme esistenti erano abbastanza valide per le demo, ma non per la produzione.

Sorprendentemente, molti, se non la maggior parte, dei nostri amici nelle aziende verticali di IA vocale stavano in realtà “creando da zero” i propri stack... Per noi non aveva senso: è davvero l'equivalente delle startup web degli anni '90 che dovevano ospitare i propri server web su un server nell'armadio.

Con questa consapevolezza, abbiamo capito che era il momento di trasformare il nostro sistema di IA telefonica in una piattaforma che chiunque potesse usare.

Le aziende verticali di IA vocale e i consulenti dovrebbero potersi concentrare sul soddisfare le esigenze del proprio mercato di riferimento con la loro esperienza specifica di settore — non sull'ingegnerizzazione complessa dell'IA e della tecnologia telefonica sottostanti! È questo che lanciamo oggi con ThunderPhone.

È stato un lungo percorso per arrivare fin qui! Ci scusiamo con tutti coloro che si sono iscritti con noi dallo scorso aprile e stanno ancora aspettando l'accesso: quello che pensavamo sarebbe stato uno sprint rapido per finire il lavoro si è rivelato un'odissea di mesi per capire come intrecciare i modelli disponibili oggi in un sistema il più robusto possibile.

Ma ora siamo finalmente online — provalo e dicci cosa ne pensi!

Anche se abbiamo risolto le principali criticità, ci saranno sicuramente ancora bug nel sistema. Se riscontri problemi, invia un'email a alex@thunderphone.com e farò in modo che vengano risolti per te al più presto. Facci sapere anche se hai richieste di funzionalità e faremo il possibile per realizzarle quanto prima.

E se hai esigenze più personalizzate, come supporto per implementazioni e integrazioni su misura, conformità oltre HIPAA e GDPR standard, SLA e richieste di funzionalità personalizzate, saremo felici di parlare di un accordo Enterprise. Contattaci a alex@thunderphone.com e parleremo delle tue esigenze e di come possiamo aiutarti.

Più in generale: il nostro impegno nei tuoi confronti è che è compito NOSTRO assicurarci che ThunderPhone funzioni subito, con il minimo sforzo da parte tua, e gestisca le chiamate della tua attività nel modo più efficace possibile con l'IA di oggi, entro i limiti del livello di prezzo che scegli: Spark, Bolt o Storm. Provaci: non vediamo l'ora di mostrarti cosa può fare ThunderPhone.

Facci sapere cosa ne pensi e grazie per il tuo supporto!