ThunderPhone julkistetaan
Päivitys, elokuu 2026: Tämä on alkuperäinen julkaisuilmoituksemme maaliskuulta 2026, säilytettynä arkistona. Jotkin yksityiskohdat — erityisesti hinnoittelu ja puhevaihtoehdot — ovat sittemmin muuttuneet; katso tämänhetkiset tiedot ajantasaisesta hinnoittelusta. Ja odotus on ohi: lue v2-julkaisuilmoitus!
Tänään julkaisemme ylpeinä ThunderPhone:n, jonka avulla puheluiden automatisointi tekoälyn avulla on helppoa. ThunderPhone käyttää täysin erilaista integroitua arkkitehtuuria kuin muut puhelintekoälyalustat, minkä ansiosta se tarjoaa huomattavasti paremman suorituskyvyn, alhaisemmat kustannukset ja vähemmän integraatioihin liittyviä hankaluuksia. ThunderPhone tukee saapuvia ja lähteviä puheluita kymmenillä kielillä ja noudattaa HIPAA- ja GDPR-vaatimuksia.
Integroidun arkkitehtuurin etu
Muut puhelintekoälyalustat rajoittavat järjestelmiensä suorituskykyä pakottamalla ne kolmivaiheiseen rakenteeseen:
- Yksi transkriptiomalli, joka muuntaa käyttäjän puheen tekstiksi.
- Yksi LLM, joka käsittelee käyttäjän tekstin ja tuottaa vastauksen.
- Yksi TTS-malli, joka muuntaa vastaustekstin takaisin ääneksi.
Useimmat niistä myös siirtävät teknistä työtä käyttäjiensä vastuulle pakottamalla nämä valitsemaan käytettävät mallit sekä asetukset, kuten kohinanpoiston ja reagointinopeuden parametrit.
Olemme valinneet toisenlaisen lähestymistavan: olemme koonneet mielestämme parhaimman mahdollisen kokonaisuuden nykyisistä malleista ja tehneet siitä käyttövalmiin ilman monimutkaista konfigurointia. Järjestelmämme käyttää useita malleja samanaikaisesti ja reitittää niiden välillä älykkäästi keskustelun kulun mukaan. Tähän kuuluu:
- Useiden transkriptiomallien yhdistäminen: jotkin ovat toisia nopeampia, jotkin tarkempia, jotta nopeus ja tarkkuus pysyvät tasapainossa ja mallien virheet voidaan paikata.
- Ääntä syötteenä käyttävien LLM:ien, joiden yleinen älykkyys voi olla heikompi mutta äänen ymmärrys parempi, yhdistäminen vain tekstiä käsitteleviin LLM:iin, jotka voivat tehdä virheitä epätarkkojen transkriptien vuoksi mutta ovat usein älykkäämpiä.
- Nopeiden mutta yksinkertaisten LLM:ien, jotka voivat tuottaa nopeita vastauksia, yhdistäminen huomattavasti älykkäämpiin mutta hitaampiin LLM:iin, jotka voivat toimia taustalla ja varmistaa, että tekoäly noudattaa kehotettaan ja vastaa oikein käyttäjän sanomaan.
- Kaupallisten mallien yhdistäminen johtavilta palveluntarjoajilta, kuten OpenAI:lta ja Googlelta, jotka tarjoavat nykyisin korkeimman saatavilla olevan älykkyyden, laajaan valikoimaan avoimen lähdekoodin malleja, jotka tarjoavat usein paremman nopeuden alhaisemmilla kustannuksilla.
- Useiden mallien samanaikainen käyttäminen taustamelun, sivukeskustelujen ja muiden häiritsevien äänien luokitteluun ja poistamiseen, sillä ne voivat muuten suistaa keskustelun raiteiltaan.
Näitä komponentteja ja muita ohjataan eri tavoin kolmella palvelutasollamme, Spark, Bolt ja Storm — Spark on optimoitu kustannuksille, Bolt nopeudelle ja Storm älykkyydelle, samalla kun kunkin haittapuolet minimoidaan mahdollisimman tehokkaasti. Kaikilla kolmella järjestelmällä on yhteisiä etuja, kuten uskomattoman tarkka ymmärrys käyttäjien puheesta myös erisnimien ja tavauksen kohdalla.
Olemme havainneet, että tämä tiiviisti integroitu arkkitehtuuri tarjoaa järjestelmällemme huomattavasti paremman suorituskyvyn alhaisemmilla kustannuksilla kuin muiden toimittajien tarjoama jäykkä kolmivaiheinen lähestymistapa. Clay Christensenin modulaarisuusteorian mukaisesti puhetekoäly on yhä alkutaipaleellaan, ja suorituskyvyn maksimointi integroidulla arkkitehtuurilla on edelleen arvokkaampaa kuin mukautettavuuden maksimointi modulaarisella arkkitehtuurilla.
Optimoidut päätökset
Mitä muokattavuuteen tulee, vastustamme sitä! Useimmat nykyiset puhelin-AI-alustat pakottavat käyttäjät selaamaan loputtomia valintoja käytettävistä malleista äärimmäisen yksityiskohtaisiin parametreihin, kuten siihen, kuinka nopeasti AI keskeyttää käyttäjän.
Mielestämme on MEIDÄN tehtävämme optimoida nämä valinnat taustalla, jotta ThunderPhonen käyttäjät voivat keskittyä siihen, missä he ovat hyviä, eikä heidän tarvitse huolehtia puhe-AI:n yksityiskohtaisesta määrittelystä. Näemme itsemme eräänlaisena Squarespacena, joka helpottaa käyttäjiämme ottamaan käyttöön puheagentteja tämän päivän malleilla mahdollisimman korkealla suorituskyvyllä ilman, että heidän tarvitsee tehdä mitään.
Helppokäyttöisyys
ThunderPhone on myös uskomattoman helppokäyttöinen, olitpa ottamassa käyttöön uutta puheagenttia tai siirtymässä toiselta alustalta tai omasta teknisestä kokonaisuudesta. Puheagentin käyttöönotto ThunderPhonessa vaatii vain seuraavat vaiheet:
- Päätä, haluatko käyttää Sparkia, Boltia vai Stormia.
- Valitse ääni.
- Anna meille kehotteesi. Monikehotteisia agentteja ei tarvita! Jos kehotteesi on liian monimutkainen Sparkille tai Boltille, päivitä Stormiin, joka pystyy käsittelemään monimutkaisetkin käyttötapaukset yhdellä kehotteella.
- Yhdistä ohjelmistointegraatiot (mikä tahansa päätepiste tai natiivi n8n-integraatio) uskomattoman helppokäyttöisellä ohjatulla toiminnolla.
- Yhdistä VoIP-palvelusi uskomattoman helppokäyttöisellä ohjatulla toiminnolla.
Tähän kuluu yleensä 10 minuuttia tai vähemmän.
ThunderPhone on HIPAA- ja GDPR-yhteensopiva, ja allekirjoitamme sekä toimitamme BAA- ja DPA-sopimukset pyynnöstä.
Tarinamme
Olemme Stanford AI Labin ja Y Combinatorin alumneista koostuva tiimi, joka on työskennellyt puhe-AI:n parissa vuodesta 2024 lähtien. Alun perin keskityimme Flux Interpretingiin, joka kääntää puheluita eri kielten välillä. Kun asiakkaat kuitenkin pyysivät meitä toistuvasti automatisoimaan yritystensä puheluita niiden pelkän kääntämisen sijaan, siirsimme fokuksemme siihen, mikä nykyään on ThunderPhone.
Nykyisten alustojen ongelmat
Aluksi rakensimme puheagentteja asiakkaille muiden yritysten puhelin-AI-alustoilla. Testasimme lähes kaikki markkinoilla olevat puhelin-AI-alustat, mutta valitettavasti huomasimme niissä puutteita, erityisesti seuraavissa asioissa:
- Äänen ymmärtäminen: Kun käyttäjän ääni muunnetaan tekstiksi vain yhdellä transkriptiomallilla, AI ”kuulee” käyttäjän usein väärin, etenkin erisnimien, harvinaisten sanojen ja tavutusten kohdalla.
- Ohjeiden noudattaminen: Kun puhelun varsinaisesta ”aivotyöstä” vastaa yksi nopea LLM, AI:t kamppailevat usein ohjeiden oikean noudattamisen kanssa ja ajautuvat sivuraiteille.
- Vaikeat integraatiot: Kokeilemamme alustat tekivät ulkoisten ohjelmistojen yhdistämisestä erittäin hankalaa. Yleensä jouduimme kirjoittamaan laajoja JSON-määrityksiä työkalukutsuja varten ja hakkaamaan niitä toistuvasti lähes ilman palautetta, kunnes ne yhtäkkiä alkoivat toimia.
- Hinta: Nykyiset alustat veloittivat yleensä maltaita: tavallisesti 10 senttiä minuutilta tai enemmän keskinkertaisesta suorituskyvystä.
Oman kokonaisuutemme rakentaminen
Kun solmimme sopimuksen myyntipuhelukäyttötapauksen toteuttamisesta suuryritysasiakkaalle, jouduimme rakentamaan oman räätälöidyn kokonaisuutemme vastataksemme heidän tarpeisiinsa. Tämä käyttötapaus oli vaativa: toisin kuin asiakastuen puheluissa, joissa soittajat toimivat pitkälti yrityksen ehdoilla, myyntipuheluissa soittajat lopettavat puhelun herkästi.
Puhelun laadun on oltava huippuluokkaa, jotta kauppa syntyy eikä liidiä menetetä. Tämä tarkoitti lukuisten erisnimien ja tavutusten, kuten nimien ja osoitteiden, käsittelyä – asioiden, jotka tavallisten transkriptiomallien on vaikea saada oikein. Jotta pystyimme toteuttamaan tämän käyttötapauksen täydellisesti, rakensimme sen, mikä nykyään on ThunderPhone.
Matkan varrella tapasimme San Franciscon puhe-AI-yhteisössä jatkuvasti ihmisiä, jotka rakensivat toimialakohtaisia puheagenttiyrityksiä – eläinlääkäreille, kuorma-autonkuljettajille ja muille. Yllättäen useimmilla heistä oli sama näkemys: nykyiset alustat olivat riittävän hyviä demoihin, mutta eivät tuotantoon.
Hätkähdyttävää kyllä, monet, elleivät jopa useimmat ystävistämme toimialakohtaisissa puhe-AI-yrityksissä rakensivat omia kokonaisuuksiaan... Tämä ei käynyt meille järkeen – se vastaa käytännössä sitä, että 90-luvun verkkostartupien olisi pitänyt ylläpitää omia verkkopalvelimiaan vaatekaappinsa palvelimella.
Tämän oivalluksen myötä ymmärsimme, että oli aika tehdä puhelin-AI-järjestelmästämme alusta, jota kuka tahansa voi käyttää.
Toimialakohtaisten puhe-AI-yritysten ja konsulttien pitäisi voida keskittyä kohdemarkkinansa tarpeisiin toimialakohtaisella osaamisellaan — ei taustalla olevan AI- ja puhelinteknologian monimutkaiseen suunnitteluun! Tätä julkaisemme tänään ThunderPhonen kanssa.
Tie tänne on ollut pitkä! Pahoittelut kaikille, jotka ovat rekisteröityneet meille viime huhtikuusta lähtien ja odottavat yhä pääsyä: se, minkä ajattelimme olevan nopea loppukiri työn viimeistelemiseksi, osoittautui kuukausia kestäväksi matkaksi, jolla selvitimme, miten nykyiset saatavilla olevat mallit voidaan kutoa yhteen mahdollisimman vankaksi järjestelmäksi.
Mutta nyt olemme vihdoin julkaisseet sen — kokeile ja kerro, mitä mieltä olet!
Vaikka olemme ratkaisseet suurimmat ongelmat, järjestelmässä on varmasti yhä bugeja. Jos löydät ongelmia, lähetä sähköpostia osoitteeseen alex@thunderphone.com, niin varmistan, että ne korjataan sinulle mahdollisimman pian. Kerro myös mahdollisista ominaisuustoiveistasi, niin toteutamme nekin sinulle niin pian kuin pystymme.
Jos sinulla on räätälöidympiä tarpeita, kuten tukea räätälöityyn toteutukseen ja integraatioihin, tavallista HIPAA- ja GDPR-vaatimustenmukaisuutta laajempia vaatimuksia, palvelutasosopimuksia tai räätälöityjä ominaisuustoiveita, keskustelemme mielellämme yrityssopimuksesta. Ota yhteyttä osoitteessa alex@thunderphone.com, niin keskustellaan tarpeistasi ja siitä, voimmeko auttaa.
Yleisemmin ottaen sitoumuksemme sinulle on tämä: ON MEIDÄN tehtävämme varmistaa, että ThunderPhone toimii heti käyttövalmiina mahdollisimman pienellä vaivalla sinulta ja hoitaa yrityksesi puhelut niin täydellisesti kuin nykyisellä AI:lla on mahdollista valitsemastasi Spark-, Bolt- tai Storm-hintatasosta riippuen. Kokeile meitä — odotamme innolla, että pääsemme näyttämään, mihin ThunderPhone pystyy.
Kerro meille, mitä mieltä olet, ja kiitos tuestasi!