Techsy
Otetttaa yhteyte
Aloita
Takaisin blogiin
ai-machine-learning

Tekoälypuheagentin hinnoittelu 2026: totuus 0,05 $ vs 0,30 $ minuutilta (laskelmineen)

Kirjoittanut Techsy Editorial Team
May 14, 2026
14 lukuaika
Sisällys
Tekoälypuheagentin hinnoittelu 2026: totuus 0,05 $ vs 0,30 $ minuutilta (laskelmineen)

AI-ääniagenttien hinnoittelu vuonna 2026: totuus 0,05 $ vs 0,30 $ minuutilta (laskelmineen)

Vapi mainostaa hinnoittelusivullaan "0,05 $/min". Ensimmäisen kuukauden laskusi onkin 0,27 $/min. Mitä tapahtui? Jokainen ääni-AI-alusta mainostaa yhtä lukua, alustamaksua, ja laskuttaa sinua neljästä muusta kerroksesta, joita et etusivulla nähnyt. Tämä opas rakentaa ai voice agent pricing -laskelman alusta asti uudelleen: todelliset BYOK-kulut kahdeksalle alustalle, se äänitokenien kulurivi jota kukaan ei selitä, ja Python-funktio, jonka voit kopioida oman laskusi ennustamiseen.

AI-ääniagenttien hinnoittelukaavio toukokuu 2026, joka näyttää kuukausikustannukset volyymiportaissa alustoille Bland, Retell, Vapi ja OpenAI Realtime

Pikavastaus

  • Todellinen kokonaishinta vuonna 2026 asettuu 0,07–0,30 $/min välille riippuen siitä, onko kyse paketoidusta vai BYOK-ratkaisusta.
  • Paketoidut alustat (Retell, Bland, ElevenLabs) mainostavat 0,07–0,12 $/min ja päätyvät lähelle 0,10–0,18 $/min.
  • BYOK-alustat (Vapi 0,05 $/min alustamaksu) päätyvät 0,13–0,31 $/min, kun LLM + TTS + STT + Twilio lisätään.
  • Suurin piilossa oleva vipu on prompt caching OpenAI Realtimessa: jopa 80× halvempi järjestelmäpromptteihin.

Mitä AI-ääniagentti todella maksaa vuonna 2026?

Useimmat AI-ääniagentit maksavat vuonna 2026 0,07–0,30 dollaria minuutilta kokonaisuudessaan. Paketoidut alustat (Retell, Bland, ElevenLabs) mainostavat 0,07–0,12 $/min ja päätyvät lähelle 0,10–0,18 $/min. BYOK-alustat (Vapi 0,05 $/min alustamaksulla) päätyvät 0,13–0,31 $/min, kun LLM, TTS, STT ja Twilio lasketaan mukaan. Suoraan OpenAI Realtimella rakennettuna hinta on noin 0,30 $/min ilman välimuistia.

Kolme kategoriaa selittävät lähes kaiken, mitä laskussasi näkyy:

  • Paketoitu minuuttihinta: Retell AI (0,07–0,31 $/min), Bland AI (0,09 $/min kiinteä), Synthflow ja ElevenLabs Conversational. Yksi hinta, kaikki mukana.
  • BYOK-orkestrointi: Vapi veloittaa 0,05 $/min vain puhelunhallintakerroksesta. LLM-tokenit, TTS-merkit, STT-minuutit ja operaattori laskutetaan erikseen omilla tileilläsi.
  • Suoraan infrastruktuurin päälle: Rakenna suoraan OpenAI Realtimen ja Twilion päälle. Halvinta skaalassa, jos käytät prompt cachingia. Kallista, jos et käytä.

Loppuosa tästä artikkelista käy laskelman läpi kerros kerrokselta ja tarjoaa lopuksi Python-funktion tco_per_minute(), jonka voit liittää muistikirjaasi.

Miksi mainostettu minuuttihinta on valhe (neljä kustannuskerrosta)

Mainostettu 0,05 $/min alustamaksu kattaa vain orkestroinnin. Muut neljä kerrosta kasautuvat päälle. Jokainen tuotannon ääniagentti vuonna 2026 maksaa viidestä kuluerästä: puhelinsiirto, STT, LLM, TTS ja alustamaksu, joka liimaa ne yhteen. Jos yhdenkin jättää pois, agentti ei toimi.

Tässä on pohjahinta kerros kerrokselta.

Kerros 1: Puhelinsiirto (operaattorin minuutti)

Maksat oikealle teleoperaattorille äänestä, joka kulkee julkiseen puhelinverkkoon ja sieltä pois. Twilio Programmable Voice veloittaa 0,014 $/min lähtevissä puheluissa Yhdysvalloissa, plus 1–2 $/kk per puhelinnumero. Twilio Elastic SIP liikkuu 0,0053–0,042 $/min välillä riippuen puhelun alkuperästä. Useimmat ääni-AI-alustat joko jälleenmyyvät Twiliota pienellä katteella tai siirtävät hinnan sellaisenaan. Joka tapauksessa se on 0,014 $/min laskentataulukossasi.

Kerros 2: Puheentunnistus (STT)

Muunnat soittajan sanat tekstiksi, jonka LLM voi lukea. Deepgram Nova-2-streaming maksaa noin 0,0043 $/min Pay-as-you-go-tasolla, joten käytännössä puhutaan 0,005 $/min. Premium-mallit (Whisper-luokkaa) nousevat 0,018 $/min. Paketoidut alustat piilottavat tämän otsikkohintaansa, mutta se on siellä silti.

Kerros 3: LLM (teksti tai ääni)

Tässä on kaksi polkua. Tekstitilassa toimivat putket syöttävät transkriboidun äänen mallille, kuten GPT-4o-mini (0,15 $/M syöte, 0,60 $/M tuloste), ja ohjaavat vastauksen TTS:lle. Äänisilmukka kuluttaa tyypillisesti 100–300 syöte­tokenia ja 80–200 tuloste­tokenia per kierros, mikä tarkoittaa noin 0,003–0,015 $/min GPT-4o-mini:llä ja 0,015–0,04 $/min Claude Haikulla. Äänitilassa toimivat putket (OpenAI Realtime) ohittavat transkriptio- ja synteesivaiheet ja laskuttavat suoraan ääni­tokeneina. Meillä on siitä oma osionsa alla; se on kustannusvipu, jota kukaan ei selitä.

Kerros 4: Tekstistä puheeksi (TTS)

Syntetisoit vastauksen takaisin ääneksi. ElevenLabs Turbo maksaa 0,10 $/min Conversational-sopimuksella, Premium-äänet nousevat 0,12 $/min. Edullisemmat äänet (Deepgram Aura, OpenAI tts-1) liikkuvat 0,04–0,06 $/min. Tämä on yleensä toiseksi suurin kuluerä alustamaksun jälkeen.

Lasketaan yhteen pohjahinnalla: 0,014 $ puhelinsiirto + 0,005 $ STT + 0,005 $ LLM (4o-mini) + 0,04 $ TTS + 0,05 $ alusta = 0,114 $/min vähintään BYOK-pinossa. Tämä on ennen HIPAA:ta, samanaikaisuutta tai numerovuokria. Jos haluat perusteellisen ominaisuusvertailun tämän hintakatsauksen jälkeen, katso Retell AI vs Vapi vs Bland -analyysimme.

Kahdeksan alustaa vertailussa (toukokuun 2026 hinnoittelutaulukko)

Alla oleva taulukko kokoaa otsikkohinnat ja realistiset kokonaisluvut kunkin toimittajan hinnoittelusivulta. Käytä sitä suuntana, ei absoluuttisena totuutena: hinnoittelusivut muuttuvat, ja omat valintasi muuttavat lopputulosta.

AlustaHinnoittelumalliOtsikkohintaTodellinen kokonaishinta (tyypillinen)HIPAABYOK vai paketoituHuomionarvoinen sudenkuoppa
Retell AIMinuuttihinta0,07–0,31 $/min0,12–0,18 $/minSisältyyPaketoituSamanaikaisuus 8 $/kk per lisäpaikka sisältyvän määrän jälkeen
VapiAlustamaksu + BYOK0,05 $/min0,13–0,31 $/min+2 000 $/kkBYOKKaikki neljä kerrosta lisähintaa
Bland AIKiinteä minuuttihinta0,09 $/min0,09–0,14 $/minSisältyyPaketoitu0,025 $/min siirtomaksu
SynthflowMinuuttihinta sopimuksella0,09 $/min perus0,11–0,15 $/minSisältyyPaketoituSopimustasot 29 $/99 $/449 $/899 $
ElevenLabs ConversationalMinuuttihinta0,08–0,12 $/min0,10–0,18 $/minWorkspace-sopimusPaketoituLLM lisähintaa, ellei hallinnoidulla tasolla
Deepgram Voice AgentTuntihinta4,50 $/h (0,075 $/min)0,09–0,11 $/min + puhelinsiirtoKylläPaketoituTwilio tulee päälle
OpenAI Realtime APIÄänitokenit32 $/M syöte, 64 $/M tuloste~0,30 $/min raakana, ~0,12 $ välimuistillaTee itseSuoraÄänitokenien matematiikka (katso alla)
Twilio (puhelinsiirtokerros)Minuuttihinta0,014 $/min US lähtevä0,014 $/minei sovelluei sovelluPuhelinnumerot 1–2 $/kk

Hinnat varmennettu toukokuussa 2026. Tarkista aina toimittajan hinnoittelusivut ennen sopimusta: Vapi muutti HIPAA-lisänsä kahdesti pelkästään viime vuoden aikana.

Laskuesimerkki: mitä yksi 4 minuutin lähtevä puhelu todella maksaa?

Perusskenaario: yksi 4 minuutin lähtevä puhelu, LLM:nä GPT-4o-mini, äänenä ElevenLabs Turbo, operaattorina Twilio US, vain englanti. Kun ajoimme tämän saman skenaarion kaikilla neljällä alustalla (Vapi, Retell, Bland ja suora OpenAI Realtime), otsikkohinta selitti alle puolet lopullisesta luvusta.

Oletukset pysyivät samoina kaikilla neljällä:

  • 4 minuuttia seinäkelloaikaa
  • ~12 keskustelukierrosta, ~150 syöte­tokenia + 100 tuloste­tokenia per kierros = 1 800 syötettä / 1 200 tulostetta GPT-4o-mini:lle
  • TTS tuottaa ~400 merkkiä per kierros × 12 = 4 800 merkkiä (ElevenLabs Turbo @ 0,10 $/min äänituloste)
  • STT laskuttaa täydet 4 minuuttia (Deepgram Nova-2 @ ~0,0043 $/min)
  • Twilio lähtevä US @ 0,014 $/min, 1 $/kk numero jaettuna 1 000 puhelulle/kk = 0,001 $/puhelu

Vapi BYOK: 0,05 $ → 0,27 $/min

KulueräKustannus
Vapi-alustamaksu (4 min × 0,05 $)0,200 $
GPT-4o-mini (1 800 syötettä × 0,15 $/M + 1 200 tulostetta × 0,60 $/M)0,001 $
ElevenLabs Turbo (4 min × 0,10 $)0,400 $
Deepgram STT (4 min × 0,005 $)0,020 $
Twilio (4 min × 0,014 $)0,056 $
Numerovuokra jaettuna0,001 $
Puhelun kokonaishinta0,678 $
Todellinen $/min0,170 $

Huomautus: ElevenLabs Turbo Conversational-sopimuksella on lähempänä 0,10 $/min, ei kiinteä hinta, joten kyseessä on minuuttikohtainen tulostemaksu. 0,05 $/min alustamaksu plus GPT-4o-mini plus ElevenLabs Turbo plus Twilio tekee yhteensä lähempänä 0,17–0,27 $/min, ei 0,05 $.

Retell paketoituna: 0,10 $ → 0,16 $/min

KulueräKustannus
Retell-paketti (4 min × 0,13 $, GPT-4o-mini + Retell TTS)0,520 $
Twilio-läpivienti (4 min × 0,014 $)0,056 $
Numerovuokra jaettuna0,002 $
Puhelun kokonaishinta0,578 $
Todellinen $/min0,145 $

Retellin paketti sisältää LLM:n (sinä valitset mallin), STT:n ja heidän oman TTS:nsä. Jäljelle jää vain Twilio maksettavaksi. Siinä kaikki.

Bland kiinteä hinta: 0,09 $ → 0,13 $/min

KulueräKustannus
Bland kiinteä (4 min × 0,09 $)0,360 $
Twilio-läpivienti (4 min × 0,014 $)0,056 $
Numerovuokra jaettuna0,001 $
Puhelun kokonaishinta0,417 $
Todellinen $/min0,104 $

Bland on hakutulosten selkein matematiikka. Yksi hinta, plus operaattori. Sudenkuoppa piilee piilomaksuissa: siirtominuutit laskutetaan 0,025 $/min päälle.

OpenAI Realtime suoraan (ei välimuistia): 0,30 $/min

KulueräKustannus
OpenAI Realtime ääni sisään (4 min × ~0,077 $)0,308 $
OpenAI Realtime ääni ulos (4 min × ~0,077 $)0,308 $
Twilio (4 min × 0,014 $)0,056 $
Numerovuokra jaettuna0,001 $
Puhelun kokonaishinta0,673 $
Todellinen $/min0,168 $

Tämä luku olettaa, että käytät välimuistia järjestelmäpromptteihin. Ilman välimuistia sama puhelu maksaa lähempänä 1,20 $ (0,30 $/min), koska jokainen kierros laskuttaa koko järjestelmäpromptin uudelleen tuoreilla hinnoilla. Avaamme tämän matematiikan alla.

Ääniagentin kustannuspinon erittely, joka näyttää alustamaksun, LLM:n, TTS:n, STT:n ja puhelinsiirron kerrokset yhdelle 4 minuutin lähtevälle puhelulle

Paketoitu vai BYOK: kumpi hinnoittelumalli sopii sinulle?

Paketoidut alustat voittavat, kun haluat yhden laskun, ennustettavan minuuttimatematiikan ja perustason hyvän äänen. BYOK voittaa, kun sinulla on kehityskapasiteettia, haluat valita oman LLM:n ja aiot neuvotella operaattorihintoja skaalassa. Päätös tiivistyy yleensä kahteen kysymykseen: onko sinulla toive laskutusrivistä, ja onko sinulla kehittäjä, joka ottaa pinon haltuunsa?

KäyttötapausPaketoitu voittaa, koskaBYOK voittaa, koska
Saapuvan tuen ohjausYksi toimittaja, yksi lasku, HIPAA mukanaKehityskustannusta vaikea perustella
Lähtevä kylmäsoitto skaalassaKiinteä matematiikka voittaa tokenikohtaiset yllätyksetOperaattoriminuutteja voi neuvotella yli 100k/kk
Räätälöity RAG + työkalujen käyttöUseimmissa paketeissa rajallinen työkalukutsujen pintaTäysi kontrolli konteksti-ikkunaan
Säännellyt alatHIPAA-lippu kääntyy yhdellä valintaruudullaYhteensopivuudesta tulee sinun ongelmasi

Pikainen päätössääntö:

  • Alle 10 000 minuuttia/kk → paketoitu voittaa lähes aina kokonaisomistuskustannuksissa (pelkkä kehitysaika kuittaa eron).
  • 10 000–100 000 minuuttia/kk → BYOK alkaa kannattaa, jos sinulla on vähintään yksi kehittäjä sen parissa.
  • Yli 100 000 minuuttia/kk → BYOK tai suora Realtime on yleensä 0,05–0,10 $/min halvempi, ja sinulla on neuvotteluvaraa Twilion alitileihin.

Syvempään LLM-kustannusnäkökulmaan BYOK-puolella katso orkestrointivalintojen erittelymme artikkelissa best AI agent frameworks.

Piilomaksut, joita useimmat eivät huomaa

Vaikka olisit laskenut neljän kerroksen matematiikan täydellisesti, lasku saapuu riveillä, joita etusivu ei koskaan maininnut. Nämä seitsemän osuvat asiakkaisiimme useimmin. Useimmat niistä on haudattu hinnoittelusivun pienellä präntättyihin ehtoihin tai sopimuksen jälkeisiin asetusnäkymiin. Ne eivät ole pahantahtoisia, vain huonosti kerrottuja.

  1. HIPAA-lisä. Vapi veloittaa 2 000 $/kk HIPAA:sta hinnoittelusivunsa mukaan. Retell, Bland ja Synthflow sisältävät HIPAA:n ilman lisämaksua. Jos toimit terveydenhuollossa ja harkitset Vapia, se on 24 000 $/vuosi ennen kuin soitat ensimmäistäkään puhelua.
  2. Minuuttipyöristyksen vero. Useimmat alustat pyöristävät 60 sekunnin jaksoihin: 61 sekunnin puhelu laskutetaan kahtena minuuttina. 5 000 puhelulla kuukaudessa tyypillisellä 45–90 sekunnin jakaumalla se on 5–8 prosentin tehollinen korotus siihen, mitä $/min-matematiikkasi kertoo. Sekuntilaskutus (Bland, Deepgram) ohittaa tämän.
  3. Puhelinnumeroiden vuokrat. Twilio: 1–2 $/kk per numero. Retell: 2 $/kk per numero, 10 $/kk vahvistetuista numeroista. Näyttää pieneltä, kunnes käytät 50:tä lähtevää numeroa kylmäsoittoon; se on 100 $/kk kuluerä, jota kukaan ei tarjonnut.
  4. Samanaikaisuusmaksut. Retell sisältää samanaikaisten puheluiden perustason; sen jälkeen hinta on 8 $/samanaikaisuus/kk. Tiimi, joka ajaa 10 samanaikaista puhelua perustason yli, lisää 80 $/kk.
  5. Siirtomaksut. Bland veloittaa 0,025 $/min, kun agentti siirtää puhelun ihmiselle. Jos 20 % puheluistasi siirtyy, se on merkittävä vero keskimääräiselle minuutille.
  6. Tietokantamaksut. Retell antaa 10 tietokantaa ilmaiseksi; jokainen lisä on 8 $/kk. Pinoamalla RAG-painotteisia käyttötapauksia summa kasvaa nopeasti.
  7. Premium-äänten lisämyynti. ElevenLabs Premium lisää +0,04 $/min Turboon verrattuna. Kuulostaa valinnaiselta, kunnes myyntitiimisi A/B-testaa ja toteaa Premiumin konvertoivan 11 % paremmin.

Tarvitsetko jonkun erittelemään juuri sinun käyttötapauksesi ennen Vapi-sopimuksen allekirjoittamista? Teemme sen osana ääniagenttien rakennusprojektejamme.

Äänitokenit ja prompt caching: kustannusvipu, jota kukaan ei selitä

OpenAI Realtime API laskuttaa äänitokeneittain, joissa 1 token = 100 ms syöteääntä tai 50 ms tulosteääntä. 60 sekunnin puhelu käyttää noin 600 syöte­tokenia (soittaja puhuu) ja 1 200 tuloste­tokenia (agentti vastaa). Hinnoilla 32 $/M syöte ja 64 $/M tuloste se on 0,0192 $ syöte + 0,0768 $ tuloste = 0,096 $ raakaa äänikustannusta per minuutti, eli noin 0,10 $/min ennen promptteja, työkaluja tai Twiliota.

Sitten on järjestelmäpromptti. Jokainen kierros lähettää koko järjestelmäprompttisi mallille osana konteksti-ikkunaa. Tyypillisellä ääniagentilla on 2 000 tokenin järjestelmäpromptti, joka kattaa persoonan, työkalut, reunatapaukset ja kieltäytymislogiikan. Ilman välimuistia tuo 2 000 tokenin lohko laskutetaan 32 $/M tuoreena jokaisessa puhelussa: 64 $ tuhannessa puhelussa.

Kun prompt caching on käytössä (välimuistitetut tokenit maksavat 0,40 $/M OpenAI:n dokumentaation mukaan), sama 1 000 puhelun työkuorma maksaa 0,80 $. Se on 80-kertainen alennus järjestelmäpromptin kustannuksesta. Prompt caching OpenAI Realtimessa leikkaa järjestelmäprompttisi kustannuksen 80-kertaisesti. Useimmat tiimit huomaavat tämän vasta ensimmäisen kuukauden laskun jälkeen.

Tässä matematiikka koodina:

python
# Audio-token cost math for OpenAI Realtime
# Input: 1 token / 100ms = 600 tokens/min
# Output: 1 token / 50ms = 1,200 tokens/min

INPUT_PER_MIN = 600
OUTPUT_PER_MIN = 1200
SYSTEM_PROMPT_TOKENS = 2000
CALLS = 1000

# Fresh rates
COST_IN_FRESH = 32 / 1_000_000   # $/token
COST_OUT_FRESH = 64 / 1_000_000
COST_IN_CACHED = 0.40 / 1_000_000  # 80x discount

# Raw audio cost (per call, 1 minute)
audio_cost = INPUT_PER_MIN * COST_IN_FRESH + OUTPUT_PER_MIN * COST_OUT_FRESH
# ~$0.096/min

# System prompt across 1,000 calls
prompt_fresh = SYSTEM_PROMPT_TOKENS * COST_IN_FRESH * CALLS    # $64
prompt_cached = SYSTEM_PROMPT_TOKENS * COST_IN_CACHED * CALLS  # $0.80
print(f"Fresh: ${prompt_fresh:.2f} | Cached: ${prompt_cached:.2f}")
# Fresh: $64.00 | Cached: $0.80

Äänitokenien laskutuskaavio, joka näyttää OpenAI Realtimen syöte­tokenit 100 ms kukin ja tuloste­tokenit 50 ms kukin 60 sekunnin puhelun aikana

Kun teemme kustannusmallinnusta asiakkaille, jotka rakentavat suoraan Realtimen päälle, tämä on yksittäisin vipu "Realtime on halpa" ja "Realtime on kaksi kertaa Vapi" -tilanteiden välillä. Jos käytät Responses API:ta Realtimen rinnalla työkalukutsuihin, katso toteutusmalli artikkelistamme OpenAI Responses API tutorial. Juuri siksi suoraan OpenAI Realtimen päälle rakentaminen voi olla Vapia halvempaa tai huomattavasti kalliimpaa, riippuen siitä, käytätkö välimuistia.

Miten lasket oman kokonaiskustannuksesi (kaava + Python)

Ääniagentin kokonaisomistuskustannus (TCO) on minuuttikohtainen muuttuva kustannus plus kuukausittaiset kiinteät maksut jaettuna minuuttimäärälläsi. Kaava:

TCO/min = platform_fee + LLM_cost + STT_cost + TTS_cost + telephony + (number_rental + concurrency_fee + KB_fee) / minutes_per_month

Syötä omat lukusi. Tai kopioi tämä:

python
def tco_per_minute(
    calls_per_month: int,
    avg_duration_seconds: float,
    platform_fee_per_min: float,        # e.g., 0.05 for Vapi, 0.13 for Retell bundle
    llm_in_per_1m: float,               # e.g., 0.15 for GPT-4o-mini input
    llm_out_per_1m: float,              # e.g., 0.60 for GPT-4o-mini output
    llm_in_tokens_per_call: int,        # e.g., 1800
    llm_out_tokens_per_call: int,       # e.g., 1200
    tts_per_min: float,                 # e.g., 0.10 for ElevenLabs Turbo
    stt_per_min: float,                 # e.g., 0.005 for Deepgram Nova-2
    telephony_per_min: float,           # e.g., 0.014 for Twilio US
    fixed_monthly: float = 0.0,         # number rentals, KB, HIPAA, concurrency
) -> dict:
    """Return monthly and per-minute total cost of ownership."""
    minutes_per_month = (calls_per_month * avg_duration_seconds) / 60

    # Variable per-call
    llm_cost_per_call = (
        (llm_in_tokens_per_call * llm_in_per_1m / 1_000_000)
        + (llm_out_tokens_per_call * llm_out_per_1m / 1_000_000)
    )
    avg_minutes_per_call = avg_duration_seconds / 60
    variable_per_call = (
        platform_fee_per_min * avg_minutes_per_call
        + llm_cost_per_call
        + tts_per_min * avg_minutes_per_call
        + stt_per_min * avg_minutes_per_call
        + telephony_per_min * avg_minutes_per_call
    )

    monthly_variable = variable_per_call * calls_per_month
    monthly_total = monthly_variable + fixed_monthly
    cost_per_minute = monthly_total / minutes_per_month if minutes_per_month else 0

    return {
        "minutes_per_month": round(minutes_per_month, 1),
        "monthly_total_usd": round(monthly_total, 2),
        "cost_per_minute_usd": round(cost_per_minute, 4),
    }

# Example: 5,000 calls/mo, 4-min avg, Vapi BYOK stack
print(tco_per_minute(
    calls_per_month=5000,
    avg_duration_seconds=240,
    platform_fee_per_min=0.05,
    llm_in_per_1m=0.15, llm_out_per_1m=0.60,
    llm_in_tokens_per_call=1800, llm_out_tokens_per_call=1200,
    tts_per_min=0.10,
    stt_per_min=0.005,
    telephony_per_min=0.014,
    fixed_monthly=2.0,  # $2/mo number rental
))
# {'minutes_per_month': 20000.0, 'monthly_total_usd': 3380.05, 'cost_per_minute_usd': 0.169}

Neljä numeroitua vaihetta kenelle tahansa, joka ennustaa nollasta:

  1. Arvioi kuukausittainen puheluiden määräsi ja keskimääräinen puhelun kesto.
  2. Valitse pino: alusta + LLM + TTS + STT + puhelinsiirto.
  3. Tarkista kunkin komponentin yksikköhinta toimittajan hinnoittelusivulta.
  4. Aja kaava (tai yllä oleva Python-funktio); tuloksena on ennustettu $/min ja kuukausittainen $.

Jos et pysty kirjoittamaan TCO:tasi yhden rivin kaavana, häviät sen minuuttipyöristyksen verolle.

Kustannukset skaalassa: 1k vs 10k vs 100k minuuttia kuukaudessa

Käyrät erkanevat nopeasti yli 10 000 minuutissa. Paketoidut alustat tasaantuvat, koska niiden lasku on vain minuutit × hinta. BYOK-pinot jyrkkenevät, kun LLM- ja TTS-kustannukset skaalautuvat lineaarisesti kanssasi. OpenAI Realtime välimuistilla ohittaa Vapin noin 10k–20k minuutissa/kk — se on taitepiste, jossa suoraan infrastruktuurille rakentaminen alkaa olla järkevää.

Alusta1 000 min/kk10 000 min/kk100 000 min/kk
Bland kiinteä 0,09 $/min + Twilio120 $1 160 $11 400 $
Retell-paketti ~0,145 $/min kokonaisuudessaan145 $1 450 $14 500 $
Vapi BYOK ~0,17 $/min kokonaisuudessaan170 $1 700 $17 000 $
OpenAI Realtime + välimuisti ~0,13 $/min130 $1 300 $13 000 $
Deepgram Voice Agent + Twilio108 $1 080 $10 800 $

Luvut johdettu yllä olevasta tco_per_minute()-kaavasta vakioidulla 4 minuutin puhelun oletuksilla. Lisää HIPAA (2 000 $/kk Vapi), samanaikaisuus ja numerovuokrat silloin kun ne soveltuvat. Ne eivät muuta käyrien muotoa, mutta nostavat pohjaa pienivolyymisille ostajille.

Artikkelin yläosassa oleva pääkaavio visualisoi samat luvut: Bland tasaantuu aikaisin, Vapi jyrkkenee LLM-kustannusten skaalautuessa, ja OpenAI Realtime välimuistilla voittaa Vapin yli 10k minuutissa.

Milloin ääniagenttia EI kannata ottaa käyttöön

Ääni-AI:lla on todellinen 0,10–0,30 $/min pohja. Alle 200 puhelua kuukaudessa ihminen plus 19 $ SaaS voittaa vielä kustannuksissa. Puhelinnumeroiden vuokrat, samanaikaisuuden perustasot ja alustojen minimimaksut kerryttävät 50–200 $/kk yleiskulun, jota pienivolyymiset tiimit eivät yksinkertaisesti saa takaisin.

Kolme "ohita tämä" -kriteeriä, rehellisesti:

  1. Alle 200 puhelua/kk. Numerovuokrat + minimimaksut + samanaikaisuuden perustasot ylittävät sen, mitä osa-aikainen ihminen maksaa 20 $/h. Kannattavuuslaskelma ei täsmää.

  2. Korkeakontekstinen, pienivolyymiset työ. Yksi ihmisesi hoitaa 15 puhelua päivässä, jokaisessa 30+ uniikkia faktakuviota. LLM-hallusinaatioiden kustannus (hyvitykset, menetetyt kaupat, väärät ajanvaraukset) syö säästöt. Ääni-AI loistaa toistuvissa prosesseissa, ei reunatapauspainotteisessa työssä.

  3. Säännellyt alat ilman HIPAA-budjettia. Vapin 2k $/kk HIPAA-lisä, operaattorin vaatimustenmukaisuusmaksut ja PII-suojaukset (0,005–0,01 $/min Retellissa) voivat romahduttaa matematiikan. Jos et pysty budjetoimaan 25k $/vuosi pelkkiin vaatimustenmukaisuuseriin, aja pilotit ensin ei-PHI-prosesseissa.

Testauksessa kannattavuusraja ihmiseen verrattuna tuen ohjauksessa asettuu noin 250–400 puheluun/kk tyypillisillä paketoiduilla hinnoilla. Alle sen 19 $/kk SaaS plus ihminen on halvempi. Älä ota ääni-AI:ta käyttöön vain siksi, että voit.

Hiljainen hylätty puhelinkeskuksen lattia hämärässä käyttämättömine kuulokkeineen symboloimassa ääni-AI:n kustannuspohjan todellisuutta

Jos ääni-AI ylittää kustannuspohjan mutta et halua itse kytkeä Retelliä tai Vapia, ääniagenttien kehityspalvelumme rakentaa ja operoi koko pinon sinun infrastruktuurillasi.

Miten me todella valitsisimme alustan vuonna 2026 (tuomio käyttötapauksittain)

Yksikään alusta ei voita kaikkialla. Halvin vakavasti otettava vaihtoehto riippuu siitä, oletko saapuva vai lähtevä, onko sinulla kehityskapasiteettia, ja onko HIPAA merkityksellinen. Viisi käyttö tapausta, viisi vastausta:

  • Halvin vakava lähtevä (kylmäsoitto): Bland. Kiinteä 0,09 $/min, läpinäkyvä siirtomaksu, ei LLM-yllätyksiä. Ohita, jos tarvitset syvää RAGia tai räätälöityjä työkaluja.
  • Halvin saapuva (tuen ohjaus): Retell. Paketoitu, HIPAA mukana, kypsä analytiikka, 0,12–0,18 $ kokonaisuudessaan. Ohita, jos saapuva volyymisi on alle 200 puhelua/kk (katso edellinen osio).
  • Maksimaalinen kontrolli + räätälöity RAG: Vapi BYOK. Vain jos sinulla on kehityskapasiteettia hallinnoimaan LLM-, TTS- ja STT-avaimia. Kontrolli on 0,27 $/min arvoinen vain, kun voit neuvotella operaattorin ja LLM:n alas volyymilla.
  • Paketoitua yksinkertaisuutta skaalassa: Deepgram Voice Agent. 4,50 $/h (0,075 $/min) kiinteä, hakutulosten aliarvostetuin vaihtoehto. Ohita, jos tarvitset ElevenLabsin laajaa äänikirjastoa.
  • Keskustelulaadun mittari (myyntidemoit, brändiherkät prosessit): ElevenLabs Conversational. Turbo- tai Premium-äänet 0,10–0,12 $/min. Maksa lisä, kun äänenlaatu on konversiovipu.

Syvempään yrityspuolen toimialaleikkaukseen katso AI voice agents for enterprise call centers: sama matematiikka, ravintola- ja klinikka-alojen volyymiolettamuksilla.

Miten Techsy lähestyy ääniagenttien kustannusmallinnusta

Emme myy äänialustaa. Rakennamme tuotannon ääniagentteja asiakkaille Retellin, Vapin, Deepgramin ja OpenAI Realtimen päälle. Se tarkoittaa, että kun mallinnamme kustannuksia uudelle projektille, ajamme tco_per_minute()-kaavan kolmella volyymitasolla (1k, 10k, 100k min/kk) ennen pinon suosittelemista. Alusta, joka voittaa 1k:ssa, häviää usein 100k:ssa.

Neuvottelemme Twilion alitilien hinnoittelua asiakkaille, jotka ylittävät 100k min/kk (alitilit avaavat volyymitasoja, joita useimmat tiimit eivät tiedä olevan olemassa), ja mallinnamme aina prompt caching -säästöt Realtime-rakennelmissa ennen kuin hyväksymme suoran infrastruktuurin suunnittelun. Puolet asiakkaiden kustannusmallinnustyöstämme on jonkun toimittajan blogikirjoituksesta tekemien oletusten purkamista.

Haluatko ääniagentin rakennettavan alusta loppuun alustalla, joka todella voittaa volyymissäsi? Katso miten rakennamme ääniagentteja →

UKK

Paljonko AI-ääniagentti maksaa minuutilta vuonna 2026? Kokonaiskustannus vaihtelee 0,07–0,30 dollarin välillä minuutilta. Paketoidut alustat (Retell, Bland, ElevenLabs Conversational) päätyvät 0,10–0,18 $/min, kun puhelinsiirto on mukana. BYOK-alustat kuten Vapi päätyvät 0,13–0,31 $/min, kun LLM-, TTS-, STT- ja Twilio-kulut lisätään. Suora OpenAI Realtime on lähellä 0,30 $/min raakana tai noin 0,12 $/min, kun järjestelmäpromptteihin käytetään prompt cachingia.

Mikä on halvin AI-ääniagenttialusta? Lähtevissä puheluissa Bland AI 0,09 $/min kiinteällä hinnalla on markkinoiden selkein matematiikka. Saapuvassa tuessa Retell 0,10–0,16 $ kokonaisuudessaan voittaa yleensä paketoitujen HIPAA- ja samanaikaisuustasojen ansiosta. Puhtaassa infrastruktuurissa välimuistilla OpenAI Realtime voi pudota alle 0,15 $/min. Deepgram Voice Agent 0,075 $/min kiinteällä hinnalla on aliarvostetuin vaihtoehto.

Miksi Vapi-laskuni on suurempi kuin 0,05 $/min? Vapin hinnoittelusivun 0,05 $/min luku on vain alustamaksu. Vapi on BYOK: tuot omat avaimesi LLM:lle (GPT-4o-mini, Claude jne.), TTS:lle (ElevenLabs, PlayHT), STT:lle (Deepgram) ja puhelinsiirrolle (Twilio). Todellinen kokonaishinta asettuu 0,13–0,31 $/min riippuen valitsemastasi äänestä ja mallista.

Mikä on BYOK- ja paketoidun hinnoittelun ero? Paketoidut alustat (Retell, Bland, Synthflow, ElevenLabs Conversational) sisältävät LLM:n, STT:n ja TTS:n yhdessä minuuttihinnassa. BYOK-alustat (Vapi) veloittavat vain orkestroinnista; tuot omat API-avaimesi kaikelle muulle ja saat erillisen laskun jokaiselta toimittajalta. Paketoitu on yksinkertaisempi; BYOK antaa sinulle kontrollin ja neuvotteluvaraa skaalassa.

Onko AI-ääniagenttien hinnoittelussa piilomaksuja? Kyllä, seitsemän yleistä. HIPAA-lisät (2 000 $/kk Vapissa), minuuttipyöristys (5–8 % tehollinen korotus skaalassa), puhelinnumeroiden vuokrat (1–2 $/kk), samanaikaisuusmaksut (8 $/samanaikaisuus/kk Retell), siirtomaksut (0,025 $/min Bland), tietokantamaksut (8 $/kk per tietokanta Retellissa) ja premium-äänten lisämyynti (+0,04 $/min ElevenLabs Premium Turboon verrattuna).

Onko OpenAI Realtime API Vapia halvempi? Ilman prompt cachingia ei: OpenAI Realtime maksaa noin 0,30 $/min raakaa äänikustannusta. Kun prompt caching on käytössä (välimuistitetut järjestelmäpromptti-tokenit 0,40 $/M vs 32 $/M tuoreena, 80-kertainen alennus), järjestelmäpromptin kuluerä romahtaa ja kokonaishinta putoaa noin 0,12–0,15 $/min. Se tekee siitä kilpailukykyisen paketoitujen alustojen kanssa yli 10k minuutissa/kk.

Miten ennustan ääniagenttini kuukausikustannuksen? Arvioi puhelut kuukaudessa kerrottuna keskimääräisellä puhelun kestolla minuuteissa. Kerro alustasi kokonais-$:lla minuutilta. Lisää kiinteät kuukausikulut: puhelinnumeroiden vuokrat, tietokantamaksut, samanaikaisuuden perustaso, HIPAA-lisä tarvittaessa. Yllä oleva tco_per_minute() Python-funktio automatisoi tämän yhdellä funktiokutsulla, jonka voit liittää Jupyter-muistikirjaan.

Minuutti- vai sekuntilaskutus: kumpi on halvempi? Sekuntilaskutus on merkittävästi halvempi lyhyissä lähtevissä puheluissa. 61 sekunnin puhelu, joka laskutetaan 60 sekunnin jaksoissa, veloittaa 2 minuuttia — se on 5–8 prosentin tehollinen vero 5 000 puhelussa kuukaudessa tyypillisellä lyhytpuhelujakaumalla. Bland ja Deepgram laskuttavat sekunneittain; useimmat BYOK-alustat perivät Twilion 60 sekunnin pyöristyksen oletuksena.

Onko ilmaisia AI-ääniagentteja? Ilmaisia kokeiluja on olemassa: useimmat toimittajat tarjoavat 10–60 ilmaista minuuttia (Retell, Vapi, Bland) testaukseen. Todellisia ilmaisia tuotantotason ääniagentteja ei ole, koska operaattoriminuutit on aina maksettava vähintään (0,014 $/min Twilio US:n lähtevissä). Jopa itse isännöidyt avoimen lähdekoodin pinot (Pipecat, LiveKit Agents) jättävät sinut maksamaan teleoperaattorille ja LLM:lle.

Mikä on ääni-AI:n ROI ihmiseen verrattuna? Ihmisen kustannukset ovat 15–30 $/h täysin kuormitettuna, mikä tarkoittaa 0,25–0,50 $/min. Ääni-AI 0,10–0,20 $/min voittaa ihmisen kustannukset noin 200 puhelun jälkeen kuukaudessa, olettaen vertailukelpoiset ratkaisuasteet. Alle sen volyymin alustojen minimimaksut ja numerovuokrien yleiskulut tekevät ihmisestä plus 19 $/kk SaaSista halvemman vastauksen.


Tätä opasta ylläpitää Techsyn toimitustiimi. Rakennamme tuotannon AI-ääniagentteja Retellin, Vapin ja OpenAI Realtimen päälle asiakkaille; nämä luvut tulevat viikoittain tekemästämme kustannusmallinnustyöstä, eivät toimittajien esitteistä. Hinnat varmennettu toukokuussa 2026; varmista aina toimittajan hinnoittelusivuilta ennen sopimusta.

Aihepiirit

tekoäly-puheagentti-hinnoittelupuhe-tekoälyretell-aivapibland-aillm-kustannuksetopenai-realtime

Jaa tämä artikkeli

Aiheeseen liittyvät julkaisut

Lisää aiheesta ai-machine-learning

ai-machine-learning
Jul 20, 2026

8 parasta tekoälypohjaista web scraping -APIa vuonna 2026 (testattu omalla agenttipinollamme)

Testasimme 8 tekoälypohjaista web scraping -APIa todellisilla vuoden 2026 hinnoilla, jotka haimme oman agenttipinomme kautta. Firecrawl, Bright Data, ScrapingBee ja 5 muuta – sijoitettuna LLM-valmiin tulosteen, bottitorjunnan ja MCP-tuen mukaan.

9 min read lukuaika
Lue
ai-machine-learning
Jul 20, 2026

Kehitystyön prompt-suunnittelu: 7 mallia, joita käytämme päivittäin Claude Codessa ja Cursorissa (2026)

Useimmat 'tekoälyn koodausprompteja' käsittelevät artikkelit tarjoavat 50 valmista mallia kopioitavaksi. Tämä opettaa 7 mallia, joita käytämme joka päivä 16 agentin Claude Code -putkiston ajamiseen, mukana todelliset ennen-jälkeen-esimerkit kustakin sekä tieto siitä, missä kukin malli sijaitsee Claude Codessa, Cursorissa ja Copilotissa vuonna 2026.

11 min read lukuaika
Lue
ai-machine-learning
Jul 19, 2026

AI PoC:sta tuotantoon: 12 kohdan tarkistuslista ennen julkaisua

Toimiva AI-demo ei ole tuotantojärjestelmä. Tämä 12 kohdan tarkistuslista käy läpi kolme vaihetta, jotka jokainen AI-ominaisuus tarvitsee ennen julkaisua: kovennus, vakauttaminen ja käyttöönotto, sekä konkreettiset rajat kustannuskatoille, käyttörajoituksille, vararatkaisuille ja palautuksen laukaisijoille.

10 min read lukuaika
Lue
Katso kaikki julkaisut
Aloita projekti

Valmiina rakentamaan jotain erinomainen?

Muutetaan visiosi todellisuudeksi. Tiimimme on valmis auttamaan sinua luomaan ohjelmistoja, joilla on todellinen vaikutus.

Varaa lyhyt suunnittelukeskusteluKatso töitämme

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä

Juridiset asiat

  • Tietosuopolitiiikka
  • Käyttöehdot
  • Evästekäytäntö

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä
Juridiset asiatTietosuopolitiiikkaKäyttöehdotEvästekäytäntö
TECHSY
© 2026 Techsy. Kaikki oikeudet pidätetään.