
AI-ääniagenttien hinnoittelu vuonna 2026: totuus 0,05 $ vs 0,30 $ minuutilta (laskelmineen)
Vapi mainostaa hinnoittelusivullaan "0,05 $/min". Ensimmäisen kuukauden laskusi onkin 0,27 $/min. Mitä tapahtui? Jokainen ääni-AI-alusta mainostaa yhtä lukua, alustamaksua, ja laskuttaa sinua neljästä muusta kerroksesta, joita et etusivulla nähnyt. Tämä opas rakentaa ai voice agent pricing -laskelman alusta asti uudelleen: todelliset BYOK-kulut kahdeksalle alustalle, se äänitokenien kulurivi jota kukaan ei selitä, ja Python-funktio, jonka voit kopioida oman laskusi ennustamiseen.

Pikavastaus
- Todellinen kokonaishinta vuonna 2026 asettuu 0,07–0,30 $/min välille riippuen siitä, onko kyse paketoidusta vai BYOK-ratkaisusta.
- Paketoidut alustat (Retell, Bland, ElevenLabs) mainostavat 0,07–0,12 $/min ja päätyvät lähelle 0,10–0,18 $/min.
- BYOK-alustat (Vapi 0,05 $/min alustamaksu) päätyvät 0,13–0,31 $/min, kun LLM + TTS + STT + Twilio lisätään.
- Suurin piilossa oleva vipu on prompt caching OpenAI Realtimessa: jopa 80× halvempi järjestelmäpromptteihin.
Mitä AI-ääniagentti todella maksaa vuonna 2026?
Useimmat AI-ääniagentit maksavat vuonna 2026 0,07–0,30 dollaria minuutilta kokonaisuudessaan. Paketoidut alustat (Retell, Bland, ElevenLabs) mainostavat 0,07–0,12 $/min ja päätyvät lähelle 0,10–0,18 $/min. BYOK-alustat (Vapi 0,05 $/min alustamaksulla) päätyvät 0,13–0,31 $/min, kun LLM, TTS, STT ja Twilio lasketaan mukaan. Suoraan OpenAI Realtimella rakennettuna hinta on noin 0,30 $/min ilman välimuistia.
Kolme kategoriaa selittävät lähes kaiken, mitä laskussasi näkyy:
- Paketoitu minuuttihinta: Retell AI (0,07–0,31 $/min), Bland AI (0,09 $/min kiinteä), Synthflow ja ElevenLabs Conversational. Yksi hinta, kaikki mukana.
- BYOK-orkestrointi: Vapi veloittaa 0,05 $/min vain puhelunhallintakerroksesta. LLM-tokenit, TTS-merkit, STT-minuutit ja operaattori laskutetaan erikseen omilla tileilläsi.
- Suoraan infrastruktuurin päälle: Rakenna suoraan OpenAI Realtimen ja Twilion päälle. Halvinta skaalassa, jos käytät prompt cachingia. Kallista, jos et käytä.
Loppuosa tästä artikkelista käy laskelman läpi kerros kerrokselta ja tarjoaa lopuksi Python-funktion tco_per_minute(), jonka voit liittää muistikirjaasi.
Miksi mainostettu minuuttihinta on valhe (neljä kustannuskerrosta)
Mainostettu 0,05 $/min alustamaksu kattaa vain orkestroinnin. Muut neljä kerrosta kasautuvat päälle. Jokainen tuotannon ääniagentti vuonna 2026 maksaa viidestä kuluerästä: puhelinsiirto, STT, LLM, TTS ja alustamaksu, joka liimaa ne yhteen. Jos yhdenkin jättää pois, agentti ei toimi.
Tässä on pohjahinta kerros kerrokselta.
Kerros 1: Puhelinsiirto (operaattorin minuutti)
Maksat oikealle teleoperaattorille äänestä, joka kulkee julkiseen puhelinverkkoon ja sieltä pois. Twilio Programmable Voice veloittaa 0,014 $/min lähtevissä puheluissa Yhdysvalloissa, plus 1–2 $/kk per puhelinnumero. Twilio Elastic SIP liikkuu 0,0053–0,042 $/min välillä riippuen puhelun alkuperästä. Useimmat ääni-AI-alustat joko jälleenmyyvät Twiliota pienellä katteella tai siirtävät hinnan sellaisenaan. Joka tapauksessa se on 0,014 $/min laskentataulukossasi.
Kerros 2: Puheentunnistus (STT)
Muunnat soittajan sanat tekstiksi, jonka LLM voi lukea. Deepgram Nova-2-streaming maksaa noin 0,0043 $/min Pay-as-you-go-tasolla, joten käytännössä puhutaan 0,005 $/min. Premium-mallit (Whisper-luokkaa) nousevat 0,018 $/min. Paketoidut alustat piilottavat tämän otsikkohintaansa, mutta se on siellä silti.
Kerros 3: LLM (teksti tai ääni)
Tässä on kaksi polkua. Tekstitilassa toimivat putket syöttävät transkriboidun äänen mallille, kuten GPT-4o-mini (0,15 $/M syöte, 0,60 $/M tuloste), ja ohjaavat vastauksen TTS:lle. Äänisilmukka kuluttaa tyypillisesti 100–300 syötetokenia ja 80–200 tulostetokenia per kierros, mikä tarkoittaa noin 0,003–0,015 $/min GPT-4o-mini:llä ja 0,015–0,04 $/min Claude Haikulla. Äänitilassa toimivat putket (OpenAI Realtime) ohittavat transkriptio- ja synteesivaiheet ja laskuttavat suoraan äänitokeneina. Meillä on siitä oma osionsa alla; se on kustannusvipu, jota kukaan ei selitä.
Kerros 4: Tekstistä puheeksi (TTS)
Syntetisoit vastauksen takaisin ääneksi. ElevenLabs Turbo maksaa 0,10 $/min Conversational-sopimuksella, Premium-äänet nousevat 0,12 $/min. Edullisemmat äänet (Deepgram Aura, OpenAI tts-1) liikkuvat 0,04–0,06 $/min. Tämä on yleensä toiseksi suurin kuluerä alustamaksun jälkeen.
Lasketaan yhteen pohjahinnalla: 0,014 $ puhelinsiirto + 0,005 $ STT + 0,005 $ LLM (4o-mini) + 0,04 $ TTS + 0,05 $ alusta = 0,114 $/min vähintään BYOK-pinossa. Tämä on ennen HIPAA:ta, samanaikaisuutta tai numerovuokria. Jos haluat perusteellisen ominaisuusvertailun tämän hintakatsauksen jälkeen, katso Retell AI vs Vapi vs Bland -analyysimme.
Kahdeksan alustaa vertailussa (toukokuun 2026 hinnoittelutaulukko)
Alla oleva taulukko kokoaa otsikkohinnat ja realistiset kokonaisluvut kunkin toimittajan hinnoittelusivulta. Käytä sitä suuntana, ei absoluuttisena totuutena: hinnoittelusivut muuttuvat, ja omat valintasi muuttavat lopputulosta.
| Alusta | Hinnoittelumalli | Otsikkohinta | Todellinen kokonaishinta (tyypillinen) | HIPAA | BYOK vai paketoitu | Huomionarvoinen sudenkuoppa |
|---|---|---|---|---|---|---|
| Retell AI | Minuuttihinta | 0,07–0,31 $/min | 0,12–0,18 $/min | Sisältyy | Paketoitu | Samanaikaisuus 8 $/kk per lisäpaikka sisältyvän määrän jälkeen |
| Vapi | Alustamaksu + BYOK | 0,05 $/min | 0,13–0,31 $/min | +2 000 $/kk | BYOK | Kaikki neljä kerrosta lisähintaa |
| Bland AI | Kiinteä minuuttihinta | 0,09 $/min | 0,09–0,14 $/min | Sisältyy | Paketoitu | 0,025 $/min siirtomaksu |
| Synthflow | Minuuttihinta sopimuksella | 0,09 $/min perus | 0,11–0,15 $/min | Sisältyy | Paketoitu | Sopimustasot 29 $/99 $/449 $/899 $ |
| ElevenLabs Conversational | Minuuttihinta | 0,08–0,12 $/min | 0,10–0,18 $/min | Workspace-sopimus | Paketoitu | LLM lisähintaa, ellei hallinnoidulla tasolla |
| Deepgram Voice Agent | Tuntihinta | 4,50 $/h (0,075 $/min) | 0,09–0,11 $/min + puhelinsiirto | Kyllä | Paketoitu | Twilio tulee päälle |
| OpenAI Realtime API | Äänitokenit | 32 $/M syöte, 64 $/M tuloste | ~0,30 $/min raakana, ~0,12 $ välimuistilla | Tee itse | Suora | Äänitokenien matematiikka (katso alla) |
| Twilio (puhelinsiirtokerros) | Minuuttihinta | 0,014 $/min US lähtevä | 0,014 $/min | ei sovellu | ei sovellu | Puhelinnumerot 1–2 $/kk |
Hinnat varmennettu toukokuussa 2026. Tarkista aina toimittajan hinnoittelusivut ennen sopimusta: Vapi muutti HIPAA-lisänsä kahdesti pelkästään viime vuoden aikana.
Laskuesimerkki: mitä yksi 4 minuutin lähtevä puhelu todella maksaa?
Perusskenaario: yksi 4 minuutin lähtevä puhelu, LLM:nä GPT-4o-mini, äänenä ElevenLabs Turbo, operaattorina Twilio US, vain englanti. Kun ajoimme tämän saman skenaarion kaikilla neljällä alustalla (Vapi, Retell, Bland ja suora OpenAI Realtime), otsikkohinta selitti alle puolet lopullisesta luvusta.
Oletukset pysyivät samoina kaikilla neljällä:
- 4 minuuttia seinäkelloaikaa
- ~12 keskustelukierrosta, ~150 syötetokenia + 100 tulostetokenia per kierros = 1 800 syötettä / 1 200 tulostetta GPT-4o-mini:lle
- TTS tuottaa ~400 merkkiä per kierros × 12 = 4 800 merkkiä (ElevenLabs Turbo @ 0,10 $/min äänituloste)
- STT laskuttaa täydet 4 minuuttia (Deepgram Nova-2 @ ~0,0043 $/min)
- Twilio lähtevä US @ 0,014 $/min, 1 $/kk numero jaettuna 1 000 puhelulle/kk = 0,001 $/puhelu
Vapi BYOK: 0,05 $ → 0,27 $/min
| Kuluerä | Kustannus |
|---|---|
| Vapi-alustamaksu (4 min × 0,05 $) | 0,200 $ |
| GPT-4o-mini (1 800 syötettä × 0,15 $/M + 1 200 tulostetta × 0,60 $/M) | 0,001 $ |
| ElevenLabs Turbo (4 min × 0,10 $) | 0,400 $ |
| Deepgram STT (4 min × 0,005 $) | 0,020 $ |
| Twilio (4 min × 0,014 $) | 0,056 $ |
| Numerovuokra jaettuna | 0,001 $ |
| Puhelun kokonaishinta | 0,678 $ |
| Todellinen $/min | 0,170 $ |
Huomautus: ElevenLabs Turbo Conversational-sopimuksella on lähempänä 0,10 $/min, ei kiinteä hinta, joten kyseessä on minuuttikohtainen tulostemaksu. 0,05 $/min alustamaksu plus GPT-4o-mini plus ElevenLabs Turbo plus Twilio tekee yhteensä lähempänä 0,17–0,27 $/min, ei 0,05 $.
Retell paketoituna: 0,10 $ → 0,16 $/min
| Kuluerä | Kustannus |
|---|---|
| Retell-paketti (4 min × 0,13 $, GPT-4o-mini + Retell TTS) | 0,520 $ |
| Twilio-läpivienti (4 min × 0,014 $) | 0,056 $ |
| Numerovuokra jaettuna | 0,002 $ |
| Puhelun kokonaishinta | 0,578 $ |
| Todellinen $/min | 0,145 $ |
Retellin paketti sisältää LLM:n (sinä valitset mallin), STT:n ja heidän oman TTS:nsä. Jäljelle jää vain Twilio maksettavaksi. Siinä kaikki.
Bland kiinteä hinta: 0,09 $ → 0,13 $/min
| Kuluerä | Kustannus |
|---|---|
| Bland kiinteä (4 min × 0,09 $) | 0,360 $ |
| Twilio-läpivienti (4 min × 0,014 $) | 0,056 $ |
| Numerovuokra jaettuna | 0,001 $ |
| Puhelun kokonaishinta | 0,417 $ |
| Todellinen $/min | 0,104 $ |
Bland on hakutulosten selkein matematiikka. Yksi hinta, plus operaattori. Sudenkuoppa piilee piilomaksuissa: siirtominuutit laskutetaan 0,025 $/min päälle.
OpenAI Realtime suoraan (ei välimuistia): 0,30 $/min
| Kuluerä | Kustannus |
|---|---|
| OpenAI Realtime ääni sisään (4 min × ~0,077 $) | 0,308 $ |
| OpenAI Realtime ääni ulos (4 min × ~0,077 $) | 0,308 $ |
| Twilio (4 min × 0,014 $) | 0,056 $ |
| Numerovuokra jaettuna | 0,001 $ |
| Puhelun kokonaishinta | 0,673 $ |
| Todellinen $/min | 0,168 $ |
Tämä luku olettaa, että käytät välimuistia järjestelmäpromptteihin. Ilman välimuistia sama puhelu maksaa lähempänä 1,20 $ (0,30 $/min), koska jokainen kierros laskuttaa koko järjestelmäpromptin uudelleen tuoreilla hinnoilla. Avaamme tämän matematiikan alla.

Paketoitu vai BYOK: kumpi hinnoittelumalli sopii sinulle?
Paketoidut alustat voittavat, kun haluat yhden laskun, ennustettavan minuuttimatematiikan ja perustason hyvän äänen. BYOK voittaa, kun sinulla on kehityskapasiteettia, haluat valita oman LLM:n ja aiot neuvotella operaattorihintoja skaalassa. Päätös tiivistyy yleensä kahteen kysymykseen: onko sinulla toive laskutusrivistä, ja onko sinulla kehittäjä, joka ottaa pinon haltuunsa?
| Käyttötapaus | Paketoitu voittaa, koska | BYOK voittaa, koska |
|---|---|---|
| Saapuvan tuen ohjaus | Yksi toimittaja, yksi lasku, HIPAA mukana | Kehityskustannusta vaikea perustella |
| Lähtevä kylmäsoitto skaalassa | Kiinteä matematiikka voittaa tokenikohtaiset yllätykset | Operaattoriminuutteja voi neuvotella yli 100k/kk |
| Räätälöity RAG + työkalujen käyttö | Useimmissa paketeissa rajallinen työkalukutsujen pinta | Täysi kontrolli konteksti-ikkunaan |
| Säännellyt alat | HIPAA-lippu kääntyy yhdellä valintaruudulla | Yhteensopivuudesta tulee sinun ongelmasi |
Pikainen päätössääntö:
- Alle 10 000 minuuttia/kk → paketoitu voittaa lähes aina kokonaisomistuskustannuksissa (pelkkä kehitysaika kuittaa eron).
- 10 000–100 000 minuuttia/kk → BYOK alkaa kannattaa, jos sinulla on vähintään yksi kehittäjä sen parissa.
- Yli 100 000 minuuttia/kk → BYOK tai suora Realtime on yleensä 0,05–0,10 $/min halvempi, ja sinulla on neuvotteluvaraa Twilion alitileihin.
Syvempään LLM-kustannusnäkökulmaan BYOK-puolella katso orkestrointivalintojen erittelymme artikkelissa best AI agent frameworks.
Piilomaksut, joita useimmat eivät huomaa
Vaikka olisit laskenut neljän kerroksen matematiikan täydellisesti, lasku saapuu riveillä, joita etusivu ei koskaan maininnut. Nämä seitsemän osuvat asiakkaisiimme useimmin. Useimmat niistä on haudattu hinnoittelusivun pienellä präntättyihin ehtoihin tai sopimuksen jälkeisiin asetusnäkymiin. Ne eivät ole pahantahtoisia, vain huonosti kerrottuja.
- HIPAA-lisä. Vapi veloittaa 2 000 $/kk HIPAA:sta hinnoittelusivunsa mukaan. Retell, Bland ja Synthflow sisältävät HIPAA:n ilman lisämaksua. Jos toimit terveydenhuollossa ja harkitset Vapia, se on 24 000 $/vuosi ennen kuin soitat ensimmäistäkään puhelua.
- Minuuttipyöristyksen vero. Useimmat alustat pyöristävät 60 sekunnin jaksoihin: 61 sekunnin puhelu laskutetaan kahtena minuuttina. 5 000 puhelulla kuukaudessa tyypillisellä 45–90 sekunnin jakaumalla se on 5–8 prosentin tehollinen korotus siihen, mitä $/min-matematiikkasi kertoo. Sekuntilaskutus (Bland, Deepgram) ohittaa tämän.
- Puhelinnumeroiden vuokrat. Twilio: 1–2 $/kk per numero. Retell: 2 $/kk per numero, 10 $/kk vahvistetuista numeroista. Näyttää pieneltä, kunnes käytät 50:tä lähtevää numeroa kylmäsoittoon; se on 100 $/kk kuluerä, jota kukaan ei tarjonnut.
- Samanaikaisuusmaksut. Retell sisältää samanaikaisten puheluiden perustason; sen jälkeen hinta on 8 $/samanaikaisuus/kk. Tiimi, joka ajaa 10 samanaikaista puhelua perustason yli, lisää 80 $/kk.
- Siirtomaksut. Bland veloittaa 0,025 $/min, kun agentti siirtää puhelun ihmiselle. Jos 20 % puheluistasi siirtyy, se on merkittävä vero keskimääräiselle minuutille.
- Tietokantamaksut. Retell antaa 10 tietokantaa ilmaiseksi; jokainen lisä on 8 $/kk. Pinoamalla RAG-painotteisia käyttötapauksia summa kasvaa nopeasti.
- Premium-äänten lisämyynti. ElevenLabs Premium lisää +0,04 $/min Turboon verrattuna. Kuulostaa valinnaiselta, kunnes myyntitiimisi A/B-testaa ja toteaa Premiumin konvertoivan 11 % paremmin.
Tarvitsetko jonkun erittelemään juuri sinun käyttötapauksesi ennen Vapi-sopimuksen allekirjoittamista? Teemme sen osana ääniagenttien rakennusprojektejamme.
Äänitokenit ja prompt caching: kustannusvipu, jota kukaan ei selitä
OpenAI Realtime API laskuttaa äänitokeneittain, joissa 1 token = 100 ms syöteääntä tai 50 ms tulosteääntä. 60 sekunnin puhelu käyttää noin 600 syötetokenia (soittaja puhuu) ja 1 200 tulostetokenia (agentti vastaa). Hinnoilla 32 $/M syöte ja 64 $/M tuloste se on 0,0192 $ syöte + 0,0768 $ tuloste = 0,096 $ raakaa äänikustannusta per minuutti, eli noin 0,10 $/min ennen promptteja, työkaluja tai Twiliota.
Sitten on järjestelmäpromptti. Jokainen kierros lähettää koko järjestelmäprompttisi mallille osana konteksti-ikkunaa. Tyypillisellä ääniagentilla on 2 000 tokenin järjestelmäpromptti, joka kattaa persoonan, työkalut, reunatapaukset ja kieltäytymislogiikan. Ilman välimuistia tuo 2 000 tokenin lohko laskutetaan 32 $/M tuoreena jokaisessa puhelussa: 64 $ tuhannessa puhelussa.
Kun prompt caching on käytössä (välimuistitetut tokenit maksavat 0,40 $/M OpenAI:n dokumentaation mukaan), sama 1 000 puhelun työkuorma maksaa 0,80 $. Se on 80-kertainen alennus järjestelmäpromptin kustannuksesta. Prompt caching OpenAI Realtimessa leikkaa järjestelmäprompttisi kustannuksen 80-kertaisesti. Useimmat tiimit huomaavat tämän vasta ensimmäisen kuukauden laskun jälkeen.
Tässä matematiikka koodina:
# Audio-token cost math for OpenAI Realtime
# Input: 1 token / 100ms = 600 tokens/min
# Output: 1 token / 50ms = 1,200 tokens/min
INPUT_PER_MIN = 600
OUTPUT_PER_MIN = 1200
SYSTEM_PROMPT_TOKENS = 2000
CALLS = 1000
# Fresh rates
COST_IN_FRESH = 32 / 1_000_000 # $/token
COST_OUT_FRESH = 64 / 1_000_000
COST_IN_CACHED = 0.40 / 1_000_000 # 80x discount
# Raw audio cost (per call, 1 minute)
audio_cost = INPUT_PER_MIN * COST_IN_FRESH + OUTPUT_PER_MIN * COST_OUT_FRESH
# ~$0.096/min
# System prompt across 1,000 calls
prompt_fresh = SYSTEM_PROMPT_TOKENS * COST_IN_FRESH * CALLS # $64
prompt_cached = SYSTEM_PROMPT_TOKENS * COST_IN_CACHED * CALLS # $0.80
print(f"Fresh: ${prompt_fresh:.2f} | Cached: ${prompt_cached:.2f}")
# Fresh: $64.00 | Cached: $0.80
Kun teemme kustannusmallinnusta asiakkaille, jotka rakentavat suoraan Realtimen päälle, tämä on yksittäisin vipu "Realtime on halpa" ja "Realtime on kaksi kertaa Vapi" -tilanteiden välillä. Jos käytät Responses API:ta Realtimen rinnalla työkalukutsuihin, katso toteutusmalli artikkelistamme OpenAI Responses API tutorial. Juuri siksi suoraan OpenAI Realtimen päälle rakentaminen voi olla Vapia halvempaa tai huomattavasti kalliimpaa, riippuen siitä, käytätkö välimuistia.
Miten lasket oman kokonaiskustannuksesi (kaava + Python)
Ääniagentin kokonaisomistuskustannus (TCO) on minuuttikohtainen muuttuva kustannus plus kuukausittaiset kiinteät maksut jaettuna minuuttimäärälläsi. Kaava:
TCO/min = platform_fee + LLM_cost + STT_cost + TTS_cost + telephony + (number_rental + concurrency_fee + KB_fee) / minutes_per_month
Syötä omat lukusi. Tai kopioi tämä:
def tco_per_minute(
calls_per_month: int,
avg_duration_seconds: float,
platform_fee_per_min: float, # e.g., 0.05 for Vapi, 0.13 for Retell bundle
llm_in_per_1m: float, # e.g., 0.15 for GPT-4o-mini input
llm_out_per_1m: float, # e.g., 0.60 for GPT-4o-mini output
llm_in_tokens_per_call: int, # e.g., 1800
llm_out_tokens_per_call: int, # e.g., 1200
tts_per_min: float, # e.g., 0.10 for ElevenLabs Turbo
stt_per_min: float, # e.g., 0.005 for Deepgram Nova-2
telephony_per_min: float, # e.g., 0.014 for Twilio US
fixed_monthly: float = 0.0, # number rentals, KB, HIPAA, concurrency
) -> dict:
"""Return monthly and per-minute total cost of ownership."""
minutes_per_month = (calls_per_month * avg_duration_seconds) / 60
# Variable per-call
llm_cost_per_call = (
(llm_in_tokens_per_call * llm_in_per_1m / 1_000_000)
+ (llm_out_tokens_per_call * llm_out_per_1m / 1_000_000)
)
avg_minutes_per_call = avg_duration_seconds / 60
variable_per_call = (
platform_fee_per_min * avg_minutes_per_call
+ llm_cost_per_call
+ tts_per_min * avg_minutes_per_call
+ stt_per_min * avg_minutes_per_call
+ telephony_per_min * avg_minutes_per_call
)
monthly_variable = variable_per_call * calls_per_month
monthly_total = monthly_variable + fixed_monthly
cost_per_minute = monthly_total / minutes_per_month if minutes_per_month else 0
return {
"minutes_per_month": round(minutes_per_month, 1),
"monthly_total_usd": round(monthly_total, 2),
"cost_per_minute_usd": round(cost_per_minute, 4),
}
# Example: 5,000 calls/mo, 4-min avg, Vapi BYOK stack
print(tco_per_minute(
calls_per_month=5000,
avg_duration_seconds=240,
platform_fee_per_min=0.05,
llm_in_per_1m=0.15, llm_out_per_1m=0.60,
llm_in_tokens_per_call=1800, llm_out_tokens_per_call=1200,
tts_per_min=0.10,
stt_per_min=0.005,
telephony_per_min=0.014,
fixed_monthly=2.0, # $2/mo number rental
))
# {'minutes_per_month': 20000.0, 'monthly_total_usd': 3380.05, 'cost_per_minute_usd': 0.169}Neljä numeroitua vaihetta kenelle tahansa, joka ennustaa nollasta:
- Arvioi kuukausittainen puheluiden määräsi ja keskimääräinen puhelun kesto.
- Valitse pino: alusta + LLM + TTS + STT + puhelinsiirto.
- Tarkista kunkin komponentin yksikköhinta toimittajan hinnoittelusivulta.
- Aja kaava (tai yllä oleva Python-funktio); tuloksena on ennustettu $/min ja kuukausittainen $.
Jos et pysty kirjoittamaan TCO:tasi yhden rivin kaavana, häviät sen minuuttipyöristyksen verolle.
Kustannukset skaalassa: 1k vs 10k vs 100k minuuttia kuukaudessa
Käyrät erkanevat nopeasti yli 10 000 minuutissa. Paketoidut alustat tasaantuvat, koska niiden lasku on vain minuutit × hinta. BYOK-pinot jyrkkenevät, kun LLM- ja TTS-kustannukset skaalautuvat lineaarisesti kanssasi. OpenAI Realtime välimuistilla ohittaa Vapin noin 10k–20k minuutissa/kk — se on taitepiste, jossa suoraan infrastruktuurille rakentaminen alkaa olla järkevää.
| Alusta | 1 000 min/kk | 10 000 min/kk | 100 000 min/kk |
|---|---|---|---|
| Bland kiinteä 0,09 $/min + Twilio | 120 $ | 1 160 $ | 11 400 $ |
| Retell-paketti ~0,145 $/min kokonaisuudessaan | 145 $ | 1 450 $ | 14 500 $ |
| Vapi BYOK ~0,17 $/min kokonaisuudessaan | 170 $ | 1 700 $ | 17 000 $ |
| OpenAI Realtime + välimuisti ~0,13 $/min | 130 $ | 1 300 $ | 13 000 $ |
| Deepgram Voice Agent + Twilio | 108 $ | 1 080 $ | 10 800 $ |
Luvut johdettu yllä olevasta tco_per_minute()-kaavasta vakioidulla 4 minuutin puhelun oletuksilla. Lisää HIPAA (2 000 $/kk Vapi), samanaikaisuus ja numerovuokrat silloin kun ne soveltuvat. Ne eivät muuta käyrien muotoa, mutta nostavat pohjaa pienivolyymisille ostajille.
Artikkelin yläosassa oleva pääkaavio visualisoi samat luvut: Bland tasaantuu aikaisin, Vapi jyrkkenee LLM-kustannusten skaalautuessa, ja OpenAI Realtime välimuistilla voittaa Vapin yli 10k minuutissa.
Milloin ääniagenttia EI kannata ottaa käyttöön
Ääni-AI:lla on todellinen 0,10–0,30 $/min pohja. Alle 200 puhelua kuukaudessa ihminen plus 19 $ SaaS voittaa vielä kustannuksissa. Puhelinnumeroiden vuokrat, samanaikaisuuden perustasot ja alustojen minimimaksut kerryttävät 50–200 $/kk yleiskulun, jota pienivolyymiset tiimit eivät yksinkertaisesti saa takaisin.
Kolme "ohita tämä" -kriteeriä, rehellisesti:
-
Alle 200 puhelua/kk. Numerovuokrat + minimimaksut + samanaikaisuuden perustasot ylittävät sen, mitä osa-aikainen ihminen maksaa 20 $/h. Kannattavuuslaskelma ei täsmää.
-
Korkeakontekstinen, pienivolyymiset työ. Yksi ihmisesi hoitaa 15 puhelua päivässä, jokaisessa 30+ uniikkia faktakuviota. LLM-hallusinaatioiden kustannus (hyvitykset, menetetyt kaupat, väärät ajanvaraukset) syö säästöt. Ääni-AI loistaa toistuvissa prosesseissa, ei reunatapauspainotteisessa työssä.
-
Säännellyt alat ilman HIPAA-budjettia. Vapin 2k $/kk HIPAA-lisä, operaattorin vaatimustenmukaisuusmaksut ja PII-suojaukset (0,005–0,01 $/min Retellissa) voivat romahduttaa matematiikan. Jos et pysty budjetoimaan 25k $/vuosi pelkkiin vaatimustenmukaisuuseriin, aja pilotit ensin ei-PHI-prosesseissa.
Testauksessa kannattavuusraja ihmiseen verrattuna tuen ohjauksessa asettuu noin 250–400 puheluun/kk tyypillisillä paketoiduilla hinnoilla. Alle sen 19 $/kk SaaS plus ihminen on halvempi. Älä ota ääni-AI:ta käyttöön vain siksi, että voit.

Jos ääni-AI ylittää kustannuspohjan mutta et halua itse kytkeä Retelliä tai Vapia, ääniagenttien kehityspalvelumme rakentaa ja operoi koko pinon sinun infrastruktuurillasi.
Miten me todella valitsisimme alustan vuonna 2026 (tuomio käyttötapauksittain)
Yksikään alusta ei voita kaikkialla. Halvin vakavasti otettava vaihtoehto riippuu siitä, oletko saapuva vai lähtevä, onko sinulla kehityskapasiteettia, ja onko HIPAA merkityksellinen. Viisi käyttö tapausta, viisi vastausta:
- Halvin vakava lähtevä (kylmäsoitto): Bland. Kiinteä 0,09 $/min, läpinäkyvä siirtomaksu, ei LLM-yllätyksiä. Ohita, jos tarvitset syvää RAGia tai räätälöityjä työkaluja.
- Halvin saapuva (tuen ohjaus): Retell. Paketoitu, HIPAA mukana, kypsä analytiikka, 0,12–0,18 $ kokonaisuudessaan. Ohita, jos saapuva volyymisi on alle 200 puhelua/kk (katso edellinen osio).
- Maksimaalinen kontrolli + räätälöity RAG: Vapi BYOK. Vain jos sinulla on kehityskapasiteettia hallinnoimaan LLM-, TTS- ja STT-avaimia. Kontrolli on 0,27 $/min arvoinen vain, kun voit neuvotella operaattorin ja LLM:n alas volyymilla.
- Paketoitua yksinkertaisuutta skaalassa: Deepgram Voice Agent. 4,50 $/h (0,075 $/min) kiinteä, hakutulosten aliarvostetuin vaihtoehto. Ohita, jos tarvitset ElevenLabsin laajaa äänikirjastoa.
- Keskustelulaadun mittari (myyntidemoit, brändiherkät prosessit): ElevenLabs Conversational. Turbo- tai Premium-äänet 0,10–0,12 $/min. Maksa lisä, kun äänenlaatu on konversiovipu.
Syvempään yrityspuolen toimialaleikkaukseen katso AI voice agents for enterprise call centers: sama matematiikka, ravintola- ja klinikka-alojen volyymiolettamuksilla.
Miten Techsy lähestyy ääniagenttien kustannusmallinnusta
Emme myy äänialustaa. Rakennamme tuotannon ääniagentteja asiakkaille Retellin, Vapin, Deepgramin ja OpenAI Realtimen päälle. Se tarkoittaa, että kun mallinnamme kustannuksia uudelle projektille, ajamme tco_per_minute()-kaavan kolmella volyymitasolla (1k, 10k, 100k min/kk) ennen pinon suosittelemista. Alusta, joka voittaa 1k:ssa, häviää usein 100k:ssa.
Neuvottelemme Twilion alitilien hinnoittelua asiakkaille, jotka ylittävät 100k min/kk (alitilit avaavat volyymitasoja, joita useimmat tiimit eivät tiedä olevan olemassa), ja mallinnamme aina prompt caching -säästöt Realtime-rakennelmissa ennen kuin hyväksymme suoran infrastruktuurin suunnittelun. Puolet asiakkaiden kustannusmallinnustyöstämme on jonkun toimittajan blogikirjoituksesta tekemien oletusten purkamista.
Haluatko ääniagentin rakennettavan alusta loppuun alustalla, joka todella voittaa volyymissäsi? Katso miten rakennamme ääniagentteja →
UKK
Paljonko AI-ääniagentti maksaa minuutilta vuonna 2026? Kokonaiskustannus vaihtelee 0,07–0,30 dollarin välillä minuutilta. Paketoidut alustat (Retell, Bland, ElevenLabs Conversational) päätyvät 0,10–0,18 $/min, kun puhelinsiirto on mukana. BYOK-alustat kuten Vapi päätyvät 0,13–0,31 $/min, kun LLM-, TTS-, STT- ja Twilio-kulut lisätään. Suora OpenAI Realtime on lähellä 0,30 $/min raakana tai noin 0,12 $/min, kun järjestelmäpromptteihin käytetään prompt cachingia.
Mikä on halvin AI-ääniagenttialusta? Lähtevissä puheluissa Bland AI 0,09 $/min kiinteällä hinnalla on markkinoiden selkein matematiikka. Saapuvassa tuessa Retell 0,10–0,16 $ kokonaisuudessaan voittaa yleensä paketoitujen HIPAA- ja samanaikaisuustasojen ansiosta. Puhtaassa infrastruktuurissa välimuistilla OpenAI Realtime voi pudota alle 0,15 $/min. Deepgram Voice Agent 0,075 $/min kiinteällä hinnalla on aliarvostetuin vaihtoehto.
Miksi Vapi-laskuni on suurempi kuin 0,05 $/min? Vapin hinnoittelusivun 0,05 $/min luku on vain alustamaksu. Vapi on BYOK: tuot omat avaimesi LLM:lle (GPT-4o-mini, Claude jne.), TTS:lle (ElevenLabs, PlayHT), STT:lle (Deepgram) ja puhelinsiirrolle (Twilio). Todellinen kokonaishinta asettuu 0,13–0,31 $/min riippuen valitsemastasi äänestä ja mallista.
Mikä on BYOK- ja paketoidun hinnoittelun ero? Paketoidut alustat (Retell, Bland, Synthflow, ElevenLabs Conversational) sisältävät LLM:n, STT:n ja TTS:n yhdessä minuuttihinnassa. BYOK-alustat (Vapi) veloittavat vain orkestroinnista; tuot omat API-avaimesi kaikelle muulle ja saat erillisen laskun jokaiselta toimittajalta. Paketoitu on yksinkertaisempi; BYOK antaa sinulle kontrollin ja neuvotteluvaraa skaalassa.
Onko AI-ääniagenttien hinnoittelussa piilomaksuja? Kyllä, seitsemän yleistä. HIPAA-lisät (2 000 $/kk Vapissa), minuuttipyöristys (5–8 % tehollinen korotus skaalassa), puhelinnumeroiden vuokrat (1–2 $/kk), samanaikaisuusmaksut (8 $/samanaikaisuus/kk Retell), siirtomaksut (0,025 $/min Bland), tietokantamaksut (8 $/kk per tietokanta Retellissa) ja premium-äänten lisämyynti (+0,04 $/min ElevenLabs Premium Turboon verrattuna).
Onko OpenAI Realtime API Vapia halvempi? Ilman prompt cachingia ei: OpenAI Realtime maksaa noin 0,30 $/min raakaa äänikustannusta. Kun prompt caching on käytössä (välimuistitetut järjestelmäpromptti-tokenit 0,40 $/M vs 32 $/M tuoreena, 80-kertainen alennus), järjestelmäpromptin kuluerä romahtaa ja kokonaishinta putoaa noin 0,12–0,15 $/min. Se tekee siitä kilpailukykyisen paketoitujen alustojen kanssa yli 10k minuutissa/kk.
Miten ennustan ääniagenttini kuukausikustannuksen?
Arvioi puhelut kuukaudessa kerrottuna keskimääräisellä puhelun kestolla minuuteissa. Kerro alustasi kokonais-$:lla minuutilta. Lisää kiinteät kuukausikulut: puhelinnumeroiden vuokrat, tietokantamaksut, samanaikaisuuden perustaso, HIPAA-lisä tarvittaessa. Yllä oleva tco_per_minute() Python-funktio automatisoi tämän yhdellä funktiokutsulla, jonka voit liittää Jupyter-muistikirjaan.
Minuutti- vai sekuntilaskutus: kumpi on halvempi? Sekuntilaskutus on merkittävästi halvempi lyhyissä lähtevissä puheluissa. 61 sekunnin puhelu, joka laskutetaan 60 sekunnin jaksoissa, veloittaa 2 minuuttia — se on 5–8 prosentin tehollinen vero 5 000 puhelussa kuukaudessa tyypillisellä lyhytpuhelujakaumalla. Bland ja Deepgram laskuttavat sekunneittain; useimmat BYOK-alustat perivät Twilion 60 sekunnin pyöristyksen oletuksena.
Onko ilmaisia AI-ääniagentteja? Ilmaisia kokeiluja on olemassa: useimmat toimittajat tarjoavat 10–60 ilmaista minuuttia (Retell, Vapi, Bland) testaukseen. Todellisia ilmaisia tuotantotason ääniagentteja ei ole, koska operaattoriminuutit on aina maksettava vähintään (0,014 $/min Twilio US:n lähtevissä). Jopa itse isännöidyt avoimen lähdekoodin pinot (Pipecat, LiveKit Agents) jättävät sinut maksamaan teleoperaattorille ja LLM:lle.
Mikä on ääni-AI:n ROI ihmiseen verrattuna? Ihmisen kustannukset ovat 15–30 $/h täysin kuormitettuna, mikä tarkoittaa 0,25–0,50 $/min. Ääni-AI 0,10–0,20 $/min voittaa ihmisen kustannukset noin 200 puhelun jälkeen kuukaudessa, olettaen vertailukelpoiset ratkaisuasteet. Alle sen volyymin alustojen minimimaksut ja numerovuokrien yleiskulut tekevät ihmisestä plus 19 $/kk SaaSista halvemman vastauksen.
Tätä opasta ylläpitää Techsyn toimitustiimi. Rakennamme tuotannon AI-ääniagentteja Retellin, Vapin ja OpenAI Realtimen päälle asiakkaille; nämä luvut tulevat viikoittain tekemästämme kustannusmallinnustyöstä, eivät toimittajien esitteistä. Hinnat varmennettu toukokuussa 2026; varmista aina toimittajan hinnoittelusivuilta ennen sopimusta.