
AI Voice Agent-priser 2026: Sannheten om $0,05 vs $0,30 per Minutt (Med Beregninger)
Vapi skriver "$0,05/min" på prissiden sin. Din første månedsfaktura kommer inn på $0,27/min. Hva skjedde? Hver voice AI-plattform markedsfører ett tall — plattformsavgiften — og fakturerer deg fire andre lag du ikke så på startsiden. Denne guiden bygger opp ai voice agent-prisene fra bunnen: de virkelige BYOK-kostnadene for 8 plattformer, posten for audio-tokens som ingen forklarer, og en Python-funksjon du kan forke for å forutsi din egen faktura.

Raskt Svar
- Virkelig all-in-kostnad 2026 lander mellom $0,07–$0,30/min avhengig av bundled vs BYOK.
- Bundled-plattformer (Retell, Bland, ElevenLabs) markedsfører $0,07–$0,12/min og lander rundt $0,10–$0,18/min.
- BYOK-plattformer (Vapi $0,05/min plattformsavgift) lander på $0,13–$0,31/min etter LLM + TTS + STT + Twilio.
- Den største skjulte løftestangen er prompt caching på OpenAI Realtime: opptil 80× billigere på systemprompts.
Hva koster en AI voice agent faktisk i 2026?
De fleste AI voice agents koster $0,07 til $0,30 per minutt alt inkludert i 2026. Bundled-plattformer (Retell, Bland, ElevenLabs) markedsfører $0,07–$0,12/min og lander rundt $0,10–$0,18/min. BYOK-plattformer (Vapi med $0,05/min plattformsavgift) lander på $0,13–$0,31/min når du legger til LLM, TTS, STT og Twilio. Direkte på OpenAI Realtime er det omtrent $0,30/min uten caching.
Tre kategorier forklarer nesten alt du ser på fakturaen din:
- Bundled per minutt: Retell AI ($0,07–$0,31/min), Bland AI ($0,09/min fast), Synthflow og ElevenLabs Conversational. Ett tall, alt inkludert.
- BYOK-orkestrering: Vapi tar $0,05/min bare for samtalshåndteringslaget. LLM-tokens, TTS-tegn, STT-minutter og operatøren faktureres separat på dine egne kontoer.
- Direkte på infrastruktur: Bygge direkte på OpenAI Realtime pluss Twilio. Billigst i skala hvis du cacher prompts. Dyrt ellers.
Resten av dette innlegget forklarer matematikken lag for lag og leverer deretter en Python-funksjon tco_per_minute() du kan lime inn i en notebook.
Hvorfor den annonserte minuttprisen er en løgn (de 4 kostnadslag)
Den annonserte plattformsavgiften på $0,05/min dekker bare orkestrering. De andre fire lagene stables oppå. Hver produksjons-voice-agent i 2026 betaler fem poster: telefoni, STT, LLM, TTS og plattformsavgiften som holder dem sammen. Hopp over én og du har ikke en fungerende agent.
Her er gulvet, lag for lag.
Lag 1: Telefoni (operatørminuttet)
Du betaler en ekte telecom for lyden som reiser inn og ut av det offentlige telefonnettverket. Twilio Programmable Voice fakturerer $0,014/min utgående i USA, pluss $1–$2/måned per telefonnummer. Twilio Elastic SIP varierer fra $0,0053–$0,042/min avhengig av opprinnelse. De fleste voice AI-plattformer selger Twilio videre med en liten margin eller sender det direkte gjennom. Uansett: $0,014/min i regnearket ditt.
Lag 2: Tale-til-tekst (STT)
Du konverterer det den som ringer sa til tekst som LLM kan lese. Deepgram Nova-2 streaming koster omtrent $0,0043/min på Pay-as-you-go-nivået, i praksis altså $0,005/min. Premiummodeller (Whisper-ekvivalent) klatrer til $0,018/min. Bundled-plattformer skjuler dette i deres overskriftspris, men det er fortsatt der.
Lag 3: LLM (tekst eller lyd)
To veier her. Tekstmodus-pipelines mater transkribert lyd inn i en modell som GPT-4o-mini ($0,15/M input, $0,60/M output) og mater svaret til TTS. En stemmeloop brenner typisk 100–300 input-tokens og 80–200 output-tokens per tur, noe som gir omtrent $0,003–$0,015/min for GPT-4o-mini, $0,015–$0,04/min for Claude Haiku. Lydens modus-pipelines (OpenAI Realtime) hopper over transkripsjon/syntesedansen og fakturerer direkte i audio-tokens. Vi har en hel seksjon om det nedenfor; det er kostnadshefbommen som ingen forklarer.
Lag 4: Tekst-til-tale (TTS)
Du syntetiserer svaret tilbake til lyd. ElevenLabs Turbo koster $0,10/min på Conversational-planen, premiumstemmer klatrer til $0,12/min. Lavere stemmer (Deepgram Aura, OpenAI tts-1) kommer inn på $0,04–$0,06/min. Dette er vanligvis den nest største posten etter plattformsavgiften.
Legg det til gulvet: $0,014 telefoni + $0,005 STT + $0,005 LLM (4o-mini) + $0,04 TTS + $0,05 plattform = $0,114/min minimum på et BYOK-stack. Det er før HIPAA, samtidighet eller nummerleie. Hvis du vil ha den direkte funksjonssammenligningen etter dette prisdykket, se vår Retell AI vs Vapi vs Bland-gjennomgang.
De 8 plattformene sammenlignet (pristabell mai 2026)
Tabellen nedenfor henter overskriftspriser og realistiske all-in-tall fra hver leverandørs prisside. Bruk det som referanse, ikke som evangelium: prissider endres og stackvalgene dine endrer bunnlinjen.
| Plattform | Prismodell | Overskriftspris | Virkelig all-in (typisk) | HIPAA | BYOK eller bundled | Merkbar felle |
|---|---|---|---|---|---|---|
| Retell AI | Per minutt | $0,07–$0,31/min | $0,12–$0,18/min | Inkludert | Bundled | Samtidighet $8/mnd per over inkludert |
| Vapi | Plattformsavgift + BYOK | $0,05/min | $0,13–$0,31/min | +$2 000/mnd | BYOK | Alle fire lag ekstra |
| Bland AI | Fast per minutt | $0,09/min | $0,09–$0,14/min | Inkludert | Bundled | $0,025/min overføringsavgift |
| Synthflow | Per minutt i plan | $0,09/min basis | $0,11–$0,15/min | Inkludert | Bundled | Plannivåer $29/$99/$449/$899 |
| ElevenLabs Conversational | Per minutt | $0,08–$0,12/min | $0,10–$0,18/min | Workspace-plan | Bundled | LLM ekstra med mindre på managed-nivå |
| Deepgram Voice Agent | Per time | $4,50/t ($0,075/min) | $0,09–$0,11/min + telefoni | Ja | Bundled | Legg til Twilio oppå |
| OpenAI Realtime API | Audio-tokens | $32/M input, $64/M output | ~$0,30/min rå, ~$0,12 cachet | DIY | Direkte | Audio-token-beregning (se nedenfor) |
| Twilio (telefoniskikt) | Per minutt | $0,014/min USA utgående | $0,014/min | n/a | n/a | Telefonnumre $1–$2/mnd |
Priser verifisert mai 2026. Sjekk alltid leverandørenes prissider før du signerer: Vapi endret HIPAA-tillegget sitt to ganger bare det siste året.
Bearbeidet eksempel: hva koster ett 4-minutters utgående samtale egentlig?
Det kanoniske scenariet: ett 4-minutters utgående samtale, GPT-4o-mini som LLM, ElevenLabs Turbo som stemme, Twilio USA som operatør, bare engelsk. Da vi kjørte dette eksakte scenariet på alle fire plattformer (Vapi, Retell, Bland, OpenAI Realtime direkte), forklarte overskriftsprisen mindre enn halvparten av det endelige tallet.
Antagelser holdt konstant på alle fire:
- 4 minutter total varighet
- ~12 samtaleturer, ~150 input-tokens + 100 output-tokens per tur = 1 800 inn / 1 200 ut for GPT-4o-mini
- TTS produserer ~400 tegn per tur × 12 = 4 800 tegn (ElevenLabs Turbo @ $0,10/min audio-output)
- STT fakturerer hele 4 minuttene (Deepgram Nova-2 @ ~$0,0043/min)
- Twilio utgående USA @ $0,014/min, $1/mnd nummer amortert over 1 000 samtaler/mnd = $0,001/samtale
Vapi BYOK: $0,05 → $0,27/min
| Post | Kostnad |
|---|---|
| Vapi plattformsavgift (4 min × $0,05) | $0,200 |
| GPT-4o-mini (1 800 inn × $0,15/M + 1 200 ut × $0,60/M) | $0,001 |
| ElevenLabs Turbo (4 min × $0,10) | $0,400 |
| Deepgram STT (4 min × $0,005) | $0,020 |
| Twilio (4 min × $0,014) | $0,056 |
| Nummerleie amortert | $0,001 |
| Totalt for samtalet | $0,678 |
| Effektivt $/min | $0,170 |
Merk: ElevenLabs Turbo på Conversational-planen er nærmere $0,10/min, ikke fast pris, så beregningen er en per-minutt-avgift for audio-output. En plattformsavgift på $0,05/min pluss GPT-4o-mini pluss ElevenLabs Turbo pluss Twilio summerer til nærmere $0,17–$0,27/min, ikke $0,05.
Retell bundled: $0,10 → $0,16/min
| Post | Kostnad |
|---|---|
| Retell-bundle (4 min × $0,13, GPT-4o-mini + Retell TTS) | $0,520 |
| Twilio gjennomgang (4 min × $0,014) | $0,056 |
| Nummerleie amortert | $0,002 |
| Totalt for samtalet | $0,578 |
| Effektivt $/min | $0,145 |
Retells bundle inkluderer LLM (du velger modellen), STT og deres egne TTS. Du betaler bare Twilio oppå. Det er det.
Bland fast pris: $0,09 → $0,13/min
| Post | Kostnad |
|---|---|
| Bland fast (4 min × $0,09) | $0,360 |
| Twilio gjennomgang (4 min × $0,014) | $0,056 |
| Nummerleie amortert | $0,001 |
| Totalt for samtalet | $0,417 |
| Effektivt $/min | $0,104 |
Bland har den reneste matematikken i SERP. Ett tall, pluss operatør. Fellen ligger i skjulte avgifter — overføringsminutter faktureres til $0,025/min i tillegg.
OpenAI Realtime direkte (uten caching): $0,30/min
| Post | Kostnad |
|---|---|
| OpenAI Realtime audio inn (4 min × ~$0,077) | $0,308 |
| OpenAI Realtime audio ut (4 min × ~$0,077) | $0,308 |
| Twilio (4 min × $0,014) | $0,056 |
| Nummerleie amortert | $0,001 |
| Totalt for samtalet | $0,673 |
| Effektivt $/min | $0,168 |
Det tallet antar at du cacher systemprompts. Uten caching lander det samme samtalet nærmere $1,20 ($0,30/min) fordi hvert tur re-fakturerer den fullstendige systemprompteten til ferske priser. Vi pakker ut den matematikken nedenfor.

Bundled vs BYOK: hvilken prismodell vinner for deg?
Bundled-plattformer vinner når du vil ha én faktura, forutsigbar minutt-matematikk og en god grunnleggende stemme. BYOK vinner når du har ingeniørkapasitet, vil velge din egen LLM og planlegger å forhandle operatørpriser i skala. Beslutningen handler vanligvis om to spørsmål: har du preferanse for faktureringslinjer, og har du en utvikler som eier stacken?
| Brukstilfelle | Bundled vinner fordi | BYOK vinner fordi |
|---|---|---|
| Innkommende støtteavledning | Én leverandør, én faktura, HIPAA inkludert | Vanskelig å rettferdiggjøre ingeniørkostnaden |
| Utgående kald oppringing i skala | Fast matematikk slår per-token-overraskelser | Du kan forhandle operatørminutter utover 100k/mnd |
| Tilpasset RAG + verktøybruk | Begrenset verktøysanropsflate i de fleste bundles | Full kontroll over kontekstvinduet |
| Regulerte bransjer | HIPAA-flagget slås på med en avkrysningsboks | Samsvar blir ditt problem |
Rask beslutningsregel:
- Under 10 000 minutter/mnd → bundled vinner nesten alltid på total eierkostnad (ingeniørtiden alene gjør break-even).
- 10 000–100 000 minutter/mnd → BYOK begynner å lønne seg hvis du har 1+ ingeniør på det.
- Over 100 000 minutter/mnd → BYOK eller direct-on-Realtime er vanligvis $0,05–$0,10/min billigere, og du har løftestang for å forhandle Twilio-underkontopriser.
For et dypere LLM-kostnadsperspektiv på BYOK-siden, se vår analyse av orkestreringsvalg i beste AI-agentramverk.
De skjulte avgiftene som de fleste går glipp av
Selv når du har knekket fire-lags-matematikken, kommer fakturaen med poster som hjemmesiden aldri nevnte. Disse syv er de vi ser treffe kunder oftest. De fleste er begravet i prissidens finprint eller i konfigurasjonsskjermer etter påmelding. De er ikke ondsinnte, bare underkommunisert.
- HIPAA-tillegg. Vapi tar $2 000/mnd for HIPAA ifølge prissiden sin. Retell, Bland og Synthflow inkluderer HIPAA uten ekstra kostnad. Hvis du er innen helsesektoren og vurderer Vapi, er det $24k/år før du har lagt en eneste samtale.
- Minutt-avrundingsskatt. De fleste plattformer runder opp til 60-sekunders intervaller: ett 61-sekunders samtale faktureres som 2 minutter. Med 5 000 samtaler/mnd med en typisk 45–90-sekunders fordeling er det et 5–8% effektivt tillegg over hva $/min-matematikken din sier. Per-sekund-fakturering (Bland, Deepgram) hopper over dette.
- Telefonnummer-leier. Twilio: $1–$2/mnd per nummer. Retell: $2/mnd per nummer, $10/mnd for verifiserte numre. Ser lite ut til du kjører 50 utgående numre for kald oppringing; det er en $100/mnd-post ingen siterte.
- Samtidighetsavgifter. Retell inkluderer en basislinje med samtidige samtaler; utover det er det $8/samtidighet/mnd. Et team som kjører 10 samtidige samtaler utover basislinjen legger til $80/mnd.
- Overføringsavgifter. Bland tar $0,025/min når agenten overfører til et menneske. Hvis 20% av samtalene dine overføres, er det en meningsfull skatt på gjennomsnittlig minutt.
- Kunnskapsbase-avgifter. Retell gir deg 10 KB gratis; hvert ekstra er $8/mnd. Stable RAG-intensive brukstilfeller og det akkumuleres raskt.
- Premiumstemme-oppgraderinger. ElevenLabs Premium legger til +$0,04/min over Turbo. Høres valgfritt ut til salgsteamet ditt A/B-tester og finner at Premium konverterer 11% bedre.
Trenger du noen til å spesifisere ditt spesifikke brukstilfelle før du signerer en Vapi-kontrakt? Vi gjør det som en del av våre voice agent-byggeengasjementer.
Audio-tokens og prompt caching: kostnadsløftestangen ingen forklarer
OpenAI Realtime API fakturerer per audio-token, der 1 token = 100ms audio-input eller 50ms audio-output. Et 60-sekunders samtale bruker omtrent 600 input-tokens (den som ringer snakker) og 1 200 output-tokens (agenten svarer). Til $32/M input og $64/M output gir det $0,0192 input + $0,0768 output = $0,096 rå audiokostnad per minutt, eller omtrent $0,10/min før du legger til prompts, verktøy eller Twilio.
Så er det systemprompteten. Hvert tur sender din fullstendige systempromt til modellen som en del av kontekstvinduet. En typisk voice agent har en 2 000-token systempromt som dekker persona, verktøy, kanttilfeller og avslagslogikk. Uten caching faktureres det 2 000-token blokken til $32/M ferskt ved hvert samtale: $64 over 1 000 samtaler.
Med prompt caching aktivert (cachede tokens koster $0,40/M ifølge OpenAIs dokumentasjon), faktureres den samme 1 000-samtale arbeidsmengden for $0,80. Det er en 80× rabatt på systempromt-kostnader. Prompt caching på OpenAI Realtime reduserer systempromt-kostnaden din med 80×. De fleste team oppdager dette bare etter sin første månedsfaktura.
Her er matematikken som kode:
# Audio-token-kostnadsberegning for OpenAI Realtime
# Input: 1 token / 100ms = 600 tokens/min
# Output: 1 token / 50ms = 1 200 tokens/min
INPUT_PER_MIN = 600
OUTPUT_PER_MIN = 1200
SYSTEM_PROMPT_TOKENS = 2000
CALLS = 1000
# Ferske priser
COST_IN_FRESH = 32 / 1_000_000 # $/token
COST_OUT_FRESH = 64 / 1_000_000
COST_IN_CACHED = 0.40 / 1_000_000 # 80x rabatt
# Rå audiokostnad (per samtale, 1 minutt)
audio_cost = INPUT_PER_MIN * COST_IN_FRESH + OUTPUT_PER_MIN * COST_OUT_FRESH
# ~$0,096/min
# Systempromt over 1 000 samtaler
prompt_fresh = SYSTEM_PROMPT_TOKENS * COST_IN_FRESH * CALLS # $64
prompt_cached = SYSTEM_PROMPT_TOKENS * COST_IN_CACHED * CALLS # $0,80
print(f"Ferskt: ${prompt_fresh:.2f} | Cachet: ${prompt_cached:.2f}")
# Ferskt: $64.00 | Cachet: $0.80
I kostnadsmodelleringsarbeidet vårt for kunder som bygger direkte på Realtime, er dette den største enkeltløftestangen mellom "Realtime er billig" og "Realtime koster dobbelt av Vapi". Hvis du bruker Responses API ved siden av Realtime for verktøysanrop, se vår OpenAI Responses API-veiledning for implementeringsmønsteret. Det er derfor å bygge direkte på OpenAI Realtime kan være billigere eller mye dyrere enn Vapi, avhengig av om du cacher.
Hvordan beregne din egen TCO (formel + Python)
Total eierkostnad for en voice agent er den variable kostnaden per minutt pluss månedlige faste avgifter amortert over minuttvolumet ditt. Formelen:
TCO/min = plattformsavgift + LLM_kostnad + STT_kostnad + TTS_kostnad + telefoni + (nummerleie + samtidighetsavgift + KB_avgift) / minutter_per_måned
Sett inn tallene dine. Eller fork dette:
def tco_per_minute(
calls_per_month: int,
avg_duration_seconds: float,
platform_fee_per_min: float, # f.eks. 0.05 for Vapi, 0.13 for Retell-bundle
llm_in_per_1m: float, # f.eks. 0.15 for GPT-4o-mini input
llm_out_per_1m: float, # f.eks. 0.60 for GPT-4o-mini output
llm_in_tokens_per_call: int, # f.eks. 1800
llm_out_tokens_per_call: int, # f.eks. 1200
tts_per_min: float, # f.eks. 0.10 for ElevenLabs Turbo
stt_per_min: float, # f.eks. 0.005 for Deepgram Nova-2
telephony_per_min: float, # f.eks. 0.014 for Twilio USA
fixed_monthly: float = 0.0, # nummerleier, KB, HIPAA, samtidighet
) -> dict:
"""Returnerer månedlig og per-minutt total eierkostnad."""
minutes_per_month = (calls_per_month * avg_duration_seconds) / 60
# Variabel per samtale
llm_cost_per_call = (
(llm_in_tokens_per_call * llm_in_per_1m / 1_000_000)
+ (llm_out_tokens_per_call * llm_out_per_1m / 1_000_000)
)
avg_minutes_per_call = avg_duration_seconds / 60
variable_per_call = (
platform_fee_per_min * avg_minutes_per_call
+ llm_cost_per_call
+ tts_per_min * avg_minutes_per_call
+ stt_per_min * avg_minutes_per_call
+ telephony_per_min * avg_minutes_per_call
)
monthly_variable = variable_per_call * calls_per_month
monthly_total = monthly_variable + fixed_monthly
cost_per_minute = monthly_total / minutes_per_month if minutes_per_month else 0
return {
"minutes_per_month": round(minutes_per_month, 1),
"monthly_total_usd": round(monthly_total, 2),
"cost_per_minute_usd": round(cost_per_minute, 4),
}
# Eksempel: 5 000 samtaler/mnd, 4 min snitt, Vapi BYOK-stack
print(tco_per_minute(
calls_per_month=5000,
avg_duration_seconds=240,
platform_fee_per_min=0.05,
llm_in_per_1m=0.15, llm_out_per_1m=0.60,
llm_in_tokens_per_call=1800, llm_out_tokens_per_call=1200,
tts_per_min=0.10,
stt_per_min=0.005,
telephony_per_min=0.014,
fixed_monthly=2.0, # $2/mnd nummerleie
))
# {'minutes_per_month': 20000.0, 'monthly_total_usd': 3380.05, 'cost_per_minute_usd': 0.169}Fire nummererte trinn for den som prognostiserer fra null:
- Estimer månedlig samtalevolum og gjennomsnittlig samtalelengde.
- Velg stacken din: plattform + LLM + TTS + STT + telefoni.
- Slå opp enhetsprisen for hver komponent fra leverandørens prisside.
- Kjør formelen (eller Python-funksjonen ovenfor) — output er ditt prognostiserte $/min og månedstotal.
Hvis du ikke kan skrive TCO-en din som en enlinjers formel, kommer du til å tape det på en minutt-avrundingsskatt.
Kostnad i skala: 1k vs 10k vs 100k minutter per måned
Kurvene divergerer raskt utover 10 000 minutter. Bundled-plattformer flater ut fordi fakturaen bare er minutter × pris. BYOK-stacker stiger etter hvert som LLM- og TTS-kostnader skalerer lineært med deg. OpenAI Realtime med caching krysser Vapi rundt 10k–20k minutter/mnd, infleksjonspunktet der direct-on-infra begynner å gi mening.
| Plattform | 1 000 min/mnd | 10 000 min/mnd | 100 000 min/mnd |
|---|---|---|---|
| Bland fast $0,09/min + Twilio | $120 | $1 160 | $11 400 |
| Retell bundle ~$0,145/min alt inkl. | $145 | $1 450 | $14 500 |
| Vapi BYOK ~$0,17/min alt inkl. | $170 | $1 700 | $17 000 |
| OpenAI Realtime + caching ~$0,13/min | $130 | $1 300 | $13 000 |
| Deepgram Voice Agent + Twilio | $108 | $1 080 | $10 800 |
Tall avledet fra tco_per_minute()-formelen ovenfor med de kanoniske 4-minutters samtaleantagelsene. Legg til HIPAA ($2 000/mnd Vapi), samtidighet og nummerleier der de gjelder. De endrer ikke kurveformen, men hever gulvet for kjøpere med lavt volum.
Hero-diagrammet øverst i dette innlegget visualiserer de samme tallene: Bland flater tidlig, Vapi stiger etter hvert som LLM-kostnader skalerer, og OpenAI Realtime med caching slår Vapi utover 10k minutter.
Når du IKKE bør distribuere en voice agent
Voice AI har et virkelig $0,10–$0,30/min-gulv. Under 200 samtaler per måned vinner en menneskelig pluss en $19 SaaS fortsatt på kostnad. Telefonnummer-leier, samtidighets-basislinjer og plattformsminimum summerer til en $50–$200/mnd-overhead som et lav-volum-team rett og slett ikke gjenvinner.
Tre ærlige "hopp over"-kriterier:
- Færre enn 200 samtaler/mnd. Nummerleier + minimumsavgifter + samtidige basislinjer overstiger hva et deltidsmenneskekostnad til $20/t. Break-even går ikke opp.
- Kontekstrikt arbeid med lavt volum. Det ene mennesket ditt håndterer 15 samtaler om dagen, hvert med 30+ unike faktamønstre. LLM-hallusinasjonskostnaden (refusjoner, tapte avtaler, feil avtaler) spiser opp besparelsene. Voice AI glimrer på repetitive flyter, ikke på kanttilfelle-intensivt arbeid.
- Regulerte bransjer uten HIPAA-budsjett. Vapis $2k/mnd HIPAA-tillegg, operatørcompliance-avgifter og PII-vernrekkverk ($0,005–$0,01/min på Retell) kan kollapse matematikken. Hvis du ikke kan budsjettere $25k/år på compliance-poster alene, kjør pilotprosjekter på ikke-PHI-flyter først.
I testing lander break-even-punktet mot en menneskelig agent for støtteavledning rundt 250–400 samtaler/mnd ved typiske bundled-priser. Under det er en $19/mnd SaaS pluss et menneske billigere. Ikke distribuer voice AI bare fordi du kan.

Hvis voice AI klarer kostnadsgulvet men du ikke vil koble opp Retell eller Vapi selv, bygger og drifter vår voice agent-utviklingstjeneste det komplette stacket på infrastrukturen din.
Slik ville vi faktisk velge en plattform i 2026 (dom per brukstilfelle)
Ingen enkelt plattform vinner overalt. Det billigste seriøse valget avhenger av om du er inngående eller utgående, om du har ingeniørkapasitet og om HIPAA er viktig. Fem brukstilfeller, fem svar:
- Billigste seriøse utgående (kald oppringing): Bland. Fast $0,09/min, transparent overføringsavgift, ingen overraskende LLM-kostnader. Hopp over hvis du trenger dyp RAG eller tilpassede verktøy.
- Billigste inngående (støtteavledning): Retell. Bundled, HIPAA inkludert, moden analyse, $0,12–$0,18 alt inkludert. Hopp over hvis inngående volum er under 200 samtaler/mnd (se forrige avsnitt).
- Maks kontroll + tilpasset RAG: Vapi BYOK. Bare hvis du har ingeniørkapasitet til å eie LLM-, TTS- og STT-nøklene. Kontrollen er verdt $0,27/min bare når du kan forhandle operatøren og LLM i volum.
- Bundlet enkelhet i skala: Deepgram Voice Agent. $4,50/t ($0,075/min) fast, det mest oversett alternativet i SERP. Hopp over hvis du trenger det brede stemmebiblioteket ElevenLabs tilbyr.
- Samtale-kvalitetsnivå (salgsdemonstrasjonene, merkevare-sensitive flyterter): ElevenLabs Conversational. Turbo- eller premiumstemmer til $0,10–$0,12/min. Betal ekstrapriset når stemmekvalitet er konverteringshabstangen.
For et dypere bransjeoversyn på enterprise-siden, se AI voice agents for enterprise-callcentre: samme matematikk, med restaurant- og klinikk-spesifikke volumantagelser.
Slik håndterer Techsy voice agent-kostnadsmodellering
Vi selger ikke en stemme-plattform. Vi bygger produksjons-voice-agents for kunder på Retell, Vapi, Deepgram og OpenAI Realtime. Det betyr at når vi modellerer kostnadene for et nytt engasjement, kjører vi tco_per_minute()-formelen på tre volumnivåer (1k, 10k, 100k minutter/mnd) før vi anbefaler et stack. Plattformen som vinner ved 1k taper ofte ved 100k.
Vi forhandler Twilio-underkontopriser for kunder utover 100k minutter/mnd (underkontoer låser opp volumnivåer de fleste team ikke vet eksisterer), og vi modellerer alltid prompt caching-besparelsene på Realtime-bygginger før vi signerer av på et direct-infra-design. Halvparten av kostnadsmodelleringsarbeidet vårt for kunder er å avvikle antagelser som noen har gjort fra et leverandørblogginnlegg.
Vil du ha en voice agent bygget end-to-end på plattformen som faktisk vinner for ditt volum? Se hvordan vi bygger voice agents →
FAQ
Hvor mye koster en AI voice agent per minutt i 2026? Alt-inkludert kostnad varierer fra $0,07 til $0,30 per minutt. Bundled-plattformer (Retell, Bland, ElevenLabs Conversational) lander på $0,10–$0,18/min når telefoni er inkludert. BYOK-plattformer som Vapi lander på $0,13–$0,31/min etter å ha lagt til LLM-, TTS-, STT- og Twilio-kostnader. OpenAI Realtime direkte sitter rundt $0,30/min rå eller omtrent $0,12/min med prompt caching aktivert på systemprompts.
Hva er den billigste AI voice agent-plattformen? For utgående er Bland AI til $0,09/min fast den reneste matematikken i markedet. For inngående støtte vinner Retell til $0,10–$0,16 alt inkludert vanligvis takket være bundlet HIPAA og samtidige basislinjer. For rene infrastrukturoppkoblinger med caching kan OpenAI Realtime falle under $0,15/min. Deepgram Voice Agent til $0,075/min fast er det mest oversette alternativet.
Hvorfor er Vapi-fakturaen min høyere enn $0,05/min? $0,05/min på Vapias prisside er bare plattformsavgiften. Vapi er BYOK: du tar med dine egne nøkler for LLM (GPT-4o-mini, Claude osv.), TTS (ElevenLabs, PlayHT), STT (Deepgram) og telefoni (Twilio). Virkelig alt-inkludert kostnad lander på $0,13–$0,31/min avhengig av hvilken stemme og modell du velger.
Hva er forskjellen mellom BYOK og bundled-prissetting? Bundled-plattformer (Retell, Bland, Synthflow, ElevenLabs Conversational) inkluderer LLM, STT og TTS i én per-minutt-tariff. BYOK-plattformer (Vapi) tar bare betalt for orkestrering — du tar med dine egne API-nøkler for alt annet og faktureres separat av hver leverandør. Bundled er enklere; BYOK gir deg kontroll og forhandlingshabstang i skala.
Er det skjulte avgifter i AI voice agent-priser? Ja, sju vanlige. HIPAA-tillegg ($2 000/mnd på Vapi), minutt-avrunding (5–8% effektivt tillegg i skala), telefonnummer-leier ($1–$2/mnd), samtighetsavgifter ($8/samtidighet/mnd Retell), overføringsavgifter ($0,025/min Bland), kunnskapsbase-avgifter ($8/mnd per KB på Retell) og premiumstemme-oppgraderinger (+$0,04/min ElevenLabs Premium over Turbo).
Er OpenAI Realtime API billigere enn Vapi? Uten prompt caching, nei: OpenAI Realtime koster omtrent $0,30/min rå audiokostnad. Med prompt caching aktivert (cachede systempromt-tokens til $0,40/M vs $32/M ferskt, en 80× rabatt) kollapser systempromt-posten og totalkosten synker til omtrent $0,12–$0,15/min. Det gjør det konkurransedyktig med bundled-plattformer utover 10k minutter/mnd.
Hvordan prognostiserer jeg min voice agent-månedskostnad?
Estimer samtaler per måned multiplisert med gjennomsnittlig samtalelengde i minutter. Multipliser med plattformens alt-inkludert $/min. Legg til faste månedskostnader: telefonnummer-leier, KB-avgifter, samtidighets-basislinje, HIPAA-tillegg hvis aktuelt. Python-funksjonen tco_per_minute() ovenfor automatiserer dette med ett enkelt funksjonsanrop du kan lime inn i en Jupyter-notebook.
Per-minutt eller per-sekund fakturering: hva er billigst? Per-sekund fakturering er meningsfullt billigere for korte utgående samtaler. Et 61-sekunders samtale fakturert i 60-sekunders intervaller tar betalt for 2 minutter, noe som er en 5–8% effektiv skatt på 5 000 samtaler per måned med en typisk kort-samtale-fordeling. Bland og Deepgram fakturerer per sekund; de fleste BYOK-plattformer arver Twilios 60-sekunders avrunding som standard.
Finnes det gratis AI voice agents? Gratis prøveversjoner finnes: de fleste leverandører tilbyr 10–60 gratis minutter (Retell, Vapi, Bland) for å teste. Virkelig gratis produksjonskvalitets-voice-agents finnes ikke fordi du alltid betaler minst operatørminutter ($0,014/min på Twilio USA utgående). Selv selvhostede open-source-stacker (Pipecat, LiveKit Agents) lar deg betale telecom og LLM.
Hva er ROI-en til voice AI vs en menneskelig agent? Menneskelige agenter koster $15–$30/t fullt belastet, noe som gir $0,25–$0,50/min. Voice AI til $0,10–$0,20/min slår menneskekostnaden utover omtrent 200 samtaler per måned, med antakelse om sammenlignbare løsningsgrader. Under det volumet gjør plattformsminimum og nummerleie-overhead et menneske pluss en $19/mnd SaaS til det billigere svaret.
Denne guiden vedlikeholdes av Techsys redaksjonsteam. Vi bygger produksjons-AI-voice-agents på Retell, Vapi og OpenAI Realtime for kunder; disse tallene kommer fra kostnadsmodelleringsarbeid vi gjør hver uke, ikke leverandørbrosjyrer. Priser verifisert mai 2026; bekreft alltid med leverandørenes prissider før du signerer.