
Retell AI vs Vapi vs Bland AI: Na všech třech jsme postavili stejného hlasového agenta (verdikt pro rok 2026)
Pokud si v roce 2026 vybíráte platformu pro telefonní agenty, výsledky vyhledávání jsou plné blogů jednotlivých vendorů, které vám tvrdí, že právě jejich produkt je ten nejlepší. My jsme zvolili jiný přístup: postavili jsme stejného agenta na všech třech platformách. Tento průvodce se týká platform pro hlasovou AI určenou pro telefonní agenty – Retell, Vapi a Bland – nikoliv spotřebitelských hlasových asistentů, jako je ChatGPT Voice nebo Alexa.
Verdikt pro rok 2026: Retell AI vítězí, pokud hledáte nejrychlejší cestu k spravovanému telefonnímu agentovi s nízkou latencí (~600 ms latence, ~0,07 $/min vše zahrnuto, standard HIPAA). Vapi vítězí pro inženýrské týmy, které chtějí mít plnou kontrolu nad stackem LLM, TTS, STT a telefonie a jsou ochotny zpracovávat faktury od pěti různých vendorů. Bland AI vítězí u vysokého objemu odchozích hovorů díky deterministickým tokům Pathways a předvídatelnému cenění za minutu.
Zveřejnění: Společnost Techsy buduje produkční hlasové agenty na bázi Retell, Vapi a OpenAI Realtime. Tyto partnery jsme vybrali proto, že je sami používáme. Toto srovnání je upřímné, protože špatná volba platformy pálí náš dodací čas, nejen ten váš.
Rychlý verdikt: Která platforma pro hlasové agenty vítězí v roce 2026?
Rozhodnutí retell ai vs vapi vs bland závisí na vašem případě použití, ne na jediném vítězi. Retell vítězí, když potřebujete spravovaného telefonního agenta nasazeného během týdnů, ne měsíců. Vapi vítězí, když máte inženýrskou kapacitu vlastnit multi-vendor BYOK stack. Bland vítězí, když provozujete odchozí kampaně s více než 1 000 souběžnými hovory a využíváte deterministické Pathways. Každý, kdo vám tvrdí, že existuje jasný vítěz mezi „retell ai nebo vapi“, vám něco prodává.
| Kritérium | Retell AI | Vapi | Bland AI |
|---|---|---|---|
| Nejlepší pro | Spravované příchozí hovory, nejrychlejší nasazení | Vlastní stack s inženýrskou kapacitou | Vysoký objem odchozích hovorů |
| Průměrná latence (P50) | ~600–620 ms | ~500–700 ms (vyladěno) | ~700–900 ms |
| Celkové náklady @ 10K hovorů | ~2 800 $/měsíc | ~7 200–8 800 $/měsíc | ~3 600–4 400 $/měsíc |
| Kontrola LLM | Kurátorský seznam | Jakýkoliv (BYO) | Jejich stack |
| HIPAA BAA | Standard | Doplněk pro Enterprise | Standard |
| Telefonie | Spravovaná Twilio | Vlastní Twilio | Spravovaná Twilio |
| Pracovní primitivum | Conversation Flow | Squads | Pathways |
| Nasazení do produkce | 2–6 týdnů | 4–10 týdnů | 3–6 týdnů |
Je tu jedna věc, kterou vám nikdo neřekne hned na začátku: výběr platformy je ta snadná část, možná 10 % práce. Zbývajících 90 % tvoří návrh promptů, zajištění telefonie, evaluační pipeline, monitorování a 24/7 operace. Vyberte platformu, která nejméně zatíží váš inženýrský tým, a budete nasazovat v řádu měsíců, ne čtvrtletí.
Tři platformy, tři filozofie
Na trhu hlasových agentů dnes existují tři architektonické filozofie: spravovaná (Retell), orchestrovaný middleware (Vapi) a pipeline orientované na odchozí hovory (Bland). Každá z nich volí jiný kompromis mezi kontrolou vývojáře, rychlostí nasazení a operační složitostí. Pokud víte, do které filozofie jste investovali, poznáte, jaké režimy selhání zdědíte.

Retell AI: spravovaný end-to-end
Retell je názorová platforma pro telefonní agenty „vše v jednom“. STT, LLM, TTS i telefonie běží v rámci jednoho spravovaného runtime prostředí. Dokumentace Retell uvádí, že nasadíte řešení „z dema do produkce během dní, ne týdnů“, a pro scénáře příchozích hovorů do 50 tisíc minut měsíčně to zhruba platí. Nevýhoda: nemůžete přinést libovolný LLM, nemůžete hostovat řešení sami a když se něco pokazí, vaším řešením je „otevřít ticket“.
Vapi: orchestrace middleware
Vapi je dirigent, ne orchestr. Přinášíte si vlastní LLM (jakýkoliv provider), STT (Deepgram, Azure, AssemblyAI), TTS (ElevenLabs, Cartesia, PlayHT) a vlastní účet Twilio. Vapi se stará o střídání mluvčích, přerušování (barge-in), detekci konce řeči a volání nástrojů. Když jsme stavěli svého prvního agenta na Vapi, nedocenili jsme, jak doslovně slovo „middleware“ znamená, že vy odpovídáte na dotazy Twilia ohledně registrace STIR-SHAKEN ve 3 ráno, ne Vapi. Flexibilita je skutečná; stejně tak je skutečná daň v podobě operační zátěže.
Bland AI: pipeline orientovaná na odchozí hovory
Bland je továrna na hovory. Platforma je postavena kolem Pathways, což jsou deterministické toky založené na grafech uzlů, určené pro odchozí kampaně běžící s více než 1 000 souběžnými hovory. Bland nabízí ceník za minutu, který škáluje předvídatelně, a jejich spravovaná telefonie za vás řeší A2P 10DLC a STIR-SHAKEN. Háček: příchozí hovory působí jako afterthought a jste uzamčeni do stacku LLM společnosti Bland bez možnosti BYO.
Pokud vás zajímá také základní vrstva pro agenty, naše analýza nejlepších frameworků pro AI agenty roku 2026 mapuje, jak se LangGraph vs CrewAI vs OpenAI Agents SDK zapojují do hlasového runtime prostředí.
Latence, kvalita hlasu a reálná čísla
V testech třetích stran z května 2026 dosáhlo Vapi vyladěné s Deepgram + GPT-4o-mini + ElevenLabs Flash mediánové latence ~500–700 ms. Spravovaný stack Retell má průměrnou latenci ~600–620 ms přímo z krabice. Bland AI naměřil ~700–900 ms v závislosti na složitosti Pathway. Všechny tři platformy překračují 1,5 s při P95 pod zátěží, což je bod, kdy zákazníci skutečně zavěšují.
| Metrika | Retell AI | Vapi (vyladěno) | Bland AI | Poznámky |
|---|---|---|---|---|
| Medián (P50) | ~600–620 ms | ~500–700 ms | ~700–900 ms | Z krabice vs vyladěno |
| P95 pod zátěží | ~1,4–1,8 s | ~1,2–1,9 s | ~1,6–2,4 s | Zde zákazníci zavěšují |
| Čas do prvního zvuku | ~400 ms | ~350 ms | ~500 ms | Kritické pro pocit „lidskosti“ |
| Zpracování přerušení | Nativní | Nativní | Nativní | Podporují všechny 3 |
Čísla jsme zkřížili s benchmarkem latence hlasové AI od Telnyx a vlastními inženýrskými příspěvky Retell. V našich testovacích hovorech z newyorského čísla Twilio na americký mobil jsme viděli, že Vapi dosáhlo mediánu ~540 ms s vyladěnou konfigurací a ~1,7 s při P95, jakmile jsme překročili 50 souběžných hovorů. Retell se pohyboval kolem mediánu 610 ms a P95 1,5 s. Bland naměřil medián ~820 ms a P95 2,1 s – Pathways přidávají malou penalizaci za každý uzel.
Dvě upozornění jsou důležitější než samotná čísla. Za prvé, volba LLM dominuje rozpočtu na latenci; přechod z GPT-4o-mini na Claude Opus 4.7 přidá ~200 ms bez ohledu na platformu. Za druhé, P50 vypadá skvěle všude; P95 je místo, kde zákazníci zavěšují, a všechny tři platformy významně degradují při trvalé zátěži. ElevenLabs Flash v2.5 je de facto prémiovým TTS na všech třech platformách v roce 2026 – není to diferenciátor latence, který někdo reklamuje.
Profesionální tip: investujte do nástrojů pro evaluaci LLM, než začnete měřit latenci vendorů. Nemůžete ladit to, co nemůžete pozorovat.
Ceník: Položkové náklady stacku při 10 tisících hovorů měsíčně
Při 10 000 hovorech měsíčně s průměrnou dobou trvání 4 minuty fakturuje Retell AI celkem přibližně 2 800 $/měsíc. Bland AI na plánu Scale stojí 3 600–4 400 $/měsíc. Vapi vypadá nejlevněji s cenou 0,05 $/min, ale skutečné náklady BYOK (LLM + STT + TTS + Twilio + doplňky) vyšplhají celkovou částku na 7 200–8 800 $/měsíc. To je realita cenění retell ai vs vapi, kterou stránky vendorů nezobrazují.
Past matematiky BYOK: Vapi reklamuje 0,05 $/min. Vaše skutečná faktura se blíží k 0,18–0,22 $/min, jakmile přičtete čtyři další vendory. Zde je matematika, položkově.

| Komponenta | Retell AI | Vapi (BYOK) | Bland AI (Scale) |
|---|---|---|---|
| Poplatek za platformu | Zahrnuto | 0,05 $/min | Zahrnuto v plánu |
| STT (Deepgram Nova-3) | Zahrnuto | ~0,0043 $/min | Zahrnuto |
| LLM (GPT-4o-mini realtime) | Zahrnuto | ~0,06 $/min | Jejich stack |
| TTS (ElevenLabs Flash) | Zahrnuto | ~0,08 $/min | Zahrnuto |
| Telefonie (Twilio) | Zahrnuto | ~0,013 $/min | Zahrnuto |
| Skutečný součet /min | ~0,07 $ | ~0,18–0,22 $ | ~0,09–0,11 $ |
| Celkem 40 000 min/měsíc | ~2 800 $ | ~7 200–8 800 $ | ~3 600–4 400 $ |
První měsíc, kdy jsme běželi 40 tisíc minut na Vapi, očekávali jsme fakturu podle sazebníku ve výši 2 000 $. Skutečný součet napříč 5 dashboardy vendorů byl 7 400 $. Ověřeno z ceníku Vapi, ceníku Retell AI, ceníku Bland AI, ceníku OpenAI Realtime API a ceníku Deepgram Nova-3.
Kdy náklady Vapi přesto vítězí
Cenování BYOK u Vapi překoná spravované platformy, jakmile dokážete vyjednat enterprise sazby s každým vendorem samostatně. Při 500 tisících+ minutách měsíčně náš tým viděl, že celkové náklady Vapi klesly na 0,11–0,13 $/min, když vendori LLM a TTS nabídli objemové slevy. Pokud také aplikujete cachování promptů LLM na opakující se systémové prompty a prozkoumáte jiné způsoby, jak snížit náklady na API LLM, jednotková ekonomika se obrátí. Bod zvratu je někde kolem 200 tisíc minut měsíčně pro příchozí hovory a 100 tisíc pro odchozí.
Skryté náklady, které nikdo nekótuje
KYC pro firemní čísla Twilio (zdarma, ale blokuje vás na ~3 dny). Registrace A2P 10DLC: poplatek za značku 15 $ + 1,50 $/měsíc za kampaň. Attestace STIR-SHAKEN úrovně A: zdarma se spravovaným Twilio, křehké s vlastním řešením. Poplatky za klonování hlasu na tieru ElevenLabs Pro: 5–22 $/měsíc za hlas. Vaše skutečná produkční faktura je marketingový sazebník plus 15–30 % v režii compliance a nástrojů.
Pathways vs Squads vs Conversation Flow
Bland Pathways jsou deterministické grafy uzlů (čisté pro odchozí toky, obtížně udržovatelné po překročení 50 uzlů). Vapi Squads jsou předávání mezi více agenty se sdíleným kontextem (výkonné, ale snadno korumpovatelné). Retell Conversation Flow je vizuální tvůrce promptů a nástrojů (nejrychlejší nasazení, omezená hloubka větvení). Rozhodnutí bland pathways vs vapi squads je ve skutečnosti rozhodnutím o tom, jak deterministický váš tok musí být.

| Aspekt | Bland Pathways | Vapi Squads | Retell Conversation Flow |
|---|---|---|---|
| Mentální model | Graf uzlů (deterministický) | Konstelace více agentů | Vizuální tvůrce promptů + nástrojů |
| Nejlepší pro | Odchozí, skriptované toky | Složité předávání ve více krocích | Rychlé MVP pro příchozí hovory |
| Režim selhání | Neudržovatelné po ~50 uzlech | Korupce kontextu mezi agenty | Omezená hloubka větvení |
| Zkušenost s editací | Vizuální + JSON | Code-first (JSON) | Vizuální UI |
| Strop škálovatelnosti | Vysoký (1 000+ souběžně) | Střední (omezeno inženýrstvím) | Středně vysoký |
Upřímné režimy selhání: Pathways se stávají neudržovatelnými po 50 uzlech; jakmile má tok 80 větví, každá změna riskuje regresi a diffing verzí v JSON je bolestivý. Squads vyžadují disciplinované inženýrství kontextu; sledovali jsme, jak předání z prodeje na podporu ztratilo polovinu deklarovaného záměru uživatele, protože sdílený kontext nebyl pročištěn. Conversation Flow neumí hluboké větvení; jakmile váš příchozí tok potřebuje 4+ úrovně podmíněné logiky, přerostete vizuální tvůrce a budete chtít surovou kontrolu promptů.
Vyberte Pathways, pokud je odchozí volání vaším byznysem. Vyberte Squads, pokud váš agent legitimně potřebuje více specializovaných sub-agentů. Vyberte Conversation Flow, pokud chcete nasadit MVP pro příchozí hovory za dva týdny.
Kód: Stavba stejného agenta pro rezervace v restauraci na všech třech platformách
Postavili jsme stejného agenta třikrát: hlasového agenta pro rezervace v restauraci s jedním nástrojem (bookReservation posílajícím data na /api/calendar/book), stejným hlasem ElevenLabs Flash v2.5 Rachel a stejným modelem, kde to bylo podporováno (Claude Sonnet 4.7 s fallbackem na GPT-4o-mini). Když jsme připojili stejný webhook bookReservation ke všem třem, jediný, který nám poslal celý přepis konverzace bez přidání extra konfigurace, byl Retell.
Specifikace agenta: pozdravit volajícího, získat datum + čas + počet osob + jméno, zavolat webhook, potvrdit rezervaci zpět. Stejný systémový prompt, stejné schéma nástroje, stejné TTS. Zde je ukázka, jak každý SDK tvaruje kód.
Retell AI (Python)
import os
from retell import Retell
client = Retell(api_key=os.environ["RETELL_API_KEY"])
agent = client.agent.create(
response_engine={
"type": "retell-llm",
"llm_id": "llm_rest_booking_v3",
},
voice_id="11labs-Rachel",
agent_name="restaurant-reservation-agent",
language="en-US",
interruption_sensitivity=0.7,
enable_backchannel=True,
)
# Tool attaches to the underlying LLM resource
client.llm.update(
llm_id="llm_rest_booking_v3",
general_prompt="You are a friendly host taking dinner reservations...",
general_tools=[{
"type": "custom",
"name": "bookReservation",
"url": "https://api.yourdomain.com/calendar/book",
"description": "Book a reservation in the calendar",
"parameters": {
"type": "object",
"properties": {
"date": {"type": "string"},
"time": {"type": "string"},
"party_size": {"type": "integer"},
"name": {"type": "string"},
},
"required": ["date", "time", "party_size", "name"],
},
}],
)
print(f"Agent ready: {agent.agent_id}")Vapi (JavaScript/Node)
import { VapiClient } from "@vapi-ai/server-sdk";
const vapi = new VapiClient({ token: process.env.VAPI_API_KEY });
const assistant = await vapi.assistants.create({
name: "restaurant-reservation-agent",
transcriber: { provider: "deepgram", model: "nova-3", language: "en" },
model: {
provider: "openai",
model: "gpt-4o-mini",
systemMessage: "You are a friendly host taking dinner reservations...",
tools: [{
type: "function",
function: {
name: "bookReservation",
description: "Book a reservation in the calendar",
parameters: {
type: "object",
properties: {
date: { type: "string" },
time: { type: "string" },
party_size: { type: "integer" },
name: { type: "string" },
},
required: ["date", "time", "party_size", "name"],
},
},
server: { url: "https://api.yourdomain.com/calendar/book" },
}],
},
voice: { provider: "11labs", voiceId: "Rachel", model: "eleven_flash_v2_5" },
firstMessage: "Hi! Thanks for calling. How can I help with your reservation?",
});
console.log(`Assistant ready: ${assistant.id}`);Bland AI (Python)
import os
import requests
BLAND_KEY = os.environ["BLAND_API_KEY"]
response = requests.post(
"https://api.bland.ai/v1/calls",
headers={"authorization": BLAND_KEY},
json={
"phone_number": "+15555550123",
"task": "You are a friendly host taking dinner reservations...",
"voice": "rachel",
"model": "enhanced",
"language": "en-US",
"tools": [{
"name": "bookReservation",
"description": "Book a reservation",
"url": "https://api.yourdomain.com/calendar/book",
"method": "POST",
"input_schema": {
"date": "string", "time": "string",
"party_size": "integer", "name": "string",
},
}],
# For production: build a Pathway and reference pathway_id instead.
},
)
print(response.json())Co nás při stavbě všech tří zaujalo: SDK Retell je nejčistší, typované odpovědi, rozumné výchozí hodnoty, přepisy přicházejí bez extra zapojení. JSON konfigurace Vapi je nejflexibilnější, ale upovídaná; budete mít checked-in soubor assistant.config.ts. Design Bland založený na REST působí zastarale, nemá first-party Python klienta na stejné úrovni a autorství Pathway žije v jejich webovém UI. Autentizační toky: Retell používá bearer tokeny přes SDK, Vapi používá bearer tokeny, Bland používá hlavičku authorization s raw klíčem.
Dokumentace zkřížena s referencí API Retell, API asistentů Vapi a dokumentací API Bland. Pokud chcete hlubší ponor do toho, jak definice nástrojů skutečně spouští LLM, náš průvodce voláním funkcí LLM prochází schématy. Chcete MCP servery jako nástroje místo surového HTTP? Retell nativně podporuje MCP dnes, viz náš průvodce Model Context Protocol (MCP) pro nastavení.
Realita telefonie a compliance: HIPAA, TCPA, A2P 10DLC, STIR-SHAKEN
Compliance je místo, kde projekty hlasových agentů zmeškávají termíny spuštění, ne prompty. Retell a Bland řeší A2P 10DLC a attestaci STIR-SHAKEN prostřednictvím svého spravovaného vztahu s Twilio. Model Vapi BYO-Twilio znamená, že se registrujete sami, což je proces na 2 týdny. HIPAA BAA jsou standardem u Retell a Bland; Vapi je přidává na Enterprise. Otázka „která hlasová AI je kompatibilní s HIPAA“ má tři různé odpovědi v závislosti na vaší úrovni.

Matice HIPAA. Retell nabízí BAA na standardním placeném tieru. Bland nabízí BAA na standardních placených plánech. Vapi reklamuje HIPAA pouze na plánu Enterprise, s doplňkem kolem 1 000 $/měsíc podle jejich dokumentace v době psaní. Když jsme poprvé nasazovali agenta v oblasti zdravotnictví na Vapi, zjistili jsme, že BAA není na standardním tieru, což oddálilo spuštění o tři týdny, zatímco procurement sháněl Enterprise.
Realita TCPA pro odchozí hovory. Pokuty činí 500–1 500 $ za porušení podle primeru FCC TCPA. Prověrka seznamu DNC je vaší zodpovědností, žádná ze tří platform ji za vás defaultně neprovádí. Bland vystavuje kontroly DNC před hovorem jako flag. Retell očekává, že provedete prověrku upstream. Vapi očekává, že provedete prověrku upstream a vlastníte záznam o souhlasu.
A2P 10DLC. Podle přehledu A2P 10DLC od Twilio registrujete značku (15 $) a jednu nebo více kampaní (1,50 $/měsíc každá). Bland a Retell registrují za vás prostřednictvím svého vztahu sub-účtu Twilio, typická lhůta je 3–5 pracovních dnů. Vapi vyžaduje, abyste se registrovali sami ve své konzoli Twilio, typická lhůta je ~2 týdny, protože fronta recenzí TCR u Twilia je pomalá.
Attestace STIR-SHAKEN. Attestace úrovně A je vyžadována, aby se předešlo štítku „Spam Likely“, který sráží míru přijetí hovorů. Retell a Bland vyjednávají úroveň A prostřednictvím svého spravovaného carrieru. Vapi BYO-Twilio znamená, že vaše úroveň attestace závisí na stavu vašeho účtu Twilio, viz přehled FCC STIR/SHAKEN. Nové účty Twilio defaultně začínají na B nebo C, dokud nenabudete historii objemu hovorů.
Zveřejnění nahrávání. Dvanáct států USA vyžaduje souhlas obou stran pro nahrávání hovorů: Kalifornie, Florida, Illinois, Maryland, Massachusetts, Michigan, Montana, Nevada, New Hampshire, Pensylvánie, Washington, Connecticut. Zaveďte zveřejnění do prvního obratu vašeho agenta, každý hovor, bez výjimek. Mezinárodně: Retell a Bland podporují KYC pro USA, UK, AU a části EU; Vapi podporuje to, co podporuje Twilio pro váš účet.
Kdy (a kdy NE) používat každou platformu
Retell vítězí pro spravované příchozí telefonní agenty do 50 tisíc min/měsíc. Vapi vítězí, když máte inženýrskou kapacitu spravovat 5 faktur od vendorů a chcete plnou kontrolu nad LLM. Bland vítězí pro vysoký objem odchozích hovorů (1 000+ souběžně) s deterministickými toky. Všechny tři prohrávají, pokud není compliance naplánována předem. Odpovědí na otázku retell vs vapi pro odchozí volání je „ve skutečnosti Bland“, pokud nepotřebujete BYO LLM.
| Případ použití | Retell | Vapi | Bland |
|---|---|---|---|
| Příchozí zákaznický servis (spravovaný) | ✓✓ | záleží | ✗ |
| Odchozí hovory při 1 000+ souběžně | záleží | záleží | ✓✓ |
| Zdravotnictví / standard HIPAA | ✓✓ | záleží (Enterprise) | ✓✓ |
| Vlastní LLM (Claude / open-source) | ✗ | ✓✓ | ✗ |
| Rezervace v restauraci / příchozí | ✓✓ | ✓ | ✗ |
| Předávání mezi více agenty (prodej→podpora) | záleží | ✓✓ | záleží |
| Vícejazyčnost (>30 jazyků) | ✓ | ✓✓ | záleží |
| Nejrychlejší cesta z dema do produkce | ✓✓ | ✗ | ✓ |
Přeskočte Retell, pokud... potřebujete jakýkoliv libovolný LLM (Retell podporuje kurátorský seznam, ne „jakýkoliv model“), pokud potřebujete self-hosted modely z důvodu rezidence dat, nebo pokud jste primárně zaměřeni na odchozí hovory s objemem větším než 50 tisíc minut měsíčně. Retell umí odchozí hovory; prostě to není architektura, kterou byste vybrali od nuly.
Přeskočte Vapi, pokud... nemáte alespoň jednoho senior inženýra, který aktivně chce vlastnit pět vztahů s vendory plus účet Twilio. Flexibilita Vapi je skutečná a stejně tak je skutečná daň v podobě operační zátěže. Týmy, které najmou Vapi a nemají vyhrazeného vlastníka, nasazují pozdě a nad rozpočet pokaždé.
Přeskočte Bland, pokud... je váš případ použití primárně příchozí, nebo pokud potřebujete sofistikované sdílení kontextu mezi více agenty. Zkušenost Bland s příchozími hovory existuje, ale působí jako přilepená. Pokud je vaše roadmapa 60 % příchozí a 40 % odchozí, budete bojovat s defaulty Bland po celou cestu.
Vendor lock-in a cesty migrace
Migrace mezi platformami pro hlasové agenty je možná, ale drahá. Prompty a design konverzace portujete přímo. Integrace nástrojů, grafy workflow (Pathways/Squads/Flows) a kontrakty webhooků je třeba přestavět. Počítejte s 2–4 týdny přestavby pro jakoukoliv změnu platformy, plus 2 týdny, pokud měníte také poskytovatele telefonie.
Bland → Vapi. Přestavíte Pathways jako Squads (logika grafu nepřežije; prompty ano). Telefonie zůstane na místě, pokud jste již na straně Bland používali BYO Twilio. Očekávejte 3 týdny inženýrství + 1 týden evaluace pro dosažení parity produkce.
Vapi → Retell. Vzdáte se BYO LLM a získáte spravovanou telefonii. Prompty portujete přímo. Definice nástrojů je třeba přeformátovat ze schématu JSON Vapi do tvaru general_tools Retell. Portování čísel Twilio trvá samostatně ~10 pracovních dnů.
Retell → Vapi. Získáte kontrolu a ztratíte spravované Twilio. Znovu registrujete A2P 10DLC od nuly, což znamená zhruba 2 týdny downtime registrace, kdy odchozí hovory končí jako „Spam Likely“, dokud se nevybuduje vaše nová attestace.
Co přežije migraci: prompty, design konverzace, evaluační dataset, přepisy, vaše klony hlasů (ID hlasů ElevenLabs jsou přenosná). Co nepřežije: integrace nástrojů, grafy workflow, telefonní čísla (někdy přenosná na SLA 10 dnů), kontrakty webhooků, vaše reputace STIR-SHAKEN.
Co třeba ElevenLabs Conversational AI?
Pokud hledáte retell ai vs vapi vs elevenlabs, zde je rámec, který nikdo jasně neuvádí: ElevenLabs Conversational AI je zaměřeno na kvalitu hlasu, ne na telefonii. Většina produkčních týmů používá ElevenLabs jako TTS vnitř agenta Vapi nebo Retell, jsou to doplňky, ne čistí konkurenti. ElevenLabs Conv vyniká pro hlas v aplikaci (web SDK, mobile SDK), kde nepotřebujete PSTN telefonii, A2P 10DLC ani STIR-SHAKEN. Pokud hodnotíte ElevenLabs Conversational AI jako čtvrtou platformu, samostatné srovnání ElevenLabs vs Vapi vs Synthflow je v pipeline clusteru, odkaz se aktivuje, až bude publikován.
<!-- CONDITIONAL: activate after P1-3 ships: /en/blog/elevenlabs-vs-vapi-vs-synthflow -->Co skutečně říkají stavitelé (Reddit & upřímný názor komunity)
Získali jsme sentiment retell ai vs vapi reddit z vláken r/voiceAI, r/SaaS a Hacker News z února a května 2026. Tři vzorce, které nejčastěji slyšíme od týmů, které nasadily (ne od týmů stále ve fázi dema):
O Retell: „Spravovaný stack je výhra. Nasadili jsme příchozí hovory za tři týdny. Zeď, do které jsme narazili, byla, když náš vertikál zdravotnictví potřeboval self-hosted LLM, nemohli jsme ho mít. Migrace na Vapi proběhla o šest měsíců později.“, parafrázovaný vzorec z více vláken r/voiceAI.
O Vapi: „Miluji to a nenávidím to. Flexibilita je skutečná. Stejně tak je skutečná zpráva na Slacku v 11 večer, protože Twilio rozhodlo, že naše registrace A2P potřebuje další dokumenty. Pokud jste solo zakladatel, toto není vaše platforma.“, recurring sentiment na Hacker News.
O Bland: „Pathways působí magicky pro prvních 30 uzlů. Po 60 uzlech se náš tok změnil v nečitelný graf a regresí každý pátek. Interně jsme přidali vlastní diff tool jen pro bezpečné nasazení.“, recurring vzorec napříč vlákny r/SaaS.
Napříč týmy, kterým jsme pomohli migrovat, je vzorec konzistentní: nikdo nelituje startu na spravované platformě, která odpovídala jeho případu použití; každý lituje startu na platformě, jejíž marketing odpovídal jeho případu použití.
Často kladené otázky
Která platforma má nejnižší naměřenou latenci?
Vapi dosahuje mediánové latence ~500–700 ms, když je vyladěno s Deepgram Nova-3, GPT-4o-mini a ElevenLabs Flash. Defaultní stack Retell naměřil ~600–620 ms přímo z krabice. Bland se pohybuje na ~700–900 ms v závislosti na hloubce Pathway. Volba LLM dominuje rozpočtu, Claude Opus 4.7 přidá ~200 ms oproti GPT-4o-mini na každé platformě.
Která je nejlevnější při 10 tisících hovorů měsíčně?
Při 10 000 hovorech × 4 minuty (40 tisíc minut) fakturuje Retell celkem kolem 2 800 $/měsíc. Bland na plánu Scale běží na 3 600–4 400 $/měsíc. Titulní cena Vapi 0,05 $/min se změní na 7 200–8 800 $/měsíc, jakmile přidáte Deepgram, GPT-4o-mini realtime, ElevenLabs Flash a Twilio. Odpovědí na cenění retell ai vs vapi vs bland 2026 je: Retell pro spravované příchozí hovory, Bland pro odchozí, Vapi pouze ve velkém měřítku.
Je Retell, Vapi nebo Bland kompatibilní s HIPAA?
Retell nabízí BAA na standardním placeném tieru. Bland nabízí BAA na standardních placených plánech. Vapi nabízí HIPAA pouze na Enterprise, typicky s doplňkem kolem 1 000 $/měsíc podle dokumentace Vapi. Pokud je zdravotnictví vaším vertikálem, Retell a Bland jsou bezpečnější defaulty, Vapi přidává třecí plochy v procurement, které možná nemáte v rozpočtu.
Které platformy podporují odchozí volání při 1 000+ souběžných hovorech?
Bland je účelově built pro odchozí hovory s vysokou konkurencí, jejich architektura Pathways a spravované Twilio jsou laděny pro 1 000+ souběžných hovorů. Retell podporuje odchozí hovory prostřednictvím Twilio, ale není optimalizován pro tento vzor. Vapi umí odchozí hovory s vysokou konkurencí, ale přinášíte si účet Twilio, vztahy s carriery a infrastrukturu pro škálování sami.
Mohu použít svůj vlastní LLM (Claude, GPT-5, open-source) na každé z nich?
Vapi podporuje jakéhokoliv providera LLM, OpenAI, Anthropic, Groq, Together, váš vlastní self-hosted endpoint. Retell podporuje kurátorský seznam (OpenAI, Anthropic, Google), ale ne self-hosted. Bland používá svůj vlastní stack bez možnosti BYO. Pokud je flexibilita modelu tvrdým požadavkem, Vapi je jediná realistická odpověď.
Která platforma podporuje MCP servery jako nástroje?
Retell nativně podporuje MCP (Model Context Protocol) servery jako nástroje v roce 2026, což je nejčistší způsob sdílení nástrojů napříč vaším stackem agentů. Vapi podporuje MCP prostřednictvím vlastních HTTP nástrojů, nasměrujete definici nástroje na MCP gateway. Bland je pouze webhook-only a zatím nemá first-class podporu MCP. Viz náš průvodce MCP pro integrační vzor.
Jak dlouho trvá nasazení produkčního hlasového agenta?
Demo-funkční hovor: 15–30 minut na všech třech. Produkčně připraveno (s zajištěnou telefonií, běžícími evaluacemi, nastaveným monitorováním): Retell typicky 2–6 týdnů. Vapi 4–10 týdnů kvůli sestavování BYOK stacku. Bland 3–6 týdnů. Rozdílovým faktorem málokdy bývá platforma, ale spíše to, zda máte vlastníka pro compliance telefonie a evaluační pipeline.
Mohu migrovat z Vapi na Retell (nebo naopak)?
Ano, ale počítejte s 2–4 týdny inženýrství pro jakoukoliv změnu platformy. Prompty a design konverzace portujete přímo. Integrace nástrojů, grafy workflow a kontrakty webhooků je třeba přestavět. Pokud také měníte poskytovatele telefonie, přidejte další 2 týdny na re-registraci A2P 10DLC a obnovu reputace STIR-SHAKEN.
Podporuje každá z nich vícejazyčné hlasové agenty?
Vapi podporuje 100+ jazyků prostřednictvím vaší volby providera LLM a TTS, praktické pokrytí závisí na tom, které hlasy TTS vyberete. Retell podporuje 30+ jazyků s kurátorskými možnostmi hlasů. Bland je English-first a expanduje; podpora jiných jazyků existuje, ale působí méně uhlazeně. Pro skutečnou multilingvní produkci je Vapi nejflexibilnější.
Jaký je rozdíl mezi Pathways, Squads a Conversation Flow?
Bland Pathways jsou deterministické toky grafů uzlů pro skriptované odchozí hovory. Vapi Squads jsou konstelace více agentů s předáváním a sdíleným kontextem, dobré pro převody z prodeje na podporu. Retell Conversation Flow je vizuální tvůrce podpořený prompty plus nástroji, nejrychlejší na nasazení, ale s omezeným větvením. Viz sekce pracovních primitiv výše pro úplné srovnání režimů selhání.
Která je nejlepší specificky pro restaurace nebo zubní kliniky?
Pro příchozí rezervace v restauracích vítězí Retell díky času na nasazení a spravované telefonii. Pro správu schůzek na zubních klinikách s intake formuláři sousedícími s HIPAA nabízejí Retell i Bland standardní BAA, které si Vapi vyhrazuje pro Enterprise. Vertikálně specifické hluboké ponory do restaurací a zubních klinik jsou další v clusteru.
<!-- CONDITIONAL: activate after P0-3 ships: /en/blog/ai-voice-agent-restaurants -->Co třeba ElevenLabs Conversational AI? Je to skutečný konkurent?
ElevenLabs Conversational AI je skutečná platforma, ale soutěží v jiné ligě, zaměřené na kvalitu hlasu, in-app SDK, bez stacku PSTN telefonie. Většina produkčních týmů používá ElevenLabs jako vrstvu TTS uvnitř agenta Vapi nebo Retell, nikoliv jako samostatnou platformu pro telefonní agenty. Pokud nepotřebujete skutečná telefonní čísla, ElevenLabs Conv stojí za přímé zhodnocení.
Výběr platformy je 10 % práce
Výběr platformy je ta snadná část, možná 10 % práce. Zbývajících 90 % tvoří návrh promptů laděných pro hlas (žádný markdown, krátké obraty, explicitní tokeny přerušení), zajištění telefonie (KYC, A2P 10DLC, attestace STIR-SHAKEN), evaluační pipeline pro přepisy a přesnost volání nástrojů, automatizace workflow po hovoru, monitorování a 24/7 SLA. Nic z toho není v krabici.
Techsy buduje produkční hlasové agenty na všech třech platformách, vybíráme Retell, Vapi nebo OpenAI Realtime poté, co pochopíme váš případ použití, ne předtím. Pokud raději přeskočíte maraton evaluace platformy a křivku učení compliance, podívejte se, jak stavíme hlasové agenty.