Ajoxi
  • Pijler
    CLOUD-TELEFOON

    Cloudtelefoon, messaging, video, fax, chat: de volledige UCaaS-stack.

    • Virtueel telefoonnummerLokale en gratis nummers, waar dan ook
    • Zakelijke telefoonBellen, sms'en, video, één login
    • KlantbetrokkenheidElk kanaal, één draad
    • Persoonlijke AIAI-sidekick voor elke vertegenwoordiger
    • SMS & MMSTekst van de belangrijkste zakelijke lijn
    • TeamchatInterne chat, verbonden met klanten
    • VideovergaderingenKamers met AI-notities + samenvatting
    • OnlinefaxFaxen zonder faxapparaat
    • Website-chatbotLost de bestelstatus en retourzendingen automatisch op
    • TelefoonsysteemModerne telefooncentrale met ingebouwde AI
    Uitgelicht
    Alles inbegrepen.
    Cloudtelefoon, AI-contactcentrum, AI-receptionist, sms, video, meer dan 300 integraties.
    Zie abonnementen en prijzen
  • Kerncapaciteiten
    • AI-receptioniste24/7 eerste antwoord · 32 talen
    • AI-sentimentLeidt overstuurde bellers automatisch door
    • AI-agentassistentieFluisterscripts + volgende beste actie
    • Conversatie IntelligentieAfschriften, sentiment, bezwaren
    • Opname van gesprekkenVolledige betrouwbaarheid + zoeken op trefwoorden
    • Automatische assistentVisuele IVR-bouwer met slepen en neerzetten
    • Hulpmiddelen voor toezichthoudersLuister · fluister · binnenschip · auditlogboek
    • Gratis nummers800, 888, 877 — snel bevoorraad
    Nieuw
    AI-sentiment · live scoren.
    Leidt klanten van streek naar senior agenten op het moment dat het sentiment daalt. Op elk betaald abonnement.
    Zie AI-sentiment
  • Per branche en team
    • FinanciënSOC 2 · FINRA-ready audittrails
    • DetailhandelOmnichannel + SMS voor herstel van winkelwagen
    • SaaSAPI's + Persoonlijke AI op elke stoel
    • LogistiekVerzendingsroutering naar meerdere locaties
    • VerkoopteamsKrachtige dialer + live AI-coaching
    • OndersteuningsteamsGedeeld geheugen over 8 kanalen
    • Externe teamsHetzelfde nummer op elk apparaat
    • MKBAI-receptionist als uw receptie
    • Enterprise-ITSSO, SCIM, beheer van meerdere locaties
    De meeste aangenomen
    Een aanroepstack-nalevingsvertrouwen.
    Gespreksopname, ROEREN/SCHUDDEN, sentimentroutering. SOC 2-, PCI- en FINRA-ready audittrails.
    Zie financiën
  • Native synchronisatie
    • HubSpotTweerichtingssynchronisatie · levenscyclustriggers
    • ZohoCRM · Bureau · Boeken · Bigin
    Binnenkort beschikbaar
    Salesforce. Pijpaandrijving. Versverkoop.
    Alle drie de native tweerichtingssynchronisaties in het derde kwartaal van 2026. Wilt u op de hoogte worden gehouden van de lancering?
    E-mail mij bij de lancering
  • Prijzen
  • Leren
    • BloggenTechnische en productnotities
    • KlantverhalenEchte resultaten, echte cijfers
    • GidsenStap-voor-stap draaiboeken
    • WebinarsLive elke donderdag · on-demand
    • Neem contact met ons opPraat met de verkoopafdeling of krijg ondersteuning
    Bouwen
    • DocumentenHoe alles werkt
    • API-referentieREST + webhooks
    • SDK'sKnooppunt, Python, Go, Ruby
    • WijzigingslogElk schip, op één plek
    Vertrouwen
    • StatuspaginaLive uptime + incidenten
    • Beveiliging + nalevingSOC 2 · AVG · PCI
    • PrivacyWat we verzamelen en waarom
    • VoorwaardenHet contract, in hoofdstukken
    Verse inkt
    8.400 oproepen, gemeten.
    Nauwkeurigheid van AI-receptionisten op basis van taal, accent en oproeptype: de onbewerkte nummers.
    Lees het bericht
  • English flagEngels
  • Español flagSpaans
  • Français flagFrans
  • Deutsch flagDuits
  • Italiano flagItaliaans
  • Português flagPortugees
  • Nederlands flagNederlands
  • Русский flagРусский
  • Polski flagPolski
  • Türkçe flagTurkçe
  • العربية flagالعربية
  • हिन्दी flagJa
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonesië
  • ไทย flagไทย
  • Svenska flagZweeds
  • Українська flagУкраїнська
Log inGratis proefperiode
Cloud-telefoon
Virtueel telefoonnummerLokale en gratis nummers, waar dan ookZakelijke telefoonBellen, sms'en, video, één loginKlantbetrokkenheidElk kanaal, één draadPersoonlijke AIAI-sidekick voor elke vertegenwoordigerSMS & MMSTekst van de belangrijkste zakelijke lijnTeamchatInterne chat, verbonden met klantenVideovergaderingenKamers met AI-notities + samenvattingOnlinefaxFaxen zonder faxapparaatWebsite-chatbotLost de bestelstatus en retourzendingen automatisch opTelefoonsysteemModerne telefooncentrale met ingebouwde AI
Contactcentrum
OmnichannelEén wachtrij voor elk kanaalUitgaande kiezerVoorspellend, krachtig, previewAgent-assistentieLive fluistercoachingBegeleider assisterenOntdek slechte oproepen in realtimeInteractieanalyseAuto-QA, onderwerptrendsOnderneming500+ stoelbedieningen
AI-familie
Ajoxi-stemAI-receptioniste die afspraken boektAI-assistentConcepten, samenvattingen, vervolgactiesGesprek AILeest elke oproep, zodat u niets mist
AI-receptioniste24/7 eerste antwoord · 32 talenAI-sentimentLeidt overstuurde bellers automatisch doorAI-agentassistentieFluisterscripts + volgende beste actieConversatie IntelligentieAfschriften, sentiment, bezwarenOpname van gesprekkenVolledige betrouwbaarheid + zoeken op trefwoordenAutomatische assistentVisuele IVR-bouwer met slepen en neerzettenHulpmiddelen voor toezichthoudersLuister · fluister · binnenschip · auditlogboekGratis nummers800, 888, 877 — snel bevoorraad
FinanciënSOC 2 · FINRA-ready audittrailsDetailhandelOmnichannel + SMS voor herstel van winkelwagenSaaSAPI's + Persoonlijke AI op elke stoelLogistiekVerzendingsroutering naar meerdere locatiesVerkoopteamsKrachtige dialer + live AI-coachingOndersteuningsteamsGedeeld geheugen over 8 kanalenExterne teamsHetzelfde nummer op elk apparaatMKBAI-receptionist als uw receptieEnterprise-ITSSO, SCIM, beheer van meerdere locaties
HubSpotTweerichtingssynchronisatie · levenscyclustriggersZohoCRM · Bureau · Boeken · Bigin
Leren
BloggenTechnische en productnotitiesKlantverhalenEchte resultaten, echte cijfersGidsenStap-voor-stap draaiboekenWebinarsLive elke donderdag · on-demandNeem contact met ons opPraat met de verkoopafdeling of krijg ondersteuning
Bouwen
DocumentenHoe alles werktAPI-referentieREST + webhooksSDK'sKnooppunt, Python, Go, RubyWijzigingslogElk schip, op één plek
Vertrouwen
StatuspaginaLive uptime + incidentenBeveiliging + nalevingSOC 2 · AVG · PCIPrivacyWat we verzamelen en waaromVoorwaardenHet contract, in hoofdstukken
  • English flagEngels
  • Español flagSpaans
  • Français flagFrans
  • Deutsch flagDuits
  • Italiano flagItaliaans
  • Português flagPortugees
  • Nederlands flagNederlands
  • Русский flagРусский
  • Polski flagPolski
  • Türkçe flagTurkçe
  • العربية flagالعربية
  • हिन्दी flagJa
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonesië
  • ไทย flagไทย
  • Svenska flagZweeds
  • Українська flagУкраїнська
Log inGratis proefperiode
Ajoxi

Cloudtelefoon en AI-contactcenter op één carrier-grade netwerk.

SOC 2AVGPCI-DSS

Suite C, verdieping 7, World Trust Tower,
Stanley Street 50, Centraal,
Hongkong

info@ajoxi.com+1 (512) 612-4425

Cloud-telefoon

  • Zakelijke telefoon
  • Klantbetrokkenheid
  • SMS & MMS
  • Teamchat
  • Videovergaderingen
  • Telefoonsysteem

Contactcentrum

  • Omnichannel
  • Uitgaande kiezer
  • Agent-assistentie
  • Interactieanalyse
  • Enterprise CCaaS

AI

  • AI-platform
  • AI-receptioniste
  • AI-assistent
  • Conversatie-AI
  • AI-sentiment
  • Conversatie Intelligentie

Oplossingen

  • Financiën
  • Detailhandel en eCom
  • SaaS en technologie
  • Verkoopteams
  • MKB

Wederverkoper

  • Groothandel VoIP
  • Groothandel stem
  • SIP-trunking
  • CLI-routes

Bedrijf

  • Prijzen
  • Over
  • Klanten
  • Neem contact met ons op
  • Landcodes
  • Netnummers
  • Documenten
  • Status
  • Beveiliging

© 2026 Ajoxi. Alle rechten voorbehouden.

Alle systemen normaal
  • Privacy
  • Voorwaarden
  • Sitemap
Bloggen/AI/We hebben de nauwkeurigheid van de AI-receptionist gemeten bij 8.400 echte oproepen

We hebben de nauwkeurigheid van de AI-receptionist gemeten bij 8.400 echte oproepen

Drie maanden lang hebben we elk gesprek dat de AI afhandelde bijgehouden – op taal, op accent, op gesprekstype – en de transcriptie beoordeeld aan de hand van een menselijke recensent. De nauwkeurigheidscijfers waren beter dan we hadden verwacht. De faalmodi waren interessanter.

Inhoudsopgave
  • 1.Invoering
  • 2.Hoe we proefden en beoordeelden
  • 3.De kopnummers
  • 4.Taal en accent
  • 5.De vijf faalmodi
  • 6.Wat we daardoor hebben verzonden
  • 7.Menselijke grader-drift
  • 8.Wat we hierna gaan meten

Invoering

De meeste ‘AI-nauwkeurigheid’-cijfers die u in marketingteksten leest, zijn stilletjes betekenisloos. Ze benchmarken een model op een schone dataset, beoordelen de dataset met zichzelf en produceren een getal dat vrijwel niets te maken heeft met hoe het systeem presteert op een dinsdagmiddag wanneer een klant vanuit een luidruchtig magazijn belt en drie vragen tegelijk stelt.

We wilden een nummer dat iets betekende. Dus gedurende drie maanden tussen januari en maart 2026 werd elk telefoontje dat onze AI-receptionist binnen de productievloot afhandelde (in totaal 8.427 oproepen) getranscribeerd, in realtime door de AI beoordeeld en vervolgens onafhankelijk opnieuw beoordeeld door een menselijke recensent die het AI-oordeel nooit heeft gezien.

We hielden de taal, het accent (waar herkenbaar), het type oproep, het tijdstip, de lengte en het specifieke pad dat het gesprek volgde bij.

Het ging er niet om een ​​vleiend cijfer te publiceren. Het punt was om de oproepen te vinden waarvan de AI dacht dat het was gelukt en fout was, en de oproepen waarbij de AI het probleem van de klant echt had opgelost, maar onze interne statistieken het als een misser hadden gemarkeerd. Beide klassen waren groter dan we hadden verwacht.

Hoe we de oproepen hebben bemonsterd en beoordeeld

Er waren drie regels. In de eerste plaats: geen sprake van 'cherry-picking': elk gesprek gedurende de hele periode kwam in aanmerking, inclusief de 47 gesprekken die midden in het gesprek vastliepen en de 312 die binnen de eerste 15 seconden naar een mens werden doorverbonden. Ten tweede waren de menselijke beoordelaars blind voor de zelfbeoordeling van de AI. Ze beoordeelden de transcriptie op basis van de bedoelingen van de klant, en niet op basis van wat de AI beweerde te hebben gedaan.

Ten derde werd de rubriek gepubliceerd voordat er naar gegevens werd gekeken, om te voorkomen dat we 'succes' stilletjes opnieuw gingen definiëren zodra de cijfers binnenkwamen.

Elke oproep werd gescoord op drie onafhankelijke dimensies:

  • Intentie vastleggen — heeft de AI correct geïdentificeerd wat de beller eigenlijk probeerde te doen? (Binair: ja/nee.)
  • Voltooiing van de taak — werd de door de beller aangegeven behoefte daadwerkelijk opgelost tijdens dit gesprek, of was er een menselijke follow-up voor nodig waar de beller niet om vroeg?
  • Gesprekshygiëne – was de transcriptie vrij van hallucinaties, valse beloften of tegenstrijdigheden? Beoordeeld van 1–5 door de recensent.

Een oproep werd alleen als een "overwinning" geteld als deze alle drie de punten had behaald: correcte intentie, voltooide taak, hygiënescore van 4 of 5. De derde poort is degene die stilletjes oproepen elimineerde die we anders successen zouden hebben genoemd.

De kopnummers

Voor de volledige dataset met 8.427 oproepen heeft de AI alle drie de poorten vrijgegeven 91.4% van oproepen. Dat aantal was hoger dan we intern hadden voorspeld – de meesten van ons hadden weddenschappen tussen de 85 en 88%.

De kloof tussen onze voorspelling en het resultaat was niet een model dat beter werd dan we hadden verwacht; het was dat onze intuïtie werd gevormd door de oproepen die we ons herinnerden, en die onevenredig slecht waren.

Uitgesplitst naar type oproep was het verschil aanzienlijk:

  • Afspraak boeken — 96,1% (het eenvoudigste pad, goed ingestudeerde bedoeling)
  • Algemene informatie — 93,8% (uren, locatie, diensten)
  • Prijsvragen — 89,2% (sommige prijstrajecten vereisten ondubbelzinnigheid)
  • Annulering/verplaatsing — 87.6%
  • Klachten en escalaties — 78.3%
  • Oproepen met meerdere kwesties — 71,9% (twee of meer onafhankelijke intenties in dezelfde oproep)

Het zijn de klachten- en multi-issuenummers waar we ons op hebben gericht. Een 96% cijfer voor het boeken van afspraken is wat we verzenden om deals te winnen; een aantal van 72% op oproepen met meerdere nummers is wat we verzenden om ze te behouden.

Taal en accent: waar de verrassingen woonden

We zijn actief in 32 talen en publiceren één nauwkeurigheidsgetal per taal. De totale kloof tussen onze beste taal (Engels-VS) en onze slechtst ondersteunde taal (Vietnamees) bedroeg 4,1 procentpunten – kleiner dan we hadden verwacht, en kleiner dan we in gepubliceerde academische benchmarks hebben gezien.

Maar de totale taalscores verbergen het deel van het probleem dat er werkelijk toe doet: accentvariantie binnen één taal. Engelse gesprekken afgehandeld in de Verenigde Staten scoorden 92,7%. Engelse gesprekken van Indiaas-Engelssprekende klanten scoorden 91,3% – ruim binnen de ruis. Engelse oproepen van sterk regionaal Schots-Engelssprekenden scoorden 83,4%. Dat is een verschil van 9 punten, en het bevindt zich volledig in de kolom met het label 'Engels'.

Het punt is niet dat ons model slecht is in het Schots Engels. Het punt is dat het publiceren van een nummer per taal, terwijl de accentvariantie niet wordt gemeten, een manier is om de oproepen te verbergen waar uw AI niet in slaagt. We rapporteren accentverschillen nu intern en we verwachten dit binnen twee kwartalen extern te publiceren.

De vijf faalwijzen die 80% van de missers verklaarden

Toen we de 723 gemiste oproepen (8,6% van de dataset) bundelden, waren vijf storingsmodi verantwoordelijk voor 81% daarvan. Geen van deze zal iemand verrassen die eerder stem-AI heeft verzonden, maar de relatieve gewichten hebben ons wel verrast.

1. Intentiestapeling (29% van de missers)

De beller heeft twee of meer intenties en de AI verbindt zich tot de eerste voordat hij klaar is met het vermelden van de tweede. "Ik wil mijn afspraak verzetten en verkoop je ook het X-100-model" is precies het soort input dat de gespreksstatus vernietigt.

2. Impliciete contextdaling (22%)

De beller verwijst naar iets dat eerder in het gesprek is gezegd en dat de AI niet als context heeft opgeslagen: een naam, een prijs, een datum. Dit is de faalmodus die het contextvenster van de volgende generatie het meest direct aanpakt.

3. Beller heeft over de prompt gesproken (15%)

Eindpuntfouten. De AI begint te spreken, de beller praat eroverheen, de AI hoort zijn eigen stem vermengd met die van de beller en maakt een transcript waarin de helft van de invoer ontbreekt.

4. Fouten bij het teruglezen van nummers (9%)

De beller dicteert een telefoonnummer of adres. AI leest het terug. De beller corrigeert één cijfer. AI werkt het verkeerde cijfer bij. Dit is een 100% oplosbaar probleem met een bevestigingsprompt voor gestructureerde gegevens, en we hebben er in februari een verzonden.

5. Valse overdracht (6%)

De AI identificeert correct dat het de oproep niet kan oplossen en wordt doorverbonden, maar de doorschakelroutering stuurt het naar de verkeerde wachtrij. Dit is niet echt een AI-fout; het is een mislukking van het belplan die de AI blootlegt.

Wat we hebben verzonden vanwege dit onderzoek

Drie verzonden wijzigingen kwamen rechtstreeks uit het onderzoek voort en een vierde is in ontwikkeling. We hebben geprobeerd om per foutmodus de oplossing met de hoogste hefboomwerking te leveren in plaats van de academisch interessantste.

  • Multi-intent-detector. Een kleine classificatie die parallel loopt met het vastleggen van intenties en uitingen markeert die twee of meer onafhankelijke intenties bevatten. Wanneer dit wordt gemarkeerd, wordt het gesprek onderbroken en zegt de AI expliciet: "Ik heb gehoord dat je een nieuwe afspraak wilt maken en je hebt ook naar de X-100 gevraagd. Laten we eerst de nieuwe afspraak maken - is dat goed?" De classifier voegde 11 ms latentie toe en verminderde intent-stacking-missers met 64%.
  • Gestructureerde nummerbevestiging. Elk telefoonnummer, adres of bedrag wordt nu bij het teruglezen cijfer voor cijfer bevestigd, met een bewerkingshandler van één cijfer. Het aantal gemiste teruglezingen is met 88% gedaald.
  • Herkalibratie van eindpunten. We hebben de stiltedrempel per taal opnieuw afgestemd en een 'Ben je klaar met die gedachte?' toegevoegd. herstel bij vermoedelijke afknotting. Het aantal mislukte gesprekken daalde van 15% naar 9% van de misserset.

De vierde verandering – een rijkere contextbuffer per oproep die impliciete contextdaling aanpakt – is de meest complexe van de vier en wordt in de schaduwmodus uitgeprobeerd tegen een uitgestelde oproep voordat deze live gaat.

Een opmerking over de drift van menselijke graders

Eén kleine bevinding die het vermelden waard is: de menselijke reviewers zwierven, ondanks een gepubliceerde rubriek, door de drie maanden heen. In de eerste maand beoordeelden reviewers 87% van de oproepen als succesvol. In maand drie beoordeelden dezelfde reviewers, die voor de tweede keer willekeurig getrokken oproepen in maand één scoorden, 91% als succesvol. De transcripties waren niet veranderd.

De drift was geen kwade trouw; het was bekendheid. Naarmate recensenten gewend raakten aan de formulering van de AI, werden ze genereuzer op het gebied van gesprekshygiëne. We hebben dit onderkend door een steekproef van 5% van de oproepen in maand één in maand drie opnieuw te scoren, en we hebben het hoofdnummer daarvoor gecorrigeerd. De hierboven gerapporteerde 91,4% is het voor drift gecorrigeerde cijfer. Het ruwe getal was 92,1%.

Als een leverancier een nauwkeurigheidsgetal publiceert zonder te beschrijven hoe hij heeft gecontroleerd op drift door menselijke beoordelaars, is het getal standaard verdacht. Wij hebben dit probleem niet uitgevonden; we hebben er gewoon aandacht aan besteed.

Wat we hierna gaan meten

Drie dingen, in volgorde van prioriteit. Ten eerste de accent-opgeloste nauwkeurigheid binnen elke belangrijke ondersteunde taal – en een publieke toezegging om deze te publiceren zodra de methodologie zich stabiliseert. Ten tweede: nauwkeurigheid van de uitkomst na het gesprek: heeft de beller daadwerkelijk ontvangen waarvoor hij kwam, gemeten 7 en 30 dagen na het gesprek, door afstemming met het downstreamsysteem van de klant.

Ten derde het nummer voor de kosten per opgeloste oproep dat nauwkeurigheid combineert met de economie per minuut – omdat een 98% nauwkeurige AI die €1,40/min kost, verliest van een 92% nauwkeurige AI die €0,18/min kost, voor vrijwel elk echt bedrijf.

We zullen de volgende reeks cijfers in het derde kwartaal publiceren. Als ze achteruitgang vertonen, zullen we dat ook publiceren. Het punt van het meten van dit soort dingen is niet het vinden van een flatterende grafiek; het is het vinden van de telefoontjes die we nog steeds verkeerd krijgen.

Laat je stem horen op Ajoxi.

AI-receptionisten, groothandelsroutes, virtuele nummers – gebouwd op één platform met transparante prijzen en een 24/7 NOC.

Zie prijzen Praat met ons
Blijf lezen

Gerelateerde lectuur

Met de hand uitgekozen volgende artikelen van het Ajoxi-blog.

Why we ship STIR/SHAKEN attestation on day one
Naleving

Waarom we het STIR/SHAKEN-attest op de eerste dag verzenden

De meeste leveranciers van cloudtelefoons beschouwen nummerherkenning als een functie van een hoger niveau. Vervoerders niet. Dit is de reden waarom we dit standaard hebben gemaakt en wat er is veranderd voor de uitgaande antwoordpercentages.

Lees artikel
The case for ranking calls, not sampling them
Product

Het argument voor het rangschikken van oproepen, en niet voor het bemonsteren ervan

Willekeurige steekproeven missen de oproepen die er echt toe doen. We hebben de supervisorconsole opnieuw opgebouwd rond een risicoscore en zijn gestopt met te doen alsof QA een getallenspel was.

Lees artikel
Same latency on Mandarin and English. Here is how
Engineering

Dezelfde latentie voor Mandarijn en Engels. Hier is hoe

Om pariteit in 32 talen te bereiken zonder het model op te blazen, was een modelroutinglaag nodig die we niet hadden zien aankomen. Aantekeningen uit de latentieoorlogskamer.

Lees artikel