Ajoxi
  • Pilar
    TELEFONE NA NUVEM

    Telefone na nuvem, mensagens, vídeo, fax, bate-papo — a pilha completa de UCaaS.

    • Número de telefone virtualNúmeros locais e gratuitos, em qualquer lugar
    • Telefone comercialChamada, SMS, vídeo, um login
    • Engajamento do clienteCada canal, um tópico
    • IA pessoalAjudante de IA para cada representante
    • SMS e MMSTexto da principal linha de negócios
    • Bate-papo em equipeChat interno, vinculado aos clientes
    • VideoconferênciasSalas com notas de IA + recapitulação
    • Fax on-lineFax sem o aparelho de fax
    • Bot de bate-papo do siteResolve automaticamente o status do pedido e devoluções
    • Sistema TelefônicoPBX moderno com IA integrada
    Apresentou
    Tudo incluído.
    Telefone na nuvem, contact center de IA, recepcionista de IA, SMS, vídeo, mais de 300 integrações.
    Veja planos e preços
  • Capacidades principais
    • Recepcionista de IAPrimeira resposta 24 horas por dia, 7 dias por semana · 32 idiomas
    • Sentimento de IAEncaminha automaticamente os chamadores chateados
    • Assistência do agente de IAScripts de sussurro + próxima melhor ação
    • Inteligência de conversaçãoTranscrições, sentimento, objeções
    • Gravação de chamadasFidelidade total + pesquisa por palavra-chave
    • Atendimento automáticoConstrutor visual IVR de arrastar e soltar
    • Ferramentas de supervisãoOuvir · sussurrar · barcaça · registro de auditoria
    • Números gratuitos800, 888, 877 – provisionado rapidamente
    Novo
    Sentimento de IA · pontuação ao vivo.
    As rotas incomodam os clientes para os agentes seniores no momento em que o sentimento diminui. Em todos os planos pagos.
    Veja o sentimento da IA
  • Por indústria e equipe
    • FinanciarSOC 2 · Trilhas de auditoria prontas para FINRA
    • VarejoOmnichannel + SMS de recuperação de carrinho
    • SaaSAPIs + IA pessoal em cada assento
    • LogísticaRoteamento de despacho multisite
    • Equipes de vendasDiscador avançado + treinamento de IA ao vivo
    • Equipes de suporteMemória compartilhada em 8 canais
    • Equipes RemotasO mesmo número em todos os dispositivos
    • PMERecepcionista de IA como sua recepção
    • TI empresarialSSO, SCIM, governança multisite
    Mais adotado
    Uma confiança de conformidade de pilha de chamadas.
    Gravação de chamadas, STIR/SHAKEN, roteamento de sentimento. Trilhas de auditoria prontas para SOC 2, PCI e FINRA.
    Ver finanças
  • Sincronização nativa
    • HubSpotSincronização bidirecional · gatilhos de ciclo de vida
    • ZohoCRM · Secretária · Livros · Bigin
    Em breve
    Força de vendas. Pipedrive. Novas vendas.
    Todas as três sincronizações bidirecionais nativas no terceiro trimestre de 2026. Quer ser avisado sobre o lançamento?
    Envie-me um e-mail no lançamento
  • Preços
  • Aprender
    • BlogueNotas de engenharia e produto
    • Histórias de clientesResultados reais, números reais
    • GuiasManuais passo a passo
    • Seminários on-lineAo vivo todas as quintas-feiras · sob demanda
    • Contate-nosFale com vendas ou obtenha suporte
    Construir
    • DocumentosComo tudo funciona
    • Referência da APIREST + webhooks
    • SDKsNó, Python, Go, Ruby
    • Registro de alteraçõesCada navio, em um só lugar
    Confiar
    • Página de statusTempo de atividade ao vivo + incidentes
    • Segurança + conformidadeSOC 2 · GDPR · PCI
    • PrivacidadeO que coletamos e por quê
    • TermosO contrato, em capítulos
    Tinta fresca
    8.400 ligações, medidas.
    Precisão da recepcionista de IA por idioma, sotaque e tipo de chamada – os números não editados.
    Leia a postagem
  • English flagInglês
  • Español flagEspanhol
  • Français flagFrancês
  • Deutsch flagAlemão
  • Italiano flagItaliano
  • Português flagPortuguês
  • Nederlands flagHolanda
  • Русский flagRusso
  • Polski flagPolaco
  • Türkçe flagTurquia
  • العربية flagالعربية
  • हिन्दी flagAdeus
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonésia
  • ไทย flagไทย
  • Svenska flagSueca
  • Українська flagУкраїнська
EntrarAvaliação Gratuita
Telefone na nuvem
Número de telefone virtualNúmeros locais e gratuitos, em qualquer lugarTelefone comercialChamada, SMS, vídeo, um loginEngajamento do clienteCada canal, um tópicoIA pessoalAjudante de IA para cada representanteSMS e MMSTexto da principal linha de negóciosBate-papo em equipeChat interno, vinculado aos clientesVideoconferênciasSalas com notas de IA + recapitulaçãoFax on-lineFax sem o aparelho de faxBot de bate-papo do siteResolve automaticamente o status do pedido e devoluçõesSistema TelefônicoPBX moderno com IA integrada
Central de contato
OmnicanalUma fila para cada canalDiscador de saídaPreditivo, poderoso, visualizaçãoAssistência ao agenteTreinamento sussurrante ao vivoSupervisor AssistIdentifique chamadas ruins em tempo realAnálise de interaçãoControle de qualidade automático, tendências de tópicosEmpresaMais de 500 operações de assento
Família IA
Voz AjoxiRecepcionista AI que marca compromissosAssistente de IARascunhos, resumos, acompanhamentosIA de conversaçãoLê todas as ligações para que você não perca nada
Recepcionista de IAPrimeira resposta 24 horas por dia, 7 dias por semana · 32 idiomasSentimento de IAEncaminha automaticamente os chamadores chateadosAssistência do agente de IAScripts de sussurro + próxima melhor açãoInteligência de conversaçãoTranscrições, sentimento, objeçõesGravação de chamadasFidelidade total + pesquisa por palavra-chaveAtendimento automáticoConstrutor visual IVR de arrastar e soltarFerramentas de supervisãoOuvir · sussurrar · barcaça · registro de auditoriaNúmeros gratuitos800, 888, 877 – provisionado rapidamente
FinanciarSOC 2 · Trilhas de auditoria prontas para FINRAVarejoOmnichannel + SMS de recuperação de carrinhoSaaSAPIs + IA pessoal em cada assentoLogísticaRoteamento de despacho multisiteEquipes de vendasDiscador avançado + treinamento de IA ao vivoEquipes de suporteMemória compartilhada em 8 canaisEquipes RemotasO mesmo número em todos os dispositivosPMERecepcionista de IA como sua recepçãoTI empresarialSSO, SCIM, governança multisite
HubSpotSincronização bidirecional · gatilhos de ciclo de vidaZohoCRM · Secretária · Livros · Bigin
Aprender
BlogueNotas de engenharia e produtoHistórias de clientesResultados reais, números reaisGuiasManuais passo a passoSeminários on-lineAo vivo todas as quintas-feiras · sob demandaContate-nosFale com vendas ou obtenha suporte
Construir
DocumentosComo tudo funcionaReferência da APIREST + webhooksSDKsNó, Python, Go, RubyRegistro de alteraçõesCada navio, em um só lugar
Confiar
Página de statusTempo de atividade ao vivo + incidentesSegurança + conformidadeSOC 2 · GDPR · PCIPrivacidadeO que coletamos e por quêTermosO contrato, em capítulos
  • English flagInglês
  • Español flagEspanhol
  • Français flagFrancês
  • Deutsch flagAlemão
  • Italiano flagItaliano
  • Português flagPortuguês
  • Nederlands flagHolanda
  • Русский flagRusso
  • Polski flagPolaco
  • Türkçe flagTurquia
  • العربية flagالعربية
  • हिन्दी flagAdeus
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonésia
  • ไทย flagไทย
  • Svenska flagSueca
  • Українська flagУкраїнська
EntrarAvaliação Gratuita
Ajoxi

Telefone na nuvem e contact center de IA em uma rede de nível de operadora.

SOC 2GDPRPCI-DSS

Suíte C, Nível 7, World Trust Tower,
Rua Stanley, 50, Central,
Hong Kong

info@ajoxi.com+1 (512) 612-4425

Telefone na nuvem

  • Telefone comercial
  • Engajamento do cliente
  • SMS e MMS
  • Bate-papo em equipe
  • Videoconferências
  • Sistema Telefônico

Central de contato

  • Omnicanal
  • Discador de saída
  • Assistência ao agente
  • Análise de interação
  • CCaaS empresarial

IA

  • Plataforma de IA
  • Recepcionista de IA
  • Assistente de IA
  • IA conversacional
  • Sentimento de IA
  • Inteligência de conversação

Soluções

  • Financiar
  • Varejo e comércio eletrônico
  • SaaS e tecnologia
  • Equipes de vendas
  • PME

Revendedor

  • VoIP no atacado
  • Voz por atacado
  • Entroncamento SIP
  • Rotas CLI

Empresa

  • Preços
  • Sobre
  • Clientes
  • Contate-nos
  • Códigos de país
  • Códigos de área
  • Documentos
  • Status
  • Segurança

© 2026 Ajoxi. Todos os direitos reservados.

Todos os sistemas normais
  • Privacidade
  • Termos
  • Mapa do site
Blogue/IA/Medimos a precisão da recepcionista de IA em 8.400 chamadas reais

Medimos a precisão da recepcionista de IA em 8.400 chamadas reais

Durante três meses, rastreamos todas as chamadas atendidas pela IA — por idioma, por sotaque, por tipo de chamada — e avaliamos a transcrição com base em um revisor humano. Os números de precisão foram melhores do que esperávamos. Os modos de falha foram mais interessantes.

Índice
  • 1.Introdução
  • 2.Como amostramos e classificamos
  • 3.Os números da manchete
  • 4.Idioma e sotaque
  • 5.Os cinco modos de falha
  • 6.O que enviamos por causa disso
  • 7.Deriva da niveladora humana
  • 8.O que estamos medindo a seguir

Introdução

A maioria dos números de “precisão de IA” que você lê em textos de marketing são silenciosamente sem sentido. Eles avaliam um modelo em um conjunto de dados limpo, avaliam o conjunto de dados em relação a si mesmo e produzem um número que quase nada tem a ver com o desempenho do sistema em uma tarde de terça-feira, quando um cliente está ligando de um armazém barulhento e fazendo três perguntas ao mesmo tempo.

Queríamos um número que significasse alguma coisa. Assim, durante três meses, entre janeiro e março de 2026, todas as chamadas atendidas pela nossa recepcionista de IA em toda a frota de produção — 8.427 chamadas no total — foram transcritas, avaliadas pela IA em tempo real e depois reavaliadas de forma independente por um revisor humano que nunca viu o veredicto da IA.

Rastreamos o idioma, o sotaque (quando identificável), o tipo de chamada, a hora do dia, a duração e o caminho específico que a conversa tomou.

A questão não era publicar um número lisonjeiro. O objetivo era encontrar as chamadas em que a IA achava que tinha sido bem-sucedida e estava errada, e as chamadas em que a IA realmente resolveu o problema do cliente, mas nossas métricas internas as marcaram como erradas. Ambas as turmas eram maiores do que esperávamos.

Como amostramos e classificamos as chamadas

Havia três regras. Primeiro, sem escolha seletiva: todas as chamadas durante o período eram elegíveis, incluindo as 47 chamadas que travaram no meio da conversa e as 312 que foram transferidas para uma pessoa nos primeiros 15 segundos. Em segundo lugar, os revisores humanos estavam cegos à autoavaliação da IA ​​– eles classificaram a transcrição de acordo com a intenção declarada do cliente, e não de acordo com o que quer que a IA alegasse ter feito.

Terceiro, a rubrica foi publicada antes de quaisquer dados serem analisados, para evitar que redefinissemos silenciosamente o “sucesso” assim que os números chegassem.

Cada chamada foi pontuada em três dimensões independentes:

  • Captura de intenção – a IA identificou corretamente o que o chamador estava realmente tentando fazer? (Binário: sim/não.)
  • Conclusão da tarefa — a necessidade declarada do chamador foi realmente resolvida nesta ligação ou exigiu um acompanhamento humano que o chamador não solicitou?
  • Higiene da conversa — a transcrição estava livre de alucinações, falsas promessas ou contradições? Avaliado de 1 a 5 pelo revisor.

Uma chamada só era contada como uma “vitória” se eliminasse todos os três: intenção correta, tarefa completa, pontuação de higiene de 4 ou 5. O terceiro portão é aquele que eliminou silenciosamente as chamadas que de outra forma teríamos chamado de sucessos.

Os números da manchete

Em todo o conjunto de dados de 8.427 chamadas, a IA liberou todos os três portões em 91.4% de chamadas. Esse número foi maior do que previmos internamente – a maioria de nós fez apostas na faixa de 85–88%.

A lacuna entre a nossa previsão e o resultado não foi um modelo melhor do que esperávamos; o problema era que nossa intuição estava sendo moldada pelas ligações que lembrávamos, que eram desproporcionalmente as ruins.

Dividida por tipo de chamada, a variação foi significativa:

  • Marcação de consulta — 96,1% (o caminho mais simples, intenção bem ensaiada)
  • informações gerais — 93,8% (horário, localização, serviços)
  • Consultas de preços — 89,2% (alguns caminhos de preços exigiram desambiguação)
  • Cancelamento/reagendamento — 87.6%
  • Reclamações e escalações — 78.3%
  • Chamadas com vários problemas — 71,9% (duas ou mais intenções independentes na mesma chamada)

Os números de reclamações e multiproblemas são os que nos concentramos. Um número de 96% na reserva de compromissos é o que enviamos para ganhar negócios; um número de 72% em ligações com vários problemas é o que oferecemos para mantê-los.

Linguagem e sotaque: onde moravam as surpresas

Operamos em 32 idiomas e publicamos um único número de precisão por idioma. A diferença agregada entre a nossa melhor língua (Inglês-EUA) e a nossa pior língua suportada (Vietnamita) foi de 4,1 pontos percentuais – mais estreita do que esperávamos e mais estreita do que vimos relatado em referências académicas publicadas.

Mas as pontuações agregadas de idiomas escondem a parte do problema que realmente importa: a variação de sotaque dentro de um único idioma. As chamadas em inglês atendidas nos Estados Unidos obtiveram 92,7%. Chamadas em inglês de clientes que falam inglês na Índia obtiveram 91,3% – bem dentro do ruído. Chamadas em inglês de fortemente regional Falantes de inglês escocês pontuaram 83,4%. Essa é uma lacuna de 9 pontos e fica inteiramente dentro da coluna denominada “Inglês”.

A questão não é que nosso modelo seja ruim em inglês escocês. A questão é que publicar um número por idioma, embora não seja medida a variação de sotaque, é uma forma de ocultar as chamadas nas quais sua IA está falhando. Agora estamos reportando a variação de acentuação internamente e esperamos publicá-la externamente dentro de dois trimestres.

Os cinco modos de falha que explicaram 80% dos erros

Quando agrupamos as 723 chamadas perdidas (8,6% do conjunto de dados), cinco modos de falha representaram 81% delas. Nada disso surpreenderá quem já lançou IA de voz antes, mas os pesos relativos nos surpreenderam.

1. Empilhamento de intenções (29% de erros)

O chamador tem duas ou mais intenções e a IA se compromete com a primeira antes de terminar de declarar a segunda. “Quero remarcar meu compromisso e você também vende o modelo X-100” é exatamente o tipo de informação que destrói o estado da conversa.

2. Queda de contexto implícito (22%)

O chamador faz referência a algo dito anteriormente na conversa que a IA não armazenou como contexto – um nome, um preço, uma data. Este é o modo de falha que a janela de contexto da próxima geração aborda mais diretamente.

3. O chamador falou durante o prompt (15%)

Finalizando falhas. A IA começa a falar, o chamador fala por cima, a IA ouve sua própria voz misturada com a do chamador e produz uma transcrição que falta metade da entrada.

4. Erros de leitura de número (9%)

O chamador dita um número de telefone ou endereço. AI lê de volta. O chamador corrige um dígito. AI atualiza o dígito errado. Este é um problema 100% corrigível com um prompt de confirmação de dados estruturados, e enviamos um em fevereiro.

5. Transferência falsa (6%)

A IA identifica corretamente que não consegue resolver a chamada e as transferências – mas o roteamento de transferência a envia para a fila errada. Isto não é realmente uma falha da IA; é uma falha no plano de discagem que a IA expõe.

O que enviamos por causa deste estudo

Três alterações enviadas resultaram diretamente do estudo e uma quarta está em desenvolvimento. Tentamos fornecer a correção de maior aproveitamento por modo de falha, em vez da mais interessante academicamente.

  • Detector multi-intenção. Um pequeno classificador que é executado em paralelo com a captura de intenções e sinaliza declarações que contêm duas ou mais intenções independentes. Quando sinalizada, a conversa é pausada e a IA enumera explicitamente: "Ouvi dizer que você deseja reagendar e também perguntou sobre o X-100. Vamos remarcar primeiro - tudo bem?" O classificador adicionou 11 ms de latência e reduziu as perdas de empilhamento de intenções em 64%.
  • Confirmação de número estruturado. Qualquer número de telefone, endereço ou valor agora é confirmado dígito por dígito na leitura, com um manipulador de edição de um dígito. As perdas de leitura de números caíram 88%.
  • Recalibração final. Ajustamos novamente o limite de silêncio por idioma e adicionamos um "você terminou esse pensamento?" recuperação em caso de suspeita de truncamento. As falhas de talk-over caíram de 15% para 9% do miss set.

A quarta mudança – um buffer de contexto por chamada mais rico que aborda a queda de contexto implícito – é a mais complexa das quatro e está sendo testada no modo sombra em um conjunto de chamadas retidas antes de entrar no ar.

Uma nota sobre o desvio da motoniveladora humana

Uma pequena descoberta que vale a pena mencionar: os revisores humanos, apesar de uma rubrica publicada, variaram ao longo dos três meses. No primeiro mês, os revisores marcaram 87% das ligações como bem-sucedidas. No terceiro mês, os mesmos revisores, pontuando pela segunda vez as ligações sorteadas aleatoriamente no primeiro mês, marcaram 91% como bem-sucedidas. As transcrições não foram alteradas.

A tendência não foi de má-fé; era familiaridade. À medida que os revisores se acostumaram com o fraseado da IA, eles se tornaram mais generosos na dimensão da higiene da conversa. Percebemos isso reavaliando uma amostra de 5% das ligações do primeiro mês no terceiro mês e corrigimos o número do título para isso. Os 91,4% relatados acima são o valor corrigido pelo desvio. O número bruto foi de 92,1%.

Se um fornecedor publicar um número de precisão sem descrever como controlou o desvio humano da niveladora, o número será suspeito por padrão. Não inventámos este problema; nós apenas prestamos atenção nisso.

O que estamos medindo a seguir

Três coisas, em ordem de prioridade. Primeiro, a precisão da resolução do sotaque em cada um dos principais idiomas suportados — e um compromisso público de publicá-lo assim que a metodologia se estabilizar. Em segundo lugar, a precisão do resultado pós-chamada: o chamador realmente recebeu o que procurava, medido 7 e 30 dias após a chamada, reconciliando-se com o sistema posterior do cliente.

Terceiro, o número de custo por chamada resolvida que combina precisão com a economia por minuto – porque uma IA com 98% de precisão que custa US$ 1,40/min perde para uma IA com 92% de precisão que custa US$ 0,18/min, para quase todos os negócios reais.

Publicaremos o próximo conjunto de números no terceiro trimestre. Se mostrarem regressão, publicaremos isso também. O objetivo de medir essas coisas não é encontrar um gráfico lisonjeiro; é encontrar as decisões que ainda estamos errando.

Execute sua voz no Ajoxi.

Recepcionistas de IA, rotas de atacado, números virtuais – construídos em uma plataforma com preços transparentes e NOC 24 horas por dia, 7 dias por semana.

Ver preços Fale conosco
Continue lendo

Leitura relacionada

Próximas leituras escolhidas a dedo no blog Ajoxi.

Why we ship STIR/SHAKEN attestation on day one
Conformidade

Por que enviamos o atestado STIR/SHAKEN no primeiro dia

A maioria dos fornecedores de telefones em nuvem trata o atestado de identificação de chamadas como um recurso de nível superior. As operadoras não. Veja por que o tornamos padrão – e o que isso mudou nas taxas de resposta de saída.

Leia o artigo
The case for ranking calls, not sampling them
Produto

O caso de classificar chamadas, não de amostrá-las

A amostragem aleatória perde as chamadas que realmente importam. Reconstruímos o console do supervisor em torno de uma pontuação de risco e paramos de fingir que o controle de qualidade era um jogo de números.

Leia o artigo
Same latency on Mandarin and English. Here is how
Engenharia

Mesma latência em mandarim e inglês. Aqui está como

Alcançar a paridade em 32 idiomas sem sobrecarregar o modelo exigiu uma camada de roteamento de modelo que não prevíamos. Notas da sala de guerra de latência.

Leia o artigo