Ajoxi
  • 기둥
    클라우드폰

    클라우드 전화, 메시징, 비디오, 팩스, 채팅 — 전체 UCaaS 스택.

    • 가상 전화번호어디서나 시내 및 무료 전화번호
    • 회사 전화통화, SMS, 영상, 원로그인
    • 고객 참여모든 채널, 하나의 스레드
    • 개인용 AI모든 담당자를 위한 AI 조수
    • SMS 및 MMS주요 사업 분야의 텍스트
    • 팀 채팅고객과 연결된 내부 채팅
    • 화상회의AI 메모가 포함된 회의실 + 요약
    • 온라인 팩스팩스기 없이 팩스 보내기
    • 웹사이트 챗봇주문 상태 및 반품 자동 해결
    • 전화 시스템AI가 내장된 최신 PBX
    추천
    모든 것이 포함되어 있습니다.
    클라우드 전화, AI 컨택센터, AI 접수원, SMS, 비디오, 300개 이상의 통합.
    요금제 및 가격 보기
  • 핵심 역량
    • AI 접수원연중무휴 1차 답변 · 32개 언어
    • AI 감정화가 난 발신자를 자동으로 라우팅합니다.
    • AI 에이전트 지원속삭임 스크립트 + 차선책
    • 대화지능성적표, 감정, 이의제기
    • 통화녹음완전한 충실도 + 키워드 검색
    • 자동 교환드래그 앤 드롭 시각적 IVR 빌더
    • 감독자 도구듣기 · 속삭임 · 바지선 · 감사 로그
    • 무료 전화번호800, 888, 877 — 빠르게 프로비저닝됨
    새로운
    AI 감정·실시간 채점.
    기분이 나빠지는 순간 화가 난 고객을 선임 상담원에게 연결합니다. 모든 유료 플랜에서.
    AI 감정 보기
  • 산업별 및 팀별
    • 재원SOC 2 · FINRA 지원 감사 추적
    • 소매옴니채널 + 장바구니 복구 SMS
    • SaaSAPI + 모든 좌석의 개인 AI
    • 기호 논리학다중 사이트 파견 라우팅
    • 영업팀파워 다이얼러 + 실시간 AI 코칭
    • 지원팀8개 채널에 걸친 공유 메모리
    • 원격 팀모든 기기에서 동일한 번호
    • 중소기업AI 접수원을 프런트 데스크로 활용
    • 엔터프라이즈 ITSSO, SCIM, 다중 사이트 거버넌스
    가장 많이 채택됨
    호출 스택 규정 준수가 신뢰됩니다.
    통화 녹음, STIR/SHAKEN, 감정 라우팅. SOC 2, PCI 및 FINRA 지원 감사 추적.
    금융 보기
  • 기본 동기화
    • 허브스팟양방향 동기화 · 수명 주기 트리거
    • 조호CRM · 책상 · 책 · Bigin
    곧 출시 예정
    세일즈포스. 파이프드라이브. 신선판매.
    2026년 3분기에 세 가지 기본 양방향 동기화가 모두 이루어졌습니다. 출시에 대해 미리 알고 싶으십니까?
    출시 시 이메일을 보내주세요
  • 가격
  • 배우다
    • 블로그엔지니어링 및 제품 노트
    • 고객 사례실제 결과, 실수
    • 가이드단계별 플레이북
    • 웨비나매주 목요일 생방송 · 주문형
    • 문의하기영업팀에 문의하거나 지원 받기
    짓다
    • 문서모든 작동 방식
    • API 참조REST + 웹훅
    • SDK노드, 파이썬, Go, 루비
    • 변경 내역모든 선박이 한 곳에서
    신뢰하다
    • 상태 페이지실시간 가동 시간 + 사고
    • 보안 + 규정 준수SOC 2 · GDPR · PCI
    • 은둔수집하는 항목 및 이유
    • 자귀계약서(챕터)
    신선한 잉크
    8,400건의 통화가 측정되었습니다.
    언어, 억양, 통화 유형별 AI 접수원의 정확도 — 편집되지 않은 숫자입니다.
    게시물 읽기
  • English flag영어
  • Español flag스페인어
  • Français flag프랑세즈
  • Deutsch flag독일어
  • Italiano flag이탈리아노
  • Português flag포르투갈어
  • Nederlands flag네덜란드
  • Русский flag러시아인
  • Polski flag폴스키
  • Türkçe flag터키어
  • العربية flag아랍어
  • हिन्दी flag힌두교
  • 简体中文 flag简体中文
  • 日本語 flag일본어
  • 한국어 flag한국어
  • Tiếng Việt flag티엥 비엣
  • Bahasa Indonesia flag인도네시아 바하사
  • ไทย flagไท้
  • Svenska flag스벤스카
  • Українська flag모스크바
로그인무료 평가판
클라우드폰
가상 전화번호어디서나 시내 및 무료 전화번호회사 전화통화, SMS, 영상, 원로그인고객 참여모든 채널, 하나의 스레드개인용 AI모든 담당자를 위한 AI 조수SMS 및 MMS주요 사업 분야의 텍스트팀 채팅고객과 연결된 내부 채팅화상회의AI 메모가 포함된 회의실 + 요약온라인 팩스팩스기 없이 팩스 보내기웹사이트 챗봇주문 상태 및 반품 자동 해결전화 시스템AI가 내장된 최신 PBX
컨택센터
옴니채널모든 채널에 하나의 대기열아웃바운드 다이얼러예측, 능력, 미리보기상담원 지원실시간 속삭임 코칭감독자 지원실시간으로 나쁜 전화를 찾아보세요상호작용 분석자동 QA, 주제 동향기업500개 이상의 좌석 운영
AI 가족
아족시 목소리약속을 잡는 AI 접수원AI 어시스턴트초안, 요약, 후속 조치대화 AI모든 통화를 읽어서 하나도 놓치지 마세요
AI 접수원연중무휴 1차 답변 · 32개 언어AI 감정화가 난 발신자를 자동으로 라우팅합니다.AI 에이전트 지원속삭임 스크립트 + 차선책대화지능성적표, 감정, 이의제기통화녹음완전한 충실도 + 키워드 검색자동 교환드래그 앤 드롭 시각적 IVR 빌더감독자 도구듣기 · 속삭임 · 바지선 · 감사 로그무료 전화번호800, 888, 877 — 빠르게 프로비저닝됨
재원SOC 2 · FINRA 지원 감사 추적소매옴니채널 + 장바구니 복구 SMSSaaSAPI + 모든 좌석의 개인 AI기호 논리학다중 사이트 파견 라우팅영업팀파워 다이얼러 + 실시간 AI 코칭지원팀8개 채널에 걸친 공유 메모리원격 팀모든 기기에서 동일한 번호중소기업AI 접수원을 프런트 데스크로 활용엔터프라이즈 ITSSO, SCIM, 다중 사이트 거버넌스
허브스팟양방향 동기화 · 수명 주기 트리거조호CRM · 책상 · 책 · Bigin
배우다
블로그엔지니어링 및 제품 노트고객 사례실제 결과, 실수가이드단계별 플레이북웨비나매주 목요일 생방송 · 주문형문의하기영업팀에 문의하거나 지원 받기
짓다
문서모든 작동 방식API 참조REST + 웹훅SDK노드, 파이썬, Go, 루비변경 내역모든 선박이 한 곳에서
신뢰하다
상태 페이지실시간 가동 시간 + 사고보안 + 규정 준수SOC 2 · GDPR · PCI은둔수집하는 항목 및 이유자귀계약서(챕터)
  • English flag영어
  • Español flag스페인어
  • Français flag프랑세즈
  • Deutsch flag독일어
  • Italiano flag이탈리아노
  • Português flag포르투갈어
  • Nederlands flag네덜란드
  • Русский flag러시아인
  • Polski flag폴스키
  • Türkçe flag터키어
  • العربية flag아랍어
  • हिन्दी flag힌두교
  • 简体中文 flag简体中文
  • 日本語 flag일본어
  • 한국어 flag한국어
  • Tiếng Việt flag티엥 비엣
  • Bahasa Indonesia flag인도네시아 바하사
  • ไทย flagไท้
  • Svenska flag스벤스카
  • Українська flag모스크바
로그인무료 평가판
Ajoxi

하나의 통신업체급 네트워크에 클라우드 전화 및 AI 컨택 센터가 있습니다.

SOC 2GDPRPCI-DSS

스위트 C, 7층, 월드 트러스트 타워,
50 스탠리 스트리트, 센트럴,
홍콩

info@ajoxi.com+1 (512) 612-4425

클라우드폰

  • 회사 전화
  • 고객 참여
  • SMS 및 MMS
  • 팀 채팅
  • 화상회의
  • 전화 시스템

컨택센터

  • 옴니채널
  • 아웃바운드 다이얼러
  • 상담원 지원
  • 상호작용 분석
  • 엔터프라이즈 CCaaS

일체 포함

  • AI 플랫폼
  • AI 접수원
  • AI 어시스턴트
  • 대화형 AI
  • AI 감정
  • 대화지능

솔루션

  • 재원
  • 소매 및 전자상거래
  • SaaS 및 기술
  • 영업팀
  • 중소기업

리셀러

  • 도매 VoIP
  • 도매 음성
  • SIP 트렁킹
  • CLI 경로

회사

  • 가격
  • 에 대한
  • 고객
  • 문의하기
  • 국가 코드
  • 지역번호
  • 문서
  • 상태
  • 보안

© 2026 아족시. 모든 권리 보유.

모든 시스템 정상
  • 은둔
  • 자귀
  • 사이트맵
블로그/공학/중국어와 영어의 대기 시간은 동일합니다. 방법은 다음과 같습니다

중국어와 영어의 대기 시간은 동일합니다. 방법은 다음과 같습니다

모델을 확장하지 않고 32개 언어에서 지연 시간 패리티를 달성하려면 우리가 예상하지 못했던 모델 라우팅 계층이 필요했습니다. 대기시간 상황실의 메모입니다.

목차
  • 1.소개
  • 2.밀리초가 실제로 어디로 가는지
  • 3.라우팅 수정
  • 4.아무도 보지 못한 분류기
  • 5.문제의 TTS 측면
  • 6.평균이 아닌 패리티 측정
  • 7.아직도 느린게 뭐야?
  • 8.우리가 다르게 할 것

소개

저희 음성제품에는 내부적으로 조정이 안되는 두가지 불만사항이 있었습니다. 영어를 사용하는 기업 고객의 경우 AI가 빠르게 느껴졌습니다. 중국어를 사용하는 고객과 점점 더 베트남어, 타갈로그어, 힌디어를 사용하는 고객으로부터 AI가 느리게 느껴졌습니다. 발신자 침묵부터 AI 첫 음절까지 엔드 투 엔드로 측정한 간격은 영어에서는 260ms, 중국어에서는 540ms였습니다. 두 숫자 모두 게시된 대기 시간 예산 내에 있었습니다.

그들 중 단 한 명만이 전화 통화에서 수용 가능하다고 느꼈습니다.

지연 시간 격차를 발견한 모든 엔지니어링 팀의 본능은 모델을 개선하는 것입니다. 더 빠른 추론. 더 작은 모델. 더 나은 양자화. 우리는 그 모든 것을 했습니다. 전반적으로 60ms를 샀지만 아무 것도 닫히지 않았습니다. 상대적인 격차는 여전히 있었고 영어는 두 배 빠른 속도로 유지되었습니다.

실제 수정 사항은 다른 관찰에서 나왔습니다. 즉, 대기 시간이 실제로 라우팅 문제인 경우 모델 문제로 처리하고 있었습니다.

밀리초가 실제로 어디로 가는지

540ms 표준 중국어 응답을 세그먼트로 나누는 것이 문제를 명확히 하는 첫 번째 작업이었습니다. 회계는 대략 다음과 같았습니다.

  • 오디오 캡처 및 엔드포인트 - 80ms
  • 음성-텍스트 첫 번째 토큰 — 140ms
  • 의도 + 검색 파이프라인 - 90ms
  • 대형 모델 첫 번째 토큰(세대) — 180ms
  • 텍스트 음성 변환 첫 번째 오디오 — 50ms

영어 경로에서는 80/60/90/80/40에 동일한 세그먼트가 들어왔습니다. 극적으로 갈라진 두 세그먼트는 음성-텍스트 생성과 대형 모델 생성이었습니다. STT는 중국어에서 더 느렸습니다. 음향 모델이 음조 명확성에 필요한 더 긴 컨텍스트 창으로 훈련되어 첫 번째 토큰을 80ms만큼 밀어냈기 때문입니다.

토크나이저가 영어보다 표준 중국어에서 동일한 의미를 지닌 문자당 더 많은 토큰을 생성했기 때문에 모델 생성 속도가 느려졌습니다.

모델 결함도 아니었습니다. 두 가지 모두 독립적인 팀이 자체 측정항목(정확성을 위한 STT, 생성 품질을 위한 LLM)을 최적화하기 위해 조용히 축적한 절충안이었습니다. 대기 시간 비용은 실제적이었지만 누구의 P&L도 아니었습니다.

200ms를 구매한 라우팅 수정

단일 LLM을 통해 모든 언어 라우팅을 중단했습니다. 대신, 우리는 8ms 이내에 들어오는 발언의 언어, 대화 의도 클래스, 요청이 200만 통화 세그먼트를 클러스터링하여 식별한 약 40개의 고주파 패턴 중 하나인지 여부 등 세 가지를 감지하는 얇은 분류 레이어를 생성 앞에 구축했습니다.

분류기가 영어가 아닌 언어에서 빈도가 높은 패턴을 식별하면 해당 패턴을 직접 처리하는 더 작은 언어 전문 모델로 생성을 라우팅합니다. 더 작은 모델은 동일한 패턴을 수백만 번 완성하여 증류되었으므로 특정 경로의 품질은 큰 모델의 잡음 범위 내에 있지만 첫 번째 토큰 대기 시간은 대략 1/3입니다.

분류자가 꼬리 의도(40개 패턴에 속하지 않는 모든 것)를 발견하면 이전과 마찬가지로 요청이 큰 모델로 전달됩니다. 지연 시간 감소의 대부분은 고주파 패턴이 다음과 같다는 사실에서 비롯됩니다. 또한 통화량의 약 78%를 차지하는 패턴입니다. 테일 케이스는 원래 대기 시간을 지불하지만 드물게 발생합니다.

아무도 보지 못한 분류기

씬 분류기는 누구도 예산을 책정하지 않은 프로젝트의 일부였습니다. 실패 모드가 미묘하기 때문에 라우팅 시스템 자체를 구축하는 것보다 구축하는 데 더 오랜 시간이 걸렸습니다. 요청의 1%를 처리하지 않는 작은 모델로 잘못 라우팅하는 분류자는 단지 저하된 응답이 아니라 환각을 생성합니다.

세 가지가 분류기를 작동하게 만들었습니다. 첫째, 합성 데이터가 아닌 실제 프로덕션 트래픽을 대상으로 교육을 받았습니다. 둘째, 라우터가 임계값을 설정할 수 있는 신뢰도 점수를 반환했습니다. 신뢰도가 0.91 미만이면 자동으로 큰 모델에 전달됩니다.

셋째, 트래픽이 실제로 작은 모델로 라우팅되기 전에 큰 모델이 실제 정보를 제공하면서 기존 파이프라인에 대해 6주 동안 섀도우 배포했습니다.

섀도우 배포에서는 오프라인 테스트 세트가 놓친 네 가지 종류의 실수를 발견했습니다. 두 가지는 훈련 데이터에서 수정하기 쉬웠습니다. 두 가지 필수 의도적 라우팅 규칙 - 신원 확인, 지불 또는 약속 취소와 관련된 모든 것은 분류기 신뢰도에 관계없이 항상 큰 모델로 이동합니다. 왜냐하면 해당 경로에서 환각에 대한 비용이 대기 시간 승리보다 높기 때문입니다.

문제의 TTS 측면

LLM 및 STT 변경 사항이 검토되는 동안 병행 팀이 음성 출력 작업을 진행했습니다. 50ms TTS 첫 번째 영어 오디오는 사실상 타의 추종을 불허했습니다. 영어가 아닌 대부분의 언어에서 70ms~90ms의 차이는 더 작은 음성 모델, 덜 공격적인 캐싱, 로드 시 영어를 우선시하는 단일 공유 GPU 풀에 의해 발생했습니다.

우리는 TTS 인프라를 언어 고정 풀로 분할했습니다. Mandarin TTS는 이제 대부분의 Mandarin 트래픽이 발생하는 지역에 가까운 하드웨어에서 자체 확장 규칙을 사용하여 자체 풀에서 실행됩니다. 컷오버 후 2주 이내에 대기 시간이 70~90ms에서 45ms로 감소했습니다.

이 중 어느 것도 영리하지 않았습니다. 그것은 단일 언어에 대한 미미한 개선만으로는 이를 정당화할 수 없었기 때문에 누구도 귀찮게 하지 않았던 인프라 작업이었습니다.

현재 우리가 내부적으로 기록하고 있는 교훈은 "단일 사용자 대상 측정 항목이 이를 정당화하지 않았기 때문에 이에 투자하지 않았다"는 것이 바로 4년 동안 두 언어 사이의 280ms 간격을 합산하는 일종의 결정이라는 것입니다.

평균이 아닌 패리티 측정

우리가 내부적으로 수행한 작지만 중요한 변경 사항 중 하나는 팀의 대기 시간 대시보드 보고 방식이었습니다. 우리는 단일 SLO를 기준으로 모든 언어의 평균을 계산한 엔드투엔드 대기 시간의 p50 및 p95를 추적했습니다. 대시보드는 대부분 녹색으로 보였습니다.

새 대시보드는 p50 및 p95를 보고합니다. 언어별 반대하다 둥가 SLO — 지원되는 가장 느린 언어와 가장 빠른 언어 간의 격차에는 자체 예산이 있으며 별도로 시행됩니다. 패리티 예산을 60ms로 설정했습니다. 격차가 예산을 초과하면 대기 중이 호출됩니다.

패리티 대시보드는 평균 기반 대시보드에서는 할 수 없는 작업을 수행합니다. 즉, 가장 빠른 언어의 회귀와 동일한 긴급 상황에서 가장 느린 언어의 회귀를 표시합니다. 32개 언어의 평균을 계산하면 베트남어의 200ms 회귀는 평균을 6ms만큼 이동합니다. 패리티를 측정하면 대시보드가 ​​200ms씩 이동합니다.

아직도 느린게 뭐야?

라우팅 작업, TTS 풀 및 패리티 대시보드 후 최악의 언어(광둥어, 주로 지원 음향 모델 코퍼스가 더 작기 때문에)는 320ms에 있습니다. 영어는 220ms입니다. 나머지 100ms 간격은 실제이며 우리는 그것이 어디에 있는지 대략 알고 있습니다. 광동어 STT 음향 모델은 오래되었고 아직 새로운 아키텍처에 적용되지 않았으며 3분기에 다시 훈련할 것입니다.

하지만 "가장 느린 언어는 가장 빠른 언어보다 100ms 늦다"는 것과 "가장 느린 언어는 가장 빠른 언어보다 280ms 늦다"는 대화는 다릅니다. 전자는 분기별 수정이 계획된 알려진 회귀입니다. 후자는 우리가 몰랐던 고객 경험 긴급 상황이었습니다.

다음에는 다르게 할 것

현재 알고 있는 정보를 바탕으로 대기 시간 스택을 처음부터 다시 구축한다면 세 가지를 우선 순위에 따라 살펴보겠습니다.

  • 먼저 분류기-라우터를 구축한 다음 모델을 구축하세요. 라우팅 레이어는 결국 가장 활용도가 높은 부분이 되었습니다. "필요하면 나중에 추가하겠습니다"라고 생각하면 필요한 것보다 18개월 더 오랫동안 단일 모델 대기 시간을 유지했다는 뜻이 됩니다.
  • 언어 SLO보다 먼저 패리티 SLO를 설정하세요. 언어별 목표를 설정하고 패리티가 나타나도록 하고 싶은 유혹이 있습니다. 패리티는 나타나지 않습니다. 팀의 기본 언어 방향으로 천천히 갈라집니다.
  • 각 언어가 별도의 제품인 것처럼 언어별 인프라를 리소스로 활용하세요. Mandarin TTS는 대기 시간 격차를 측정한 날이 아니라 첫날부터 자체 GPU 풀을 사용할 자격이 있었습니다.

이 중 어느 것도 새로운 연구는 아닙니다. 그 중 어느 것도 종이가 필요하지 않았습니다. 지연 시간 패리티를 제품 약속으로 처리한 다음 약속을 뒷받침하기 위해 매력적이지 않은 인프라에 자금을 지원해야 했습니다. 우리는 지금 필요한 패리티를 가지고 있습니다. 우리는 4년 동안 그것을 갖지 못했습니다.

Ajoxi에서 목소리를 내보세요.

AI 접수원, 도매 경로, 가상 번호 — 투명한 가격과 연중무휴 NOC로 단일 플랫폼에 구축되었습니다.

가격 보기 우리에게 이야기하세요
계속 읽으세요

관련 독서

Ajoxi 블로그에서 직접 선택한 다음 읽기입니다.

We measured AI receptionist accuracy across 8,400 real calls
일체 포함

8,400건의 실제 통화에서 AI 접수 정확도를 측정했습니다.

3개월 동안 우리는 AI가 처리한 모든 통화를 언어, 억양, 통화 유형별로 추적하고 인간 검토자와 비교하여 성적표를 평가했습니다. 정확도 수치는 우리가 예상했던 것보다 나았습니다. 실패 모드가 더 흥미로웠습니다.

기사 읽기
Why we ship STIR/SHAKEN attestation on day one
규정 준수

첫날에 STIR/SHAKEN 증명을 제공하는 이유

대부분의 클라우드 전화 공급업체는 발신자 ID 증명을 상위 기능으로 취급합니다. 통신사는 그렇지 않습니다. 기본값으로 설정한 이유와 아웃바운드 응답률에 대한 변경 사항은 다음과 같습니다.

기사 읽기
The case for ranking calls, not sampling them
제품

샘플링이 아닌 호출 순위 지정의 경우

무작위 샘플링은 실제로 중요한 호출을 놓칩니다. 우리는 위험 점수를 중심으로 감독 콘솔을 재구축하고 QA가 숫자 게임인 척하는 것을 중단했습니다.

기사 읽기