Ajoxi
  • Стовп
    ХМАРНИЙ ТЕЛЕФОН

    Хмарний телефон, обмін повідомленнями, відео, факс, чат — повний стек UCaaS.

    • Віртуальний номер телефонуМісцеві та безкоштовні номери будь-де
    • Службовий телефонДзвінки, смс, відео, один вхід
    • Залучення клієнтівКожен канал, один потік
    • Персональний ШІAI-помічник для кожного представника
    • SMS і MMSТекст з основної лінії бізнесу
    • Командний чатВнутрішній чат, прив'язаний до клієнтів
    • ВідеозустрічіКімнати з примітками AI + підсумок
    • Онлайн факсФакс без факсу
    • Веб-сайт Чат-ботАвтоматично вирішує статус замовлення та повернення
    • Телефонна системаСучасна АТС із вбудованим штучним інтелектом
    Рекомендовані
    Все включено.
    Хмарний телефон, контактний центр штучного інтелекту, адміністратор служби штучного інтелекту, SMS, відео, понад 300 інтеграцій.
    Перегляньте тарифні плани та ціни
  • Основні можливості
    • AI РесепшнЦілодобова перша відповідь · 32 мови
    • ШІ НастроїМаршрути автоматично засмучують абонентів
    • Помічник агента ШІСценарії Whisper + next-best-action
    • Інтелект розмовиСтенограми, настрої, заперечення
    • Запис дзвінківПовна точність + пошук за ключовими словами
    • АвтосекретарКонструктор візуального IVR із функцією перетягування
    • Інструменти супервізораСлухати · шепотіти · баржа · ревізійний журнал
    • Безкоштовні номери800, 888, 877 — швидке забезпечення
    новий
    AI Sentiment · живий рахунок.
    Маршрути засмучують клієнтів для старших агентів у момент, коли настрій падає. На кожному платному плані.
    Див. AI Sentiment
  • За галуззю та командою
    • ФінансиSOC 2 · Журнали аудиту, готові до FINRA
    • Роздрібна торгівляОмніканальність + SMS для відновлення кошика
    • SaaSAPI + персональний штучний інтелект на кожному місці
    • ЛогістикаМаршрутизація розсилки з кількох сайтів
    • Команди продажівПотужний дозвон + інструктаж зі штучним інтелектом
    • Команди підтримкиСпільна пам'ять на 8 каналів
    • Віддалені командиНа кожному пристрої однаковий номер
    • SMBШІ-ресепшн як ваша стійка реєстрації
    • ІТ підприємстваSSO, SCIM, багатосайтове управління
    Більшість усиновлених
    Стек викликів відповідає вимогам.
    Запис викликів, STIR/SHAKEN, маршрутизація настроїв. SOC 2, PCI та готові журнали аудиту FINRA.
    Дивіться фінанси
  • Нативна синхронізація
    • HubSpotДвостороння синхронізація · тригери життєвого циклу
    • ЗохоCRM · Стіл · Книги · Бігін
    Скоро буде
    Salesforce. Pipedrive. Freshsales.
    Усі три власні двосторонні синхронізації в третьому кварталі 2026 року. Хочете попередити про запуск?
    Напишіть мені про запуск
  • Ціноутворення
  • вчитися
    • БлогПримітки щодо розробки та продукту
    • Історії клієнтівРеальні результати, реальні цифри
    • ПосібникиКрок за кроком ігри
    • ВебінариПрямий ефір щочетверга · на замовлення
    • Зв'яжіться з намиЗверніться до відділу продажів або отримайте підтримку
    Будувати
    • документиЯк все працює
    • Посилання на APIREST + веб-хуки
    • SDKNode, Python, Go, Ruby
    • Журнал змінКожен корабель в одному місці
    Довіра
    • Сторінка статусуЧас безвідмовної роботи + інциденти
    • Безпека + відповідністьSOC 2 · GDPR · PCI
    • КонфіденційністьЩо ми збираємо і чому
    • УмовиДоговір, розділами
    Свіже чорнило
    8400 дзвінків, виміряно.
    Точність адміністратора ШІ за мовою, акцентом і типом дзвінка — невідредаговані номери.
    Прочитайте пост
  • English flagанглійська
  • Español flagEspañol
  • Français flagFrançais
  • Deutsch flagDeutsch
  • Italiano flagItaliano
  • Português flagPortuguês
  • Nederlands flagНідерланди
  • Русский flagРусский
  • Polski flagPolski
  • Türkçe flagтурецька
  • العربية flagالعربية
  • हिन्दी flagहिन्दी
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonesia
  • ไทย flagไทย
  • Svenska flagСвенська
  • Українська flagУкраїнська
УвійдітьБезкоштовна пробна версія
Хмарний телефон
Віртуальний номер телефонуМісцеві та безкоштовні номери будь-деСлужбовий телефонДзвінки, смс, відео, один вхідЗалучення клієнтівКожен канал, один потікПерсональний ШІAI-помічник для кожного представникаSMS і MMSТекст з основної лінії бізнесуКомандний чатВнутрішній чат, прив'язаний до клієнтівВідеозустрічіКімнати з примітками AI + підсумокОнлайн факсФакс без факсуВеб-сайт Чат-ботАвтоматично вирішує статус замовлення та поверненняТелефонна системаСучасна АТС із вбудованим штучним інтелектом
Контакт-центр
БагатоканальнийОдна черга для кожного каналуВихідний номеронабирачПрогнозування, потужність, попередній переглядПомічник агентаНавчання пошепки в прямому ефіріКерівник асистентВиявляйте погані дзвінки в реальному часіАналітика взаємодіїAuto-QA, тематичні трендипідприємство500+ робочих місць
AI Сім'я
Голос AjoxiШІ портьє, який бронює зустрічіШІ помічникЧернетки, резюме, подальші діїРозмова ІІЧитає кожен дзвінок, щоб ви нічого не пропустили
AI РесепшнЦілодобова перша відповідь · 32 мовиШІ НастроїМаршрути автоматично засмучують абонентівПомічник агента ШІСценарії Whisper + next-best-actionІнтелект розмовиСтенограми, настрої, запереченняЗапис дзвінківПовна точність + пошук за ключовими словамиАвтосекретарКонструктор візуального IVR із функцією перетягуванняІнструменти супервізораСлухати · шепотіти · баржа · ревізійний журналБезкоштовні номери800, 888, 877 — швидке забезпечення
ФінансиSOC 2 · Журнали аудиту, готові до FINRAРоздрібна торгівляОмніканальність + SMS для відновлення кошикаSaaSAPI + персональний штучний інтелект на кожному місціЛогістикаМаршрутизація розсилки з кількох сайтівКоманди продажівПотужний дозвон + інструктаж зі штучним інтелектомКоманди підтримкиСпільна пам'ять на 8 каналівВіддалені командиНа кожному пристрої однаковий номерSMBШІ-ресепшн як ваша стійка реєстраціїІТ підприємстваSSO, SCIM, багатосайтове управління
HubSpotДвостороння синхронізація · тригери життєвого циклуЗохоCRM · Стіл · Книги · Бігін
вчитися
БлогПримітки щодо розробки та продуктуІсторії клієнтівРеальні результати, реальні цифриПосібникиКрок за кроком ігриВебінариПрямий ефір щочетверга · на замовленняЗв'яжіться з намиЗверніться до відділу продажів або отримайте підтримку
Будувати
документиЯк все працюєПосилання на APIREST + веб-хукиSDKNode, Python, Go, RubyЖурнал змінКожен корабель в одному місці
Довіра
Сторінка статусуЧас безвідмовної роботи + інцидентиБезпека + відповідністьSOC 2 · GDPR · PCIКонфіденційністьЩо ми збираємо і чомуУмовиДоговір, розділами
  • English flagанглійська
  • Español flagEspañol
  • Français flagFrançais
  • Deutsch flagDeutsch
  • Italiano flagItaliano
  • Português flagPortuguês
  • Nederlands flagНідерланди
  • Русский flagРусский
  • Polski flagPolski
  • Türkçe flagтурецька
  • العربية flagالعربية
  • हिन्दी flagहिन्दी
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagTiếng Việt
  • Bahasa Indonesia flagBahasa Indonesia
  • ไทย flagไทย
  • Svenska flagСвенська
  • Українська flagУкраїнська
УвійдітьБезкоштовна пробна версія
Ajoxi

Хмарний телефон і контакт-центр AI в одній мережі операторського рівня.

SOC 2GDPRPCI-DSS

Suite C, рівень 7, World Trust Tower,
50 Stanley Street, Central,
Гонконг

info@ajoxi.com+1 (512) 612-4425

Хмарний телефон

  • Службовий телефон
  • Залучення клієнтів
  • SMS і MMS
  • Командний чат
  • Відеозустрічі
  • Телефонна система

Контакт-центр

  • Багатоканальний
  • Вихідний номеронабирач
  • Помічник агента
  • Аналітика взаємодії
  • Підприємство CCaaS

ШІ

  • Платформа ШІ
  • AI Ресепшн
  • ШІ помічник
  • Розмовний ШІ
  • ШІ Настрої
  • Інтелект розмови

Рішення

  • Фінанси
  • Роздрібна торгівля та eCom
  • SaaS & Tech
  • Команди продажів
  • SMB

Торговий посередник

  • Оптовий продаж VoIP
  • Оптовий голос
  • SIP транкінг
  • Маршрути CLI

Компанія

  • Ціноутворення
  • про
  • Клієнти
  • Зв'яжіться з нами
  • Коди країн
  • Коди регіонів
  • документи
  • Статус
  • Безпека

© 2026 Ajoxi. Всі права захищені.

Всі системи в нормі
  • Конфіденційність
  • Умови
  • Карта сайту
Блог/Інженерія/Однакова затримка на китайській та англійській мовах. Ось як

Однакова затримка на китайській та англійській мовах. Ось як

Для досягнення паритету затримки на 32 мовах без роздування моделі потрібен був рівень маршрутизації моделі, якого ми не бачили. Нотатки з латентної війни.

Зміст
  • 1.вступ
  • 2.Куди насправді йдуть мілісекунди
  • 3.Виправлення маршрутизації
  • 4.Приходу класифікатора ніхто не бачив
  • 5.Сторона проблеми TTS
  • 6.Парність вимірювання, а не середні значення
  • 7.Що ще повільно
  • 8.Що б ми зробили інакше

вступ

Наш голосовий продукт мав дві скарги, які ми не могли узгодити всередині. Англомовні корпоративні клієнти сприймали штучний інтелект швидко. Клієнти, які розмовляють мандаринською мовою, і дедалі частіше клієнти, які розмовляють в’єтнамською, тагальською та хінді, відчували млявість ШІ. Розрив, виміряний від кінця до кінця від мовчання абонента до першого складу ШІ, становив 260 мс на англійській мові та 540 мс на китайській мові. Обидва показники були в межах опублікованого бюджету затримки.

Лише один із них почувався прийнятним під час телефонної розмови.

Інстинкт будь-якої команди інженерів, яка бачить прогалину в затримці, полягає в тому, щоб переробити модель. Швидший висновок. Менша модель. Краще квантування. Ми все це зробили. Це дало нам 60 мс за всіма напрямками, що нічого не зменшило — відносний розрив все ще був, а англійська залишалася вдвічі швидшою.

Справжнє виправлення прийшло в результаті іншого спостереження: ми розглядали затримку як модельну проблему, тоді як насправді це була проблема маршрутизації.

Куди насправді йдуть мілісекунди

Розбиття відповіді Mandarin 540 мс на сегменти було першим, що прояснило проблему. Бухгалтерський облік виглядав приблизно так:

  • Захоплення аудіо та кінцева точка — 80 мс
  • Перший маркер перетворення мови в текст — 140 мс
  • Намір + конвеєр пошуку — 90 мс
  • Велика модель першого токена (покоління) — 180 мс
  • Синтез мовлення - спочатку аудіо — 50 мс

На шляху англійської мови ті самі сегменти були 80 / 60 / 90 / 80 / 40. Два сегменти, які різко розходилися, були перетворення мови в текст і створення великої моделі. STT був повільнішим у мандарині, оскільки акустичну модель було навчено з довшим контекстним вікном — необхідним для тонального усунення неоднозначності — яке зрушувало перший маркер на 80 мс.

Генерація моделі була повільнішою, оскільки токенізатор виробляв більше токенів на символ еквівалентного значення китайською мовою, ніж англійською.

Також не було дефекту моделі. Обидва були компромісами, які були тихо накопичені незалежними командами, які оптимізували власні показники — STT для точності, LLM для якості генерації. Вартість затримки була реальною, але це не були нічиї прибутки та збитки.

Виправлення маршрутизації, яке купило 200 мс

Ми припинили маршрутизацію всіх мов через один LLM. Замість цього ми створили тонкий класифікаційний рівень перед генерацією, який визначає за менш ніж 8 мс три речі: мову вхідного висловлювання, клас розмовного наміру та те, чи є запит одним із приблизно 40 високочастотних шаблонів, які ми визначили шляхом кластеризації 2 млн сегментів виклику.

Коли класифікатор визначає високочастотний шаблон у неанглійській мові, ми направляємо генерацію до меншої моделі, спеціалізованої на певній мові, яка безпосередньо обробляє цей шаблон. Менша модель була розроблена на основі мільйонів завершень того самого шаблону, тому її якість на цих конкретних шляхах знаходиться в межах шуму великої моделі, але її затримка першого маркера становить приблизно третину.

Коли класифікатор бачить кінцевий намір — все, що не входить до 40 шаблонів — запит потрапляє до великої моделі, як і раніше. Здебільшого падіння затримки відбувається через те, що високочастотні шаблони є також моделі, на які припадає ~78% обсягу викликів. Кінцеві випадки оплачують оригінальну затримку, але вони рідкісні.

Приходу класифікатора ніхто не бачив

Тонкий класифікатор був частиною проекту, який ніхто не передбачав у бюджеті. Його створення зайняло більше часу, ніж створення самої системи маршрутизації, оскільки режими збоїв були непомітними. Класифікатор, який неправильно направляє 1% запитів до невеликої моделі, яка їх не обробляє, створює галюцинації, а не просто погіршені відповіді.

Три речі змусили класифікатор працювати. По-перше, його навчали на реальному виробничому трафіку, а не на синтетичних даних. По-друге, він повернув оцінку достовірності, яку маршрутизатор міг визначити — все, що нижче 0,91, автоматично потрапляє до великої моделі.

По-третє, ми тіньово розгортали його протягом шести тижнів проти існуючого конвеєра, причому велика модель забезпечувала базову правду, перш ніж будь-який трафік фактично було спрямовано на маленькі моделі.

Тіньове розгортання виявило чотири класи помилок, які пропустив набір офлайн-тестів. Дві з них було легко виправити в навчальних даних. Два обов’язкових правила навмисної маршрутизації — все, що стосується перевірки особи, платежів або скасування зустрічі, завжди переходить до великої моделі, незалежно від впевненості класифікатора, оскільки ціна галюцинації на цих шляхах вища, ніж виграш затримки.

Сторона проблеми TTS

Поки зміни LLM і STT проходили перевірку, паралельна команда працювала над мовленнєвим виходом. Перше аудіо 50 мс TTS англійською було фактично неперевершеним; розрив у 70–90 мс для більшості неанглійських мов був зумовлений меншими голосовими моделями, менш агресивним кешуванням і єдиним спільним пулом GPU, який надавав пріоритет англійській мові під час навантаження.

Ми розділили інфраструктуру TTS на пули, закріплені за мовою. Mandarin TTS тепер працює на власному пулі, з власними правилами масштабування, на обладнанні, розташованому поблизу регіонів, звідки надходить більшість нашого трафіку Mandarin. Затримка впала з 70-90 мс до 45 мс протягом двох тижнів після перемикання.

Нічого з цього не було розумним; це була інфраструктурна робота, яку ніхто не потрудився зробити, тому що маргінальне вдосконалення будь-якої окремої мови не виправдовувало її окремо.

Урок — і ми зараз записуємо його внутрішньо — полягає в тому, що «ми не інвестували в це, тому що жодна метрика, спрямована на користувача, не виправдовувала це» — це саме те рішення, яке призводить до розриву в 280 мс між двома мовами протягом чотирьох років.

Парність вимірювання, а не середні значення

Одна невелика, але значуща зміна, яку ми внесли внутрішньо, стосувалась способу звітування командної панелі затримок. Раніше ми відстежували p50 і p95 наскрізної затримки, усереднені для всіх мов, порівняно з одним SLO. Приладова панель більшу частину часу виглядала зеленою.

Нова приладова панель повідомляє про p50 і p95 на мову проти а паритет SLO — розрив між найповільнішою та найшвидшою підтримуваними мовами має власний бюджет, який дотримується окремо. Ми встановили паритетний бюджет на рівні 60 мс. Коли розрив перевищує бюджет, черговий отримує виклик.

Інформаційна панель паритету робить те, чого не могла зробити середня: вона робить регресії на найповільнішій мові видимими з такою ж терміновістю, як і регресії на найшвидшій. Коли ви усереднюєте 32 мови, регресія на 200 мс у в’єтнамській мові зміщує середнє значення на 6 мс. Коли ви вимірюєте паритет, він пересуває інформаційну панель на 200 мс.

Що ще повільно

Після роботи з маршрутизації, пулів TTS і інформаційної панелі парності наша найгірша мова (кантонська, насамперед через те, що допоміжний корпус акустичної моделі менший) становить 320 мс. Англійська – 220 мс. Проміжок у 100 мс, що залишився, реальний, і ми приблизно знаємо, де він живе — акустична модель Cantonese STT старіша і ще не працює на новій архітектурі, і ми перенавчимо її в третьому кварталі.

Але «найповільніша мова відстає від найшвидшої на 100 мс» — це інша розмова, ніж «найповільніша мова відстає від найшвидшої на 280 мс». Перше – це відома регресія з запланованим щоквартальним виправленням. Останній був надзвичайною ситуацією, про яку ми навіть не підозрювали.

Що б ми зробили по-іншому наступного разу

Три речі, у порядку пріоритету, якби ми відновлювали стек затримки з нуля з тим, що ми знаємо зараз.

  • Спочатку побудуйте класифікатор-маршрутизатор, а потім модель. Рівень маршрутизації в кінцевому підсумку став частиною з найвищим впливом. Розглядаючи це як «ми додамо це пізніше, якщо нам це знадобиться», виявилося, що ми жили з затримкою однієї моделі на 18 місяців довше, ніж нам було потрібно.
  • Встановіть парність SLO перед мовними SLO. Спокуса полягає в тому, щоб встановити мовні цілі й дозволити виникнути паритет. Парність не виникає; вона повільно розходиться в напрямку основної мови команди.
  • Ресурси для кожної мови інфраструктури, як якщо б кожна мова була окремим продуктом. Mandarin TTS заслуговує на власний пул GPU з першого дня, а не з того дня, як ми виміряли розрив затримки.

Жодне з цього не є новим дослідженням. Нічого з цього не потребує паперу. Це вимагало розглядати паритет затримок як зобов’язання щодо продукту, а потім фінансувати непривабливу інфраструктуру для підтримки цього зобов’язання. Зараз ми маємо той паритет, який нам потрібен. У нас його не було чотири роки.

Запустіть свій голос на Ajoxi.

ШІ-ресепшн, оптові маршрути, віртуальні номери — створені на одній платформі з прозорим ціноутворенням і цілодобовим NOC.

Дивіться ціни Поговоріть з нами
Продовжуйте читати

Пов'язане читання

Підібране наступне читання з блогу Ajoxi.

We measured AI receptionist accuracy across 8,400 real calls
ШІ

Ми виміряли точність адміністратора ШІ для 8400 реальних дзвінків

Протягом трьох місяців ми відстежували кожен дзвінок, який обробив штучний інтелект — за мовою, акцентом, за типом дзвінка — і оцінювали стенограму за оцінкою людини. Точність цифр була кращою, ніж ми очікували. Режими відмови були цікавішими.

Прочитати статтю
Why we ship STIR/SHAKEN attestation on day one
Відповідність

Чому ми відправляємо атестацію STIR/SHAKEN у перший день

Більшість постачальників хмарних телефонів розглядають атестацію ідентифікатора абонента як функцію вищого рівня. Перевізники – ні. Ось чому ми зробили його за замовчуванням — і що це змінило для частоти вихідних відповідей.

Прочитати статтю
The case for ranking calls, not sampling them
Продукт

Випадок для ранжирування дзвінків, а не для їх вибірки

Випадкова вибірка пропускає виклики, які насправді мають значення. Ми перебудували консоль диспетчера на оцінку ризику — і перестали вдавати, що QA — це гра чисел.

Прочитати статтю