Ajoxi
  • 柱
    クラウドフォン

    クラウド電話、メッセージング、ビデオ、FAX、チャット - 完全な UCaaS スタック。

    • 仮想電話番号どこにいても市内通話のフリーダイヤル番号
    • ビジネスフォン通話、SMS、ビデオ、1 回のログイン
    • 顧客エンゲージメントすべてのチャネル、1 つのスレッド
    • パーソナルAIすべての担当者の AI の相棒
    • SMSとMMS主な事業内容からのテキスト
    • チームチャット顧客と結びついた社内チャット
    • ビデオ会議AI メモと要約を備えた部屋
    • オンラインファックスFAX 機を使用しない FAX
    • ウェブサイトチャットボット注文ステータスと返品を自動解決します
    • 電話システムAIが組み込まれた最新のPBX
    注目の
    すべてが含まれています。
    クラウド電話、AI コンタクト センター、AI 受付、SMS、ビデオ、300 以上の統合。
    プランと料金を見る
  • コア機能
    • AI受付係24 時間年中無休の最初の回答 · 32 言語
    • AI のセンチメント迷惑な発信者を自動的にルーティングします
    • AIエージェントアシストささやきスクリプト + 次善のアクション
    • 会話インテリジェンス転写、感想、反論
    • 通話録音完全な忠実性 + キーワード検索
    • 自動応答ドラッグアンドドロップのビジュアル IVR ビルダー
    • スーパーバイザーツール聞く、ささやく、割り込む、監査ログ
    • フリーダイヤル番号800、888、877 — 高速プロビジョニング
    新しい
    AI センチメント · ライブスコアリング。
    センチメントが低下した瞬間に顧客を動揺させ、上級エージェントにルーティングします。すべての有料プランで。
    AI のセンチメントを参照
  • 業界別、チーム別
    • ファイナンスSOC 2 · FINRA 対応の監査証跡
    • 小売りオムニチャネル + カート回復 SMS
    • SaaSすべての座席に API + パーソナル AI
    • ロジスティクスマルチサイトディスパッチルーティング
    • 営業チームパワーダイヤラー + ライブ AI コーチング
    • サポートチーム8チャンネルにわたる共有メモリ
    • リモートチームすべてのデバイスで同じ番号
    • 中小規模企業AI受付係があなたのフロントデスクとして
    • エンタープライズITSSO、SCIM、マルチサイト ガバナンス
    最も多く採用されている
    呼び出しスタックのコンプライアンス信頼。
    通話録音、STIR/SHAKEN、感情ルーティング。 SOC 2、PCI、および FINRA 対応の監査証跡。
    「財務」を参照
  • ネイティブ同期
    • ハブスポット双方向同期・ライフサイクルトリガー
    • ゾーホーCRM · デスク · 書籍 · Bigin
    近日公開
    セールスフォース。パイプドライブ。生鮮販売。
    3 つのネイティブ双方向同期はすべて 2026 年第 3 四半期に開始されます。発売に関する注意事項が必要ですか?
    発売時にメールで連絡する
  • 価格設定
  • 学ぶ
    • ブログエンジニアリングおよび製品ノート
    • お客様の事例実際の結果、実際の数値
    • ガイドステップバイステップのプレイブック
    • ウェビナー毎週木曜生放送・オンデマンド
    • お問い合わせ営業担当者に相談するかサポートを受ける
    建てる
    • ドキュメントすべての仕組み
    • APIリファレンスREST + Webhook
    • SDKノード、Python、Go、Ruby
    • 変更履歴すべての船が 1 か所に
    信頼
    • ステータスページ稼働時間 + インシデント
    • セキュリティ + コンプライアンスSOC 2 · GDPR · PCI
    • プライバシー私たちが収集するものとその理由
    • 条項契約は章ごとに
    フレッシュインク
    8,400 回の通話を測定。
    AI 受付係の言語、アクセント、通話の種類別の正確さ (未編集の数値)。
    投稿を読む
  • English flag英語
  • Español flagスペイン語
  • Français flagフランセ
  • Deutsch flagドイツ語
  • Italiano flagイタリアーノ
  • Português flagポルトガル語
  • Nederlands flagオランダ
  • Русский flagРусский
  • Polski flagポルスキー
  • Türkçe flagテュルクチェ
  • العربية flagああ
  • हिन्दी flagहिन्दी
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagティエン・ヴィエット
  • Bahasa Indonesia flagインドネシア語
  • ไทย flagไทย
  • Svenska flagスヴェンスカ
  • Українська flagУкраїнська
サインイン無料トライアル
クラウドフォン
仮想電話番号どこにいても市内通話のフリーダイヤル番号ビジネスフォン通話、SMS、ビデオ、1 回のログイン顧客エンゲージメントすべてのチャネル、1 つのスレッドパーソナルAIすべての担当者の AI の相棒SMSとMMS主な事業内容からのテキストチームチャット顧客と結びついた社内チャットビデオ会議AI メモと要約を備えた部屋オンラインファックスFAX 機を使用しない FAXウェブサイトチャットボット注文ステータスと返品を自動解決します電話システムAIが組み込まれた最新のPBX
コンタクトセンター
オムニチャネルチャネルごとに 1 つのキューアウトバウンドダイヤラー予測、パワー、プレビューエージェントアシストライブささやきコーチングスーパーバイザーアシスト不正な通話をリアルタイムで特定インタラクション分析自動QA、トピックトレンド企業500以上のシートオペレーション
AIファミリー
アジョクシの声予約をする AI 受付係AIアシスタント草案、要約、フォローアップ会話AIすべての通話を読むので、聞き逃すことはありません
AI受付係24 時間年中無休の最初の回答 · 32 言語AI のセンチメント迷惑な発信者を自動的にルーティングしますAIエージェントアシストささやきスクリプト + 次善のアクション会話インテリジェンス転写、感想、反論通話録音完全な忠実性 + キーワード検索自動応答ドラッグアンドドロップのビジュアル IVR ビルダースーパーバイザーツール聞く、ささやく、割り込む、監査ログフリーダイヤル番号800、888、877 — 高速プロビジョニング
ファイナンスSOC 2 · FINRA 対応の監査証跡小売りオムニチャネル + カート回復 SMSSaaSすべての座席に API + パーソナル AIロジスティクスマルチサイトディスパッチルーティング営業チームパワーダイヤラー + ライブ AI コーチングサポートチーム8チャンネルにわたる共有メモリリモートチームすべてのデバイスで同じ番号中小規模企業AI受付係があなたのフロントデスクとしてエンタープライズITSSO、SCIM、マルチサイト ガバナンス
ハブスポット双方向同期・ライフサイクルトリガーゾーホーCRM · デスク · 書籍 · Bigin
学ぶ
ブログエンジニアリングおよび製品ノートお客様の事例実際の結果、実際の数値ガイドステップバイステップのプレイブックウェビナー毎週木曜生放送・オンデマンドお問い合わせ営業担当者に相談するかサポートを受ける
建てる
ドキュメントすべての仕組みAPIリファレンスREST + WebhookSDKノード、Python、Go、Ruby変更履歴すべての船が 1 か所に
信頼
ステータスページ稼働時間 + インシデントセキュリティ + コンプライアンスSOC 2 · GDPR · PCIプライバシー私たちが収集するものとその理由条項契約は章ごとに
  • English flag英語
  • Español flagスペイン語
  • Français flagフランセ
  • Deutsch flagドイツ語
  • Italiano flagイタリアーノ
  • Português flagポルトガル語
  • Nederlands flagオランダ
  • Русский flagРусский
  • Polski flagポルスキー
  • Türkçe flagテュルクチェ
  • العربية flagああ
  • हिन्दी flagहिन्दी
  • 简体中文 flag简体中文
  • 日本語 flag日本語
  • 한국어 flag한국어
  • Tiếng Việt flagティエン・ヴィエット
  • Bahasa Indonesia flagインドネシア語
  • ไทย flagไทย
  • Svenska flagスヴェンスカ
  • Українська flagУкраїнська
サインイン無料トライアル
Ajoxi

1 つのキャリアグレードのネットワーク上のクラウド電話と AI コンタクト センター。

SOC2GDPRPCI-DSS

スイート C、レベル 7、ワールド トラスト タワー、
50 スタンレー ストリート、セントラル、
香港

info@ajoxi.com+1 (512) 612-4425

クラウドフォン

  • ビジネスフォン
  • 顧客エンゲージメント
  • SMSとMMS
  • チームチャット
  • ビデオ会議
  • 電話システム

コンタクトセンター

  • オムニチャネル
  • アウトバウンドダイヤラー
  • エージェントアシスト
  • インタラクション分析
  • エンタープライズ CCaaS

AI

  • AIプラットフォーム
  • AI受付係
  • AIアシスタント
  • 会話型AI
  • AI のセンチメント
  • 会話インテリジェンス

ソリューション

  • ファイナンス
  • 小売と e コマース
  • SaaS とテクノロジー
  • 営業チーム
  • 中小規模企業

リセラー

  • 卸売VoIP
  • 卸売の声
  • SIP トランキング
  • CLI ルート

会社

  • 価格設定
  • について
  • お客様
  • お問い合わせ
  • 国コード
  • 市外局番
  • ドキュメント
  • 状態
  • 安全

© 2026 アジョクシ。無断転載を禁じます。

すべてのシステムは正常です
  • プライバシー
  • 条項
  • サイトマップ
ブログ/エンジニアリング/中国語と英語で同じ遅延。その方法は次のとおりです

中国語と英語で同じ遅延。その方法は次のとおりです

モデルを肥大化させることなく 32 の言語間でレイテンシの同等性を実現するには、予想外のモデル ルーティング レイヤーが必要でした。潜伏作戦室からのメモ。

目次
  • 1.導入
  • 2.ミリ秒が実際にどこに行くのか
  • 3.ルーティングの修正
  • 4.誰も予想していなかった分類器が登場する
  • 5.TTS 側の問題
  • 6.平均ではなくパリティを測定する
  • 7.まだ遅いのは何ですか
  • 8.私たちが違うことをするとしたら

導入

当社の音声製品には 2 つの苦情があり、社内で調整できませんでした。英語を話す企業顧客からは、AI はきびきびしていると感じられました。中国語を話す顧客、そしてますますベトナム語、タガログ語、ヒンディー語を話す顧客からは、AI が遅いと感じられました。発信者の沈黙から AI の最初の音節までのエンドツーエンドで測定したギャップは、英語で 260 ミリ秒、中国語で 540 ミリ秒でした。どちらの数値も、公開されているレイテンシの予算内にありました。

電話で対応できると感じたのはそのうちの 1 人だけでした。

レイテンシのギャップを発見したエンジニアリング チームは本能的にモデルを徹底的に検討することになります。より速い推論。より小型のモデル。量子化の改善。私たちはそれをすべて行いました。全体的に 60 ミリ秒を獲得しましたが、何も縮まりませんでした。相対的な差は依然として存在し、英語は依然として 2 倍の速さでした。

本当の修正は、別の観察から生まれました。実際にはルーティングの問題であるにもかかわらず、レイテンシをモデルの問題として扱っていたのです。

ミリ秒が実際にどこに行くのか

540 ミリ秒の北京語応答をセグメントに分割することが、問題を明らかにする最初のことでした。会計は大まかに次のようになりました。

  • オーディオのキャプチャとエンドポイント — 80ミリ秒
  • 音声からテキストへの最初のトークン — 140ミリ秒
  • インテント + 取得パイプライン — 90ミリ秒
  • 大規模モデルの最初のトークン (世代) — 180ミリ秒
  • テキスト読み上げの最初の音声 — 50ミリ秒

英語のパスでは、同じセグメントが 80 / 60 / 90 / 80 / 40 でした。劇的に分岐した 2 つのセグメントは、音声テキスト変換と大規模モデルの生成でした。中国語で STT が遅くなったのは、音響モデルが、最初のトークンを 80 ミリ秒押し出す、より長いコンテキスト ウィンドウ (声調の曖昧さの解消に必要) でトレーニングされていたためです。

トークナイザーは、英語よりも北京語の方が同等の意味を持つ 1 文字あたりのトークンをより多く生成したため、モデルの生成が遅くなりました。

どちらもモデルの欠陥ではありませんでした。どちらも、精度を求める STT、生成品質を求める LLM など、独自の指標を最適化する独立したチームによって静かに蓄積されてきたトレードオフでした。レイテンシーコストは現実のものでしたが、それは誰の損益でもありませんでした。

200ミリ秒を費やしたルーティング修正

単一の LLM を介してすべての言語をルーティングするのをやめました。代わりに、生成の前に薄い分類層を構築しました。この層は、8 ミリ秒未満で 3 つのことを検出します。着信発話の言語、会話の意図クラス、およびリクエストが 200 万の通話セグメントをクラスタリングすることで特定した約 40 の高頻度パターンの 1 つであるかどうかです。

分類子が英語以外の言語の高頻度パターンを識別すると、そのパターンを直接処理する、より小規模で言語に特化したモデルに生成をルーティングします。小規模なモデルは、同じパターンの数百万回の完了に基づいて抽出されているため、それらの特定のパスでの品質は大きなモデルのノイズの範囲内にありますが、最初のトークンのレイテンシは約 3 分の 1 です。

分類子が末尾のインテント (40 パターンにないもの) を見つけると、リクエストは以前と同様に大きなモデルに渡されます。レイテンシの低下のほとんどは、高周波パターンが また 通話量の最大 78% を占めるパターン。テールケースは元のレイテンシを支払いますが、それはまれです。

誰も予想していなかった分類器が登場する

シン分類器は、誰も予算を付けていなかったプロジェクトの一部でした。障害モードが微妙だったため、ルーティング システム自体を構築するよりも構築に時間がかかりました。リクエストの 1% を、リクエストを処理しない小規模モデルに誤ってルーティングする分類子は、応答の低下だけでなく、幻覚を引き起こします。

分類器が機能する理由は 3 つありました。まず、合成データではなく、実際の運用トラフィックでトレーニングされました。次に、ルーターがしきい値を設定できる信頼度スコアを返します。信頼度 0.91 未満のものは、自動的に大きなモデルに分類されます。

3 番目に、実際にトラフィックが小さなモデルにルーティングされる前に、グラウンド トゥルースを提供する大きなモデルを使用して、既存のパイプラインに対して 6 週間シャドウ デプロイしました。

シャドウ展開では、オフライン テスト セットが見逃していた 4 つのクラスの間違いが見つかりました。 2 つはトレーニング データで簡単に修正できました。 2 つの必須の意図的なルーティング ルール。身元確認、支払い、または約束のキャンセルに関わるものはすべて、分類子の信頼度に関係なく、常に大きなモデルに送られます。これは、これらのパスでの幻覚のコストが遅延の勝利よりも高いためです。

TTS 側の問題

LLM と STT の変更がレビューされている間、並行してチームが音声出力の作業を行っていました。英語の 50 ミリ秒の TTS 最初の音声は事実上無敵でした。英語以外のほとんどの言語での 70 ミリ秒から 90 ミリ秒のギャップは、より小さい音声モデル、あまり積極的ではないキャッシュ、および負荷時に英語を優先する単一の共有 GPU プールによって引き起こされました。

TTS インフラストラクチャを言語に固定されたプールに分割しました。中国語 TTS は現在、中国語トラフィックのほとんどが発生する地域に近いハードウェア上で、独自のスケーリング ルールを備えた独自のプールで実行されます。カットオーバーから 2 週間以内に、遅延は 70 ~ 90 ミリ秒から 45 ミリ秒に減少しました。

これはどれも賢明ではありませんでした。それはインフラストラクチャの作業であり、単一言語のわずかな改善だけでは、それを正当化できるものではなかったため、誰もわざわざ行おうとはしませんでした。

教訓は、そして私たちは現在それを社内で書き留めていますが、「単一のユーザー向け指標がそれを正当化するものではなかったため、これに投資しなかった」ということは、まさに 4 年間にわたる 2 つの言語間の 280 ミリ秒の差を悪化させる種類の決定であるということです。

平均ではなくパリティを測定する

私たちが社内で行った小さいながらも重要な変更の 1 つは、チームのレイテンシ ダッシュボードのレポート方法に対するものでした。以前は、単一の SLO に対して、すべての言語で平均したエンドツーエンドの遅延の p50 と p95 を追跡していました。ダッシュボードはほとんどの場合緑色に見えました。

新しいダッシュボードは p50 と p95 をレポートします 言語ごと に対して パリティ SLO — サポートされている最も遅い言語と最も速い言語の間のギャップには、個別に適用される独自の予算があります。パリティ バジェットを 60 ミリ秒に設定します。ギャップが予算を超えると、オンコールはページングされます。

パリティ ダッシュボードは、平均ベースのダッシュボードではできなかったことを実行します。つまり、最も遅い言語での回帰を、最も速い言語での回帰と同じ緊急度で表示できるようになります。 32 言語の平均をとった場合、ベトナム語での 200 ミリ秒の回帰により、平均は 6 ミリ秒変化します。パリティを測定すると、ダッシュボードが 200 ミリ秒ずつ移動します。

まだ遅いのは何ですか

ルーティング作業、TTS プール、およびパリティ ダッシュボードの後、最悪の言語 (広東語、主にサポートする音響モデル コーパスが小さいため) は 320 ミリ秒にとどまります。英語は220msです。残りの 100 ミリ秒のギャップは実際のものであり、それがどこにあるかはおおよそわかっています。広東語 STT 音響モデルは古く、まだ新しいアーキテクチャに対応していないため、第 3 四半期に再トレーニングする予定です。

ただし、「最も遅い言語は最も速い言語より 100 ミリ秒遅れている」ということと、「最も遅い言語は最も速い言語より 280 ミリ秒遅れている」という話は異なります。前者は既知の回帰であり、四半期ごとに修正が予定されています。後者は、私たちが気づいていなかった顧客体験の緊急事態でした。

次回は違うことをするだろう

現在わかっていることを使ってレイテンシ スタックをゼロから再構築する場合、優先順位として 3 つのことが挙げられます。

  • 最初に分類子ルーターを構築し、次にモデルを構築します。最終的に、ルーティング層が最もレバレッジの高い部分となりました。これを「必要に応じて後で追加します」として扱うことは、必要以上に 18 か月間、単一モデルのレイテンシーを抱えて生きてきたことを意味することが判明しました。
  • 言語 SLO の前にパリティ SLO を設定します。言語ごとに目標を設定し、同等性を持たせたいという誘惑に駆られます。パリティは現れません。それはゆっくりと、チームの第一言語の方向に分岐していきます。
  • 各言語が個別の製品であるかのように、言語ごとのインフラストラクチャをリソース化します。 Mandarin TTS には、レイテンシー ギャップを測定した日からではなく、初日から独自の GPU プールが必要でした。

これはいずれも新しい研究ではありません。どれも紙を必要としませんでした。レイテンシの同等性を製品のコミットメントとして扱い、そのコミットメントを裏付ける地味なインフラストラクチャに資金を提供する必要がありました。私たちは今必要な等価性を持っています。うちは4年も持たなかった。

Ajoxi に声を上げてください。

AI 受付係、卸売ルート、仮想番号 — 透明な価格設定と 24 時間 365 日の NOC を備えた 1 つのプラットフォーム上に構築されています。

価格を見る ご相談ください
読み続けてください

関連書籍

次に、Ajoxi ブログから厳選した記事を読みます。

We measured AI receptionist accuracy across 8,400 real calls
AI

実際の 8,400 件の通話で AI 受付係の精度を測定しました

3 か月間、AI が処理したすべての通話を言語、アクセント、通話の種類ごとに追跡し、その記録を人間の審査員に照らして採点しました。精度の数値は予想よりも優れていました。失敗モードはさらに興味深いものでした。

記事を読む
Why we ship STIR/SHAKEN attestation on day one
コンプライアンス

STIR/SHAKEN 証明書を初日に発送する理由

ほとんどのクラウド電話ベンダーは、発信者 ID 構成証明を上位層の機能として扱います。通信事業者はそうではありません。これをデフォルトにした理由と、それによってアウトバウンド応答率がどのように変化したかを説明します。

記事を読む
The case for ranking calls, not sampling them
製品

呼び出しをサンプリングするのではなくランク付けする場合

ランダム サンプリングでは、実際に重要な呼び出しが見逃されます。私たちはリスク スコアを中心にスーパーバイザ コンソールを再構築し、QA が数字遊びであるかのように振る舞うのをやめました。

記事を読む