録音ファイルからコールセンター品質評価を始める、バッチ運用で決める受け渡しと確認

コールセンターの応対品質評価は、長らく抜き取りで行われてきた。AIによる品質評価を解説したAircallの記事は、人手のサンプリング評価では多くのセンターで対象が全体の5%に満たないと指摘し、AIで全件を採点する動きを紹介している。全件評価の魅力は分かりやすい。だが、その手の提案を受けたセンターの多くが同じ場所で立ち止まる。評価AIを通話システムにつなぎ込む、その接続である。CTI(電話とコンピューターをつなぐ仕組み)への接続は情報システム部門の審査と工事を伴い、検討が年単位になることもある。では、接続しなければ始められないのか。
そうではない、というのが本稿の出発点である。手元にはすでに録音ファイルがある。それを評価ツールへ「ファイルとして渡す」バッチ運用なら、通話システムに触れずに品質評価を始められる。実際、この方式は珍しいものではなく、たとえばAWSが公開する通話後分析のサンプルソリューションは、所定の保存場所に録音ファイルを置けば文字起こしと分析が走る構成を取っているし、Amazon Transcribeの通話分析の説明でも、保存済みファイルを対象にする通話後の分析と、通話中のストリーミング分析は別の方式として並んでいる。
この論点は取材にも出発点がある。CC AI BENCHMARK 2026の7月のセッションで、CAC identityの下地貴明氏は応対品質評価サービスmimityについて、テキストの内容と音声から読み取れる印象の両面で応対を評価する仕組みを説明し、実運用ではCTI連携を前提にせず、録音ファイルを出力してバッチで取り込む方式が基本だと述べていた。本番の通話システムに触れない方式は、導入の速さの面での利点としても語られていた。この「録音ファイルで始める」という選択肢の存在は同氏の説明に拠るものであり、以下の業務設計はそこから編集部(相原ことは)が独立に組み立てた提案である。特定の製品の仕様や推奨ではない。
本稿の立場も先に書いておく。バッチ型の品質評価がつまずくのは、AIの採点精度ではなく、ファイルの受け渡しという地味な業務の設計が抜けたときだと見ている。誰が録音を出し、誰が渡し、誰が結果を見て、落ちたファイルを誰が拾うのか。ここを決めずに始めた全件評価は、気づかぬうちに「歯抜け評価」になる。
リアルタイムで必要な評価と後からよい評価を分ける

最初に決めるのは方式ではなく、評価の用途である。健康管理にたとえると、手術中の心拍モニターと年に一度の健康診断は、どちらも体を測るが役割が違う。通話中にその場で介入したい評価と、後から振り返ればよい評価は分けて考える。
通話中でなければ意味がない評価の代表は、禁止ワードの即時アラートや、怒りの兆候を検知してSVに知らせる類のものだ。これはストリーミング接続がないと成立しない。一方、オペレーターごとの応対品質の採点、育成のためのフィードバック、月次の傾向分析は、通話の数時間後や翌日に結果が出ても業務は成り立つ。多くのセンターで品質評価の本丸はこちらである。
だから順序はこうなる。後からよい評価だけをまず洗い出し、それをバッチで始める。リアルタイムが要る用途は、効果が数字で見えてから、接続投資の判断として切り離して検討する。最初から両方を一つの導入に束ねると、リアルタイム要件がCTI接続を呼び込み、検討全体が重くなる。
会員先行公開中(10月12日に一般公開)



