Communications·production

IAM.Speech

Транскрипция, диаризация, QA-оценка и отчёты по разговорам.

Ключевые возможности

  • ASR и speaker diarization
  • Quality assurance и keyword/intent analysis
  • Отчёты, fact tables и экспорт результатов

Пошаговые инструкции

Сценарии

Начинайте с результата: откройте сценарий, подготовьте prerequisites, выполните шаги и проверьте признаки успеха.

01 Загрузить запись и получить транскрипт с диаризациейРеплики разделены по спикерам и синхронизированы с таймкодами.
Для кого
QA analyst
Результат
Реплики разделены по спикерам и синхронизированы с таймкодами.

Перед началом

  • Audio/video file или signed URL
  • Язык записи
  • Ожидаемое число спикеров

Шаги

  1. Создайте analysis jobЗагрузите файл, укажите language и включите diarization.
  2. Настройте speakersУкажите min/max speakers, если это известно из типа разговора.
  3. Дождитесь ReadyProcessing должен пройти ingest, ASR, diarization и alignment без failed stage.
  4. Проверьте спорные местаОтфильтруйте low confidence и смену speaker, прослушайте соответствующий таймкод.
Как проверить результат

Таймкоды открывают нужный звук, speaker labels стабильны на всём диалоге.

Если не работает

Плохая диаризация требует проверки channel mix/overlap, а не ручной замены всех labels.

02 Настроить QA-критерии и экспортировать отчётЗвонки оцениваются одной версией scorecard, выводы связаны с репликами.
Для кого
Руководитель качества
Результат
Звонки оцениваются одной версией scorecard, выводы связаны с репликами.

Перед началом

  • QA scorecard
  • Набор тестовых разговоров
  • Владельцы corrective actions

Шаги

  1. Создайте scorecardДобавьте критерии, веса, critical fails и допустимый N/A.
  2. Проверьте на эталонеСравните auto score с ручной разметкой и настройте thresholds.
  3. Запустите batchЗафиксируйте scorecard version и период; не смешивайте версии в одном отчёте.
  4. Проверьте и экспортируйтеОткройте evidence для critical fails, затем экспортируйте CSV/XLSX.
Как проверить результат

Каждая оценка имеет criterion id, scorecard version и evidence timestamp.

Если не работает

При резком изменении score сравните version и composition выборки до изменения модели.

Разделы приложения

Открыть подробное руководство

Для каждого экрана приложения подготовлена отдельная страница с кнопками, безопасными примерами значений, CLI/API и восстановлением по кодам ошибок.

Открыть подробное руководство →

Роль в экосистеме

IAM.Speech обрабатывает аудио и записи коммуникаций, превращая их в транскрипцию, сегменты спикеров, факты и отчёты контроля качества. Источником может быть загрузка файла, API или запись из IAM.Comm/IAM.Voice.

Конвейер обработки

ingest → normalize → VAD/ASR → diarization → QA/extraction → report

Каждый этап публикует состояние и сохраняет связь с исходником. Частичный результат маркируется явно: отсутствие диаризации не должно выглядеть как подтверждённое назначение реплик конкретным людям.

Возможности

  • временные метки, пунктуация и словарь предметной области;
  • speaker diarization и ручная коррекция ролей;
  • ключевые слова, intents, обязательные фразы и QA score;
  • структурированные факты и экспорт отчёта;
  • batch API и повторная обработка с новой конфигурацией.

Качество и воспроизводимость

Метрики разделяются по языку, каналу, шуму и числу спикеров. Версия модели, профиль обработки и контрольная сумма исходника сохраняются рядом с результатом. При переобработке предыдущая версия не перезаписывается молча.

Безопасность

Retention исходного аудио и текста задаётся отдельно. Доступ к записи не следует автоматически из доступа к агрегированному отчёту. Экспорт и удаление оставляют audit receipt.