IAM.Speech
Транскрипция, диаризация, QA-оценка и отчёты по разговорам.
Ключевые возможности
- ASR и speaker diarization
- Quality assurance и keyword/intent analysis
- Отчёты, fact tables и экспорт результатов
Пошаговые инструкции
Сценарии
Начинайте с результата: откройте сценарий, подготовьте prerequisites, выполните шаги и проверьте признаки успеха.
01 Загрузить запись и получить транскрипт с диаризациейРеплики разделены по спикерам и синхронизированы с таймкодами.
- Для кого
- QA analyst
- Результат
- Реплики разделены по спикерам и синхронизированы с таймкодами.
Перед началом
- Audio/video file или signed URL
- Язык записи
- Ожидаемое число спикеров
Шаги
- Создайте analysis jobЗагрузите файл, укажите language и включите diarization.
- Настройте speakersУкажите min/max speakers, если это известно из типа разговора.
- Дождитесь ReadyProcessing должен пройти ingest, ASR, diarization и alignment без failed stage.
- Проверьте спорные местаОтфильтруйте low confidence и смену speaker, прослушайте соответствующий таймкод.
Таймкоды открывают нужный звук, speaker labels стабильны на всём диалоге.
Плохая диаризация требует проверки channel mix/overlap, а не ручной замены всех labels.
02 Настроить QA-критерии и экспортировать отчётЗвонки оцениваются одной версией scorecard, выводы связаны с репликами.
- Для кого
- Руководитель качества
- Результат
- Звонки оцениваются одной версией scorecard, выводы связаны с репликами.
Перед началом
- QA scorecard
- Набор тестовых разговоров
- Владельцы corrective actions
Шаги
- Создайте scorecardДобавьте критерии, веса, critical fails и допустимый N/A.
- Проверьте на эталонеСравните auto score с ручной разметкой и настройте thresholds.
- Запустите batchЗафиксируйте scorecard version и период; не смешивайте версии в одном отчёте.
- Проверьте и экспортируйтеОткройте evidence для critical fails, затем экспортируйте CSV/XLSX.
Каждая оценка имеет criterion id, scorecard version и evidence timestamp.
При резком изменении score сравните version и composition выборки до изменения модели.
Открыть подробное руководство
Для каждого экрана приложения подготовлена отдельная страница с кнопками, безопасными примерами значений, CLI/API и восстановлением по кодам ошибок.
Роль в экосистеме
IAM.Speech обрабатывает аудио и записи коммуникаций, превращая их в транскрипцию, сегменты спикеров, факты и отчёты контроля качества. Источником может быть загрузка файла, API или запись из IAM.Comm/IAM.Voice.
Конвейер обработки
ingest → normalize → VAD/ASR → diarization → QA/extraction → report
Каждый этап публикует состояние и сохраняет связь с исходником. Частичный результат маркируется явно: отсутствие диаризации не должно выглядеть как подтверждённое назначение реплик конкретным людям.
Возможности
- временные метки, пунктуация и словарь предметной области;
- speaker diarization и ручная коррекция ролей;
- ключевые слова, intents, обязательные фразы и QA score;
- структурированные факты и экспорт отчёта;
- batch API и повторная обработка с новой конфигурацией.
Качество и воспроизводимость
Метрики разделяются по языку, каналу, шуму и числу спикеров. Версия модели, профиль обработки и контрольная сумма исходника сохраняются рядом с результатом. При переобработке предыдущая версия не перезаписывается молча.
Безопасность
Retention исходного аудио и текста задаётся отдельно. Доступ к записи не следует автоматически из доступа к агрегированному отчёту. Экспорт и удаление оставляют audit receipt.
Проверенные точки входа
- Landing
- https://iamspeech.ru/
- Приложение
- https://app.iamspeech.ru/
- Портфель
- https://iamgroup.ru/