docs(domain): добавлена разметка говорящих

- Зачем:
  - потребовалось отделить временный результат диаризации от итоговых реплик транскрипта.
- Что:
  - добавлено определение разметки говорящих и перечислены нежелательные синонимы.
  - уточнено, что разметка не содержит текст, имена участников и голосовые эмбеддинги.
- Проверка:
  - выполнена команда git diff --cached --check.
This commit is contained in:
Dmitriy Dementiev
2026-08-14 15:18:59 +03:00
parent 26d4ca2f4a
commit b260dab047
+4
View File
@@ -28,6 +28,10 @@ _Avoid_: Реплика, фраза говорящего
Распознанное слово, положение которого известно на временной шкале записи. Минимальная единица, которой назначается говорящий. Распознанное слово, положение которого известно на временной шкале записи. Минимальная единица, которой назначается говорящий.
_Avoid_: Токен, ASR-сегмент _Avoid_: Токен, ASR-сегмент
**Разметка говорящих**:
Упорядоченный набор временных интервалов речи, каждому из которых назначена анонимная метка говорящего. Не содержит распознанного текста, имени участника или голосового эмбеддинга.
_Avoid_: Результат диаризации, сегменты говорящих
**Реплика говорящего**: **Реплика говорящего**:
Последовательность соседних слов с временной привязкой, назначенных одному говорящему. Это единица структуры готового транскрипта, а не запуска модели распознавания. Последовательность соседних слов с временной привязкой, назначенных одному говорящему. Это единица структуры готового транскрипта, а не запуска модели распознавания.
_Avoid_: Сегмент распознавания, ASR-сегмент _Avoid_: Сегмент распознавания, ASR-сегмент