Нужен ли кеш результата диаризации #20

Closed
opened 2026-08-14 13:36:30 +03:00 by ddmitry · 1 comment
Owner

Часть карты: Карта: диаризация спикеров в транскрипте (#8)

Question

Нужно ли кешировать результат диаризации между повторными прогонами одного
файла, и если да, то где проходит граница кеша и чем он инвалидируется?

На доступном слабом Intel baseline диаризация часа записи занимает около
13,6 минуты. Цена повторного прохода теперь известна; решение должно учесть
локальность продукта, конфиденциальность интервалов, параметры моделей и
кластеризации, а также ожидаемую частоту повторной транскрипции.

Часть карты: [Карта: диаризация спикеров в транскрипте](https://git.dementev.space/ddmitry/local-transcriber/issues/8) (#8) ## Question Нужно ли кешировать результат диаризации между повторными прогонами одного файла, и если да, то где проходит граница кеша и чем он инвалидируется? На доступном слабом Intel baseline диаризация часа записи занимает около 13,6 минуты. Цена повторного прохода теперь известна; решение должно учесть локальность продукта, конфиденциальность интервалов, параметры моделей и кластеризации, а также ожидаемую частоту повторной транскрипции.
ddmitry added the wayfinder:grilling label 2026-08-14 13:36:30 +03:00
ddmitry added a new dependency 2026-08-14 14:17:51 +03:00
ddmitry self-assigned this 2026-08-14 14:57:57 +03:00
Author
Owner

Решение

Кеш результата диаризации между запусками не вводим.

  • Разметка говорящих живёт только в памяти текущего прогона и после сведения с распознанными словами больше не нужна.
  • Единственный постоянный продуктовый артефакт — итоговый Markdown-транскрипт.
  • Обычный повторный батч по-прежнему пропускает файлы с готовым транскриптом.
  • Явный повторный запуск одного файла и батч с --force полностью пересчитывают и ASR, и диаризацию.
  • Локальный кеш файлов моделей остаётся отдельным существующим механизмом и этим решением не затрагивается.

Расширенное логирование

--verbose выводит в консоль прогресс, число найденных говорящих и интервалов, длительность и предупреждения. Полный список интервалов, голосовые эмбеддинги и отдельный диагностический файл не сохраняются.

Если позже появится подтверждённый частый сценарий повторного ASR или форматирования при неизменной диаризации, кеш можно спроектировать отдельной задачей. Для первой реализации эта сложность не оправдана.

## Решение Кеш результата диаризации между запусками не вводим. - Разметка говорящих живёт только в памяти текущего прогона и после сведения с распознанными словами больше не нужна. - Единственный постоянный продуктовый артефакт — итоговый Markdown-транскрипт. - Обычный повторный батч по-прежнему пропускает файлы с готовым транскриптом. - Явный повторный запуск одного файла и батч с `--force` полностью пересчитывают и ASR, и диаризацию. - Локальный кеш файлов моделей остаётся отдельным существующим механизмом и этим решением не затрагивается. ## Расширенное логирование `--verbose` выводит в консоль прогресс, число найденных говорящих и интервалов, длительность и предупреждения. Полный список интервалов, голосовые эмбеддинги и отдельный диагностический файл не сохраняются. Если позже появится подтверждённый частый сценарий повторного ASR или форматирования при неизменной диаризации, кеш можно спроектировать отдельной задачей. Для первой реализации эта сложность не оправдана.
Sign in to join this conversation.
1 Participants
Notifications
Due Date
No due date set.
Reference: ddmitry/local-transcriber#20