Производительность диаризации на целевом Intel Core i5 #13

Closed
opened 2026-08-12 15:05:34 +03:00 by ddmitry · 2 comments
Owner

Часть карты: Карта: диаризация спикеров в транскрипте (#8)

Question

Приемлема ли стоимость диаризации на целевом железе?

На машине разработчика (Ryzen 7 8845H) диаризация дала 11,1× RTFx против 16,4×
у ASR — то есть последовательный запуск замедляет обработку в 2,5 раза, и
диаризация оказывается дороже самой транскрипции. Масштабирование по потокам
слабое: с 4 до 8 потоков выигрыш 9%.

Бэклог прямо требует приёмку производительности на Intel Core i5 11-го
поколения; машина разработчика годится только для итераций.

Это гейт жизнеспособности. Если на целевом i5 стоимость окажется
неприемлемой, выбор единицы привязки, формат и UX становятся ненужной работой —
поэтому тикет блокирует выбор единицы привязки и должен быть взят рано.

Тикет не ждёт калибровки. Свип разведки показал, что время не зависит от
настроек кластеризации: 153, 153, 153 и 157 секунд на четырёх конфигурациях.
Мерить надо на конфигурации разведки. Оговорка: если калибровка сменит модель
эмбеддингов, замер придётся повторить — на сам вывод о жизнеспособности это
вряд ли повлияет, но число сдвинется.

Требует второго ноутбука.

  • замерить ASR и диаризацию на тех же записях на целевом i5;
  • записать точный SKU, число ядер, объём RAM, схему питания и число потоков;
  • измерить отдельно инициализацию моделей и сам проход, медиану трёх прогонов;
  • снять пиковую память процесса (в разведке это не удалось из-за ошибки
    в измерительном скрипте);
  • прикинуть, остаётся ли результат приемлемым для часовой записи.

Ответ — цифры на целевом железе и вывод, проходит ли диаризация по стоимости
как опциональная функция.

Часть карты: [Карта: диаризация спикеров в транскрипте](https://git.dementev.space/ddmitry/local-transcriber/issues/8) (#8) ## Question Приемлема ли стоимость диаризации на целевом железе? На машине разработчика (Ryzen 7 8845H) диаризация дала 11,1× RTFx против 16,4× у ASR — то есть последовательный запуск замедляет обработку в 2,5 раза, и диаризация оказывается дороже самой транскрипции. Масштабирование по потокам слабое: с 4 до 8 потоков выигрыш 9%. Бэклог прямо требует приёмку производительности на Intel Core i5 11-го поколения; машина разработчика годится только для итераций. **Это гейт жизнеспособности.** Если на целевом i5 стоимость окажется неприемлемой, выбор единицы привязки, формат и UX становятся ненужной работой — поэтому тикет блокирует выбор единицы привязки и должен быть взят рано. **Тикет не ждёт калибровки.** Свип разведки показал, что время не зависит от настроек кластеризации: 153, 153, 153 и 157 секунд на четырёх конфигурациях. Мерить надо на конфигурации разведки. Оговорка: если калибровка сменит модель эмбеддингов, замер придётся повторить — на сам вывод о жизнеспособности это вряд ли повлияет, но число сдвинется. **Требует второго ноутбука.** - замерить ASR и диаризацию на тех же записях на целевом i5; - записать точный SKU, число ядер, объём RAM, схему питания и число потоков; - измерить отдельно инициализацию моделей и сам проход, медиану трёх прогонов; - снять пиковую память процесса (в разведке это не удалось из-за ошибки в измерительном скрипте); - прикинуть, остаётся ли результат приемлемым для часовой записи. Ответ — цифры на целевом железе и вывод, проходит ли диаризация по стоимости как опциональная функция.
ddmitry added the wayfinder:task label 2026-08-12 15:05:34 +03:00
ddmitry added a new dependency 2026-08-12 15:07:19 +03:00
ddmitry self-assigned this 2026-08-14 11:47:26 +03:00
Author
Owner

Решение: стоимость диаризации приемлема для явной опциональной функции на доступном слабом Intel baseline.

На HP ZBook 17 G3 с Core i7-6820HQ (4C/8T, 29 ГиБ RAM, питание от сети, balanced/powersave, 8 потоков) проверены те же три контрольные записи. Для Data Test снята медиана трёх прогонов, две остальные записи подтверждены по одному разу.

  • ASR: взвешенно 6,2× realtime, 591,4 с на 61:13 аудио.
  • Диаризация: 4,4× realtime, 832,3 с.
  • Последовательно: 2,58× realtime, около 23,3 минуты на час записи; в 2,4 раза дольше одного ASR.
  • Инициализация из кеша: ASR 2,0–2,3 с, диаризация 0,2 с.
  • Peak RSS: ASR 900–1035 МБ на тёплых прогонах, диаризация 366–469 МБ.

Конкретный Intel Core i5 11-го поколения не проверен: такого устройства нет и в обозримом будущем не будет. Core i7-6820HQ принят как практический слабый Intel baseline, но не как эквивалент i5.

Полный отчёт: Производительность диаризации на старом Intel Core i7. Артефакт опубликован в draft PR «Карта: диаризация спикеров в транскрипте», коммит 99ddf77.

Решение: стоимость диаризации приемлема для явной опциональной функции на доступном слабом Intel baseline. На HP ZBook 17 G3 с Core i7-6820HQ (4C/8T, 29 ГиБ RAM, питание от сети, balanced/powersave, 8 потоков) проверены те же три контрольные записи. Для Data Test снята медиана трёх прогонов, две остальные записи подтверждены по одному разу. - ASR: взвешенно 6,2× realtime, 591,4 с на 61:13 аудио. - Диаризация: 4,4× realtime, 832,3 с. - Последовательно: 2,58× realtime, около 23,3 минуты на час записи; в 2,4 раза дольше одного ASR. - Инициализация из кеша: ASR 2,0–2,3 с, диаризация 0,2 с. - Peak RSS: ASR 900–1035 МБ на тёплых прогонах, диаризация 366–469 МБ. Конкретный Intel Core i5 11-го поколения не проверен: такого устройства нет и в обозримом будущем не будет. Core i7-6820HQ принят как практический слабый Intel baseline, но не как эквивалент i5. Полный отчёт: [Производительность диаризации на старом Intel Core i7](https://git.dementev.space/ddmitry/local-transcriber/src/branch/feature/8-diarization-map/docs/benchmarks/2026-08-14-diarization-intel-i7.md). Артефакт опубликован в draft PR [«Карта: диаризация спикеров в транскрипте»](https://git.dementev.space/ddmitry/local-transcriber/pulls/18), коммит `99ddf77`.
Author
Owner

Уточнение условий замера: во время тестов ноутбук работал с урезанным питанием и ограничивал производительность. По наблюдению владельца, потеря составляла примерно 30%, но это визуальная оценка без отдельного A/B-прогона. Поэтому измеренные времена и RTFx не пересчитываются и считаются консервативным результатом для зафиксированного режима питания. Уточнение добавлено в benchmark-отчёт, коммит bbc2bda.

Уточнение условий замера: во время тестов ноутбук работал с урезанным питанием и ограничивал производительность. По наблюдению владельца, потеря составляла примерно 30%, но это визуальная оценка без отдельного A/B-прогона. Поэтому измеренные времена и RTFx не пересчитываются и считаются консервативным результатом для зафиксированного режима питания. Уточнение добавлено в benchmark-отчёт, коммит `bbc2bda`.
Sign in to join this conversation.
1 Participants
Notifications
Due Date
No due date set.
Reference: ddmitry/local-transcriber#13