- Зачем: - результат benchmark нужно интерпретировать с учётом ограничения питания ноутбука. - Что: - зафиксировано урезанное питание во время прогонов. - визуальная оценка потери производительности около 30% явно отделена от измеренных результатов. - Проверка: - git diff --check.
7.2 KiB
Производительность диаризации на старом Intel Core i7
Дата: 2026-08-14
Статус: приёмка на доступном слабом Intel baseline. Не эквивалент замеру на Intel Core i5 11-го поколения.
Решение
Диаризация проходит по стоимости как опциональная функция. На доступном ноутбуке обработка остаётся заметно быстрее реального времени: час записи занимает около 23 минут при последовательном запуске ASR и диаризации.
Цена функции существенная: диаризация медленнее ASR и увеличивает полное время примерно в 2,4 раза. Поэтому включать её без явного запроса пользователя нельзя. Теоретическое совмещение независимых проходов уменьшило бы время часа записи до примерно 13,6 минуты, но параллельный режим здесь не измерялся.
Запланированный Intel Core i5 11-го поколения недоступен и в обозримом будущем не появится. Вместо бессрочного блокирующего требования принят доступный старый Intel Core i7 как практический слабый baseline. Результат не переносится на конкретный SKU i5 и не является сравнением микроархитектур.
Оборудование и условия
- HP ZBook 17 G3, BIOS N81 01.61;
- Intel Core i7-6820HQ, 4 ядра / 8 логических процессоров, 2,7–3,6 ГГц;
- 29 ГиБ доступной RAM;
- Ubuntu, Linux 7.0.0-29-generic x86_64;
- питание от сети, профиль
balanced, governorpowersave; доступная мощность была урезана, и ноутбук ограничивал производительность; - Python 3.13.13,
onnx-asr0.12.0,onnxruntime1.28.0,faster-whisper1.2.1,sherpa-onnx1.13.5, NumPy 2.4.3; - 8 потоков CPU, порог кластеризации 0,89;
- прогоны последовательные, без намеренно запущенной конкурирующей нагрузки;
- модели после первого запуска находились в локальном кеше.
По наблюдению владельца, ограничение питания снижало производительность примерно на 30%. Это визуальная оценка, а не результат отдельного A/B-замера, поэтому фактические времена ниже не пересчитываются. Их следует читать как консервативный результат именно в зафиксированном режиме питания.
Использованы те же три записи и те же SHA-256, что в
отчёте о калибровке. Модель ASR —
gigaam-v3-e2e-rnnt INT8; диаризация — Pyannote segmentation 3.0 и WeSpeaker
ResNet34 LM.
Результаты
Для самой длинной записи сделано три прогона каждого прохода. Для двух остальных — по одному подтверждающему прогону: разброс трёх повторов был мал, а коэффициенты на записях другой длины подтвердили линейное масштабирование.
| Запись | Длительность | ASR | RTFx ASR | Диаризация | RTFx диаризации |
|---|---|---|---|---|---|
| Data Test | 26:00 | 257,1 с (медиана: 261,2 / 257,1 / 253,7) | 6,1× | 352,6 с (медиана: 352,6 / 349,8 / 358,8) | 4,4× |
| T2 BDMA | 14:51 | 149,0 с | 6,0× | 203,7 с | 4,4× |
| Yantar | 20:22 | 185,3 с | 6,6× | 276,0 с | 4,4× |
| Взвешенно, три записи | 61:13 | 591,4 с | 6,2× | 832,3 с | 4,4× |
Последовательная обработка трёх записей занимает около 1424 секунд, или 23,7 минуты, при общей длительности 61,2 минуты: 2,58× realtime. В пересчёте на час это около 9,7 минуты ASR и 13,6 минуты диаризации, всего 23,3 минуты.
Инициализация и память
| Проход | Инициализация из локального кеша | Peak RSS |
|---|---|---|
| ASR | 2,0–2,3 с | 900–1035 МБ на тёплых прогонах |
| Диаризация | 0,2 с | 366–469 МБ |
Первый ASR-запуск показал 23,6 секунды, но включал скачивание файлов модели, поэтому не считается чистым cold start. Peak RSS этого процесса достиг 1174 МБ. Пиковая память замерена отдельно для каждого последовательного прохода; для будущего параллельного режима значения нельзя механически считать измеренным общим пиком.
Сопоставление с разведкой на Ryzen
На Ryzen 7 8845H для Data Test были получены 16,4× RTFx у ASR и 11,1× у диаризации. На старом Intel оба прохода медленнее примерно в 2,6 раза, а их соотношение почти не изменилось. Следовательно, слабое железо ухудшает абсолютное время, но не меняет основной архитектурный вывод: диаризация дороже ASR, а совмещение проходов потенциально полезно.
Ограничения
- Core i7-6820HQ не моделирует производительность Core i5 11-го поколения;
- влияние урезанного питания оценивается примерно в 30% только на глаз; прогон с полным питанием для сравнения не проводился;
- медиана трёх прогонов снята только на одной полной записи, на двух других есть по одному подтверждающему прогону;
- чистый cold start ASR без скачивания, но с холодным файловым кешем не измерен;
- параллельный запуск ASR и диаризации не измерен;
- результат отвечает только на стоимость выбранных моделей и конфигурации, а не на качество диаризации.