docs: уточнены ограничения авто-профиля и профиль turbo
- Зачем: - документация обещала large-v3-turbo на NVIDIA, где он недоступен, и умалчивала, что модель по умолчанию без CUDA понимает только русскую речь. - Что: - large-v3-turbo перенесён из таблицы faster-whisper в раздел OpenVINO с измеренными размерами моделей. - языковое ограничение авто-профиля и предупреждение CLI описаны в README, gpu.md и ADR-006. - в backlog добавлен пункт про turbo для faster-whisper, в gpu.md снято расхождение по скорости openvino-cpu. - Проверка: - вычитка diff, проверка якорной ссылки на docs/gpu.md.
This commit is contained in:
@@ -252,6 +252,22 @@ SQL`), словарь пользовательский в `.transcriber.toml`.
|
||||
|
||||
---
|
||||
|
||||
### `large-v3-turbo` для faster-whisper
|
||||
|
||||
**Что:** Добавить `large-v3-turbo` в каталог faster-whisper, чтобы модель была
|
||||
доступна с `--device cuda` и `--device cpu`, а не только через OpenVINO.
|
||||
|
||||
**Почему:** На CPU turbo INT8 оказался быстрее `medium` и точнее по WER
|
||||
([сравнение от 2026-08-12](benchmarks/2026-08-12-openvino-large-v3-turbo-comparison.md)),
|
||||
и владельцам NVIDIA этот профиль сейчас недоступен без ручного указания
|
||||
репозитория HuggingFace.
|
||||
|
||||
**Почему откладывается:** каталог faster-whisper в проекте собран из
|
||||
репозиториев `Systran`, и для turbo нужно сначала выяснить, какая CT2-сборка
|
||||
годится, проверить её происхождение и качество, и только потом вносить в код.
|
||||
|
||||
---
|
||||
|
||||
## Отклонённые направления
|
||||
|
||||
*(пока пусто — добавлять сюда то, что попробовали и решили не делать, с причиной)*
|
||||
|
||||
Reference in New Issue
Block a user