feat(onnx): добавлен каталог моделей GigaAM

- Зачем:
  - добавлена локальная транскрипция смешанной речи и русского текста с пунктуацией.
- Что:
  - onnx-asr обновлён до 0.12 и зарегистрированы три модели GigaAM.
  - выбор compute_type учитывает опубликованные квантизации и явность настройки.
  - обновлены тесты, README и требования PRD.
- Проверка:
  - uv run pytest -q: 223 passed, 1 skipped.
  - выполнены smoke- и полные прогоны четырёх GigaAM-моделей.
This commit is contained in:
Dmitriy Dementiev
2026-08-11 13:11:18 +03:00
parent 3c519c6860
commit 0af2dbdd17
8 changed files with 177 additions and 27 deletions
+2 -2
View File
@@ -118,7 +118,7 @@ transcribe <путь_к_файлу> [опции]
### 4.2. Требования к окружению
- Python ≥ 3.10
- Python ≥ 3.13
- ffmpeg в PATH (используется faster-whisper внутри для декодирования любых медиаформатов)
- Для GPU: Linux/WSL2 — cuBLAS из nvidia-cublas-cu12 (ставится автоматически через `uv sync`); Windows — системный CUDA toolkit (см. ADR-001)
- Дисковое пространство для моделей: ~3 GB (large-v3)
@@ -134,7 +134,7 @@ transcribe <путь_к_файлу> [опции]
| Компонент | Технология |
|---------------------|-------------------------------------------------|
| Язык | Python 3.10+ |
| Язык | Python 3.13+ |
| Управление проектом | uv (pyproject.toml) |
| Распознавание речи | faster-whisper (CTranslate2 backend) |
| Медиа-декодирование | ffmpeg (системная зависимость, используется faster-whisper внутри) |