feat(onnx): добавлен каталог моделей GigaAM
- Зачем: - добавлена локальная транскрипция смешанной речи и русского текста с пунктуацией. - Что: - onnx-asr обновлён до 0.12 и зарегистрированы три модели GigaAM. - выбор compute_type учитывает опубликованные квантизации и явность настройки. - обновлены тесты, README и требования PRD. - Проверка: - uv run pytest -q: 223 passed, 1 skipped. - выполнены smoke- и полные прогоны четырёх GigaAM-моделей.
This commit is contained in:
+2
-2
@@ -118,7 +118,7 @@ transcribe <путь_к_файлу> [опции]
|
||||
|
||||
### 4.2. Требования к окружению
|
||||
|
||||
- Python ≥ 3.10
|
||||
- Python ≥ 3.13
|
||||
- ffmpeg в PATH (используется faster-whisper внутри для декодирования любых медиаформатов)
|
||||
- Для GPU: Linux/WSL2 — cuBLAS из nvidia-cublas-cu12 (ставится автоматически через `uv sync`); Windows — системный CUDA toolkit (см. ADR-001)
|
||||
- Дисковое пространство для моделей: ~3 GB (large-v3)
|
||||
@@ -134,7 +134,7 @@ transcribe <путь_к_файлу> [опции]
|
||||
|
||||
| Компонент | Технология |
|
||||
|---------------------|-------------------------------------------------|
|
||||
| Язык | Python 3.10+ |
|
||||
| Язык | Python 3.13+ |
|
||||
| Управление проектом | uv (pyproject.toml) |
|
||||
| Распознавание речи | faster-whisper (CTranslate2 backend) |
|
||||
| Медиа-декодирование | ffmpeg (системная зависимость, используется faster-whisper внутри) |
|
||||
|
||||
Reference in New Issue
Block a user