feat(onnx): изменена модель по умолчанию на GigaAM RNN-T
- Зачем: - пользователям нужен читаемый транскрипт без обязательной LLM-обработки. - Что: - моделью ONNX по умолчанию выбрана `gigaam-v3-e2e-rnnt`. - сохранён явный профиль `gigaam-v3` для более точного сырого текста. - обновлены тест, README, спецификация, ADR и benchmark. - Проверка: - `uv run pytest -q` — 226 passed, 1 skipped. - `git diff --check`.
This commit is contained in:
@@ -197,10 +197,10 @@ FasterWhisper лучше сохраняет `API`, `ETL`, `Open Platform`; об
|
||||
11 раз медленнее GigaAM ради снижения WER примерно на 5–6 процентных пунктов.
|
||||
На CUDA соотношение необходимо измерять отдельно.
|
||||
|
||||
Три записи подтверждают RNN-T как практический профиль для готового текста, но
|
||||
не дают оснований молча менять общий default: существующие пользователи могут
|
||||
предпочитать более точный сырой `gigaam-v3`, а пунктуация RNN-T заметно дробит
|
||||
живую речь. Лучше выразить выбор явными профилями CLI или конфигурации.
|
||||
По итогам сравнения и обсуждения двух основных сценариев RNN-T выбрана моделью
|
||||
по умолчанию для явного `--device onnx`: небольшая потеря дословной точности
|
||||
принята ради читаемого результата с пунктуацией. Для LLM-пайплайнов и поиска,
|
||||
где важнее сырой текст, `gigaam-v3` остаётся явным профилем.
|
||||
|
||||
## Воспроизводимость
|
||||
|
||||
|
||||
Reference in New Issue
Block a user