Commit Graph
5 Commits
Author SHA1 Message Date
Dmitriy DementievandClaude Opus 4.6 104b0f695c docs: результаты оптимизации потоков CT2 int8_float32
8 потоков (физические ядра) — оптимум: 458с vs 599с (дефолт 4 потока).
16 потоков (SMT) хуже: 498с. CT2 int8_float32 с 8 потоками почти
догоняет whisper.cpp Vulkan (458с vs 432с) без доп. зависимостей.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-03-24 09:05:15 +03:00
Dmitriy DementievandClaude Opus 4.6 9a289bd59e docs: результаты whisper.cpp + Vulkan на Radeon 780M
432с — 2x vs CPU, но всего 28% быстрее CT2 int8_float32.
Зацикливание при дефолтных параметрах, workaround -mc 0.
Вывод: сложность интеграции не оправдана, CT2 int8_float32 — оптимум.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-03-23 23:23:58 +03:00
ddadminandClaude Opus 4.6 52acecfd65 docs: результаты прототипа whisper.cpp в WSL2
- whisper.cpp medium f16 на CPU: 886с, качество ≈ CT2 float32
- Vulkan GPU не доступен в WSL2 для AMD (нет dozen драйвера)
- Следующий шаг: Windows-сборка с нативным Vulkan

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-03-23 18:24:11 +03:00
Dmitriy DementievandClaude Opus 4.6 2a7d3605e7 docs: детали интеграции whisper.cpp + Vulkan
Модели (GGML формат), сборка, Python-биндинги, subprocess-подход.
Следующий шаг — прототип в WSL.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-03-23 16:45:14 +03:00
Dmitriy DementievandClaude Opus 4.6 78cd8b42ad docs: исследование ускорения на AMD Radeon/NPU
DirectML заблокирован (missing operator, maintenance mode).
whisper.cpp + Vulkan — основной путь (3-4x на Radeon 780M).
AMD NPU (XDNA 1) — рано, ждём XDNA 2 и зрелый tooling.

Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>
2026-03-23 16:23:02 +03:00