v0.12.1 — Словарь: без галлюцинаций, обрезка по токенам
RU: Галлюцинация распознавания больше не попадает в словарь; словарь режется по токенам
EN: Recognition loops no longer poison the dictionary; the prompt is capped by tokens
Изменения / Changes (2026-08-19)
- Словарь: галлюцинация распознавания больше не попадает в словарь, обрезка по токенам
Подробнее
Петля «галлюцинация → словарь → галлюцинация». Whisper на плохой записи
выдал одно слово двести раз подряд; строка легла в историю, автослой посчитал
слово самым частым и внёс в auto_terms.txt, а словарь уходит в
initial_prompt — и Whisper, уже подсказанный, выдавал его снова. Теперь
зацикливание отсекается сразу после распознавания (одно слово занимает 40%
фразы и повторено ≥8 раз — не вставляем и в историю не пишем), такие строки
не участвуют в сборке словаря, а латинские слова считаются один раз на
диктовку, а не по всем повторам.
Обрезка словаря по токенам. Раньше словарь резался по словам (60 штук), а
у initial_prompt потолок в 224 ТОКЕНА, и одно русское слово — это 3–5
токенов: словарь из 58 слов давал 227. Лишнее Whisper отрезает с начала, то
есть выбрасывал ровно ручные термины, которые важнее автослоя. Теперь режется
хвост автослоя, ручное ядро остаётся целиком.
Обновление из приложения: меню «О программе · версия» → «Обновления» (git по HTTPS, ключи не нужны). Ручной вариант: git pull --ff-only && uv sync && ./daemon.sh restart.