Правка стала проверяемой: сканер сравнивает факты исходника и результата,
каталог откалиброван на третьем корпусе с русскими моделями, живые каталоги
сверяются с репо по расписанию. Каталог и баны не менялись.
- Факт-замок стал командой:
scan.py стало.txt --before было.txtпечатает
«было N, стало M» по чистоте и сравнивает факты исходника и результата:
числа, числительные словами, месяцы, имена, ссылки, инлайн-код. Новый факт,
которого в исходнике не было, даёт exit 2. Модульhumanizer_metrics/facts.py
едет со скиллом, мелкие количества («два», «половина») только отмечаются. - Третья калибровка каталога, на LLMTrace (
eval/llmtrace_calibration.py,
eval/LLMTRACE-CALIBRATION.md): 14 763 русских текста, 30 генераторов, 7
доменов. Впервые измерены GigaChat и YandexGPT: по словарю ближе к человеку,
чем gpt-3.5, по тире дальше всех (74-77% документов). Тире и «данный» на
отредактированных источниках срабатывают на людях чаще, чем на машинах,
на отзывах и историях наоборот: границы строгого режима подтверждены. - Гейт живых поверхностей
scripts/check_live_distribution.py: сверяет npm,
GitHub Release, ссылку на ZIP, версию и правила сканера на сайте и карточку
skills.sh с версией в репо. Крутится в CI раз в сутки
(live-distribution.yml), чтобы забытыйnpm publishили отставший деплой
не висели незамеченными. Карточка skills.sh считается мягкой поверхностью:
её кэш нам не подчиняется, отставание печатается предупреждением.