Skip to content

Releases: prankhitevil/Hagen

Hagen v1.0.0 - точная модель включена в архив (giga_am v3_e2e_rnnt, сжатые веса int8)

Choose a tag to compare

@prankhitevil prankhitevil released this 23 Sep 18:54

Это тот же выпуск, что v1.0.0_compact, только архивом со всем внутри: точная модель распознавания речи (сжатые веса), библиотеки, ffmpeg. При установке ничего не скачивается. Лёгкий v1.0.0_compact (архив 69 МБ) при установке докачивает библиотеки с PyPI, ffmpeg с GitHub и модель распознавания с Hugging Face; если эти сайты с вашего компьютера открываются, удобнее взять его. Обновляются оба выпуска одинаково — кнопкой «Настройки → О программе → Проверить обновления».

Лёгкий — v1.0.0_compact, рекомендуется Полный, сжатые веса — v1.0.0_full_int8 Полный, полные веса — v1.0.0_full_fp32
Файл Hagen-v1.0.0-windows.zip, 69 МБ Hagen-v1.0.0-windows-full-int8.zip, 0,7 ГБ Hagen-v1.0.0-windows-full-fp32.zip, 1,3 ГБ
Что докачивается при установке около 0,6 ГБ: библиотеки с PyPI, ffmpeg с GitHub и модель с Hugging Face ничего ничего
Точная модель сжатые веса (полные — кнопкой в Настройках) сжатые веса (полные — в Настройках) полные веса (сжатые — в Настройках)
Кнопка «Проверить обновления» есть есть есть

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Как поставить

  1. Скачайте Hagen-v1.0.0-windows-full-int8.zip (ниже, в Assets), 0,7 ГБ — готовая программа, всё внутри.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он ничего не скачивает: настраивает пути, спрашивает папку хранилища Obsidian и создаёт ярлык «Hagen».
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Полных весов в этом архиве нет: если переключить на них в «Настройки → Модели», программа докачает их с Hugging Face (890 МБ). Нужны полные сразу, без докачки, — берите v1.0.0_full_fp32.

Что в архиве

  • точная модель распознавания русской речи GigaAM v3 через onnx-asr, сжатые веса (230 МБ);
  • разметка голосов — модель pyannote community-1 на ONNX Runtime, без регистрации и токенов;
  • поиск речи — Silero VAD на ONNX Runtime;
  • Python 3.12, библиотеки (без torch), ffmpeg.

Что нового в v1.0.0

  • Без torch. Поиск речи, обе русские модели распознавания, английская и разметка голосов считаются на onnxruntime. Из выпуска ушли torch и его спутники (около 550 МБ библиотек; sympy остаётся — его требует onnxruntime) и пакет gigaam: библиотек в папке становится 0,3 ГБ вместо 1,0, памяти в простое — примерно на 160 МБ меньше. Модель поиска речи (Silero VAD, 2 МБ) теперь лежит в папке программы и едет с кодом; границы речи те же, что были, — бит в бит. Быстрая модель берётся в готовом ONNX с Hugging Face, как и точная (850 МБ; раньше 440 МБ весов переводились в ONNX на компьютере несколько минут), и считает на 20 % быстрее. Выбор «движок torch» из «Настройки → Модели» убран; у кого он стоял, тот молча переводится на полные веса — текст тот же слово в слово. Файлы прежних версий (веса torch, свой экспорт в ONNX, до 2,5 ГБ) программа больше не читает и предлагает удалить в «Настройки → Модели». Релиз с разметкой через pyannote остаётся отдельной сборкой со своим torch.
  • По умолчанию — точная модель со сжатыми весами. Её ставит установщик и везёт полный архив: 230 МБ вместо 890, в памяти втрое меньше и примерно на 20 % быстрее; слова совпадают с полными весами на 98 %. Если качество стенограмм не устраивает — переключите в «Настройки → Модели» веса на «полные». У кого выбор уже сделан, у того он не меняется.

И всё, что пришло в v0.9.9:

  • Записи с телефона. Новый раздел настроек «С телефона» (включается в «Возможностях»). Две дороги в одни входящие: папки входящих — программа следит за указанными папками и берёт новый звуковой или видеофайл, когда он дописан (чем наполнять папку — LocalSend, Quick Share, «Связь с телефоном», облачный диск, загрузки Telegram Desktop, — программе всё равно; что лежало в папке до её добавления, не берётся; оригинал остаётся на месте); и страница в локальной сети — QR-код в настройках, телефон открывает ссылку в браузере и отправляет файл, приложения не нужно. Страница слушает свой порт, умеет только принять файл и открывается только по ссылке с ключом; «Новый ключ» закрывает старую. Пришедший файл распознаётся и раскладывается по голосам, документ — по кнопке. Новая зависимость segno (QR-код, чистый Python).
  • Сколько стоит документ. Если сервис по ключу сам отдаёт цены в списке моделей (Polza, OpenRouter), цена видна под полем «Модель», примерная стоимость — в окне «Сделать документ», а потраченное — в подписи под готовым документом. Своих таблиц цен в программе нет: не назвал сервис цену — её и не показываем.
  • Todoist снова принимает задачи. Todoist отключил прежний адрес API (ответ 410), и ни список проектов, ни отправка не работали. Программа перешла на новый; токен тот же. Проект в настройках, возможно, придётся выбрать заново: у проектов теперь другие номера.
  • Подпись под документом больше не уходит в задачи. Когда раздел задач стоял в документе последним, строка «Подготовил Hagen…» попадала в поручения — и в Todoist, и в «С прошлого раза осталось».
  • Во время записи готовые записи не теряют вкладок. Пока шла запись, любая открытая запись показывала блок записи вместо вкладок, «+ Документ», «Отправить» и «Править». Теперь у готовой записи всё на месте, а сверху — строка «идёт запись · Стоп». Кнопка у свёрнутых устройств теперь и сворачивает их обратно.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 1 ГБ на диске;
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v1.0.0 распознавание речи и поиск речи работают без torch, на onnxruntime; с v0.9 так же работает разметка голосов. На замерах по настоящим совещаниям результат совпал с прежним путём (полные веса — слово в слово, сжатые — около 98 % слов), но в повседневной работе это проверяется только сейчас.

Лицензия

GNU GPL v3.0. Сторонние компоненты и их лицензии — в THIRD-PARTY-NOTICES.md. В архиве лежит сборка FFmpeg под GPL; её исходники — https://www.gyan.dev/ffmpeg/builds/ и https://git.ffmpeg.org/ffmpeg.git.

Hagen v1.0.0 - точная модель включена в архив (giga_am v3_e2e_rnnt, полные веса fp32)

Choose a tag to compare

@prankhitevil prankhitevil released this 23 Sep 18:58

Это тот же выпуск, что v1.0.0_compact, только архивом со всем внутри: точная модель распознавания речи (полные веса), библиотеки, ffmpeg. При установке ничего не скачивается. Лёгкий v1.0.0_compact (архив 69 МБ) при установке докачивает библиотеки с PyPI, ffmpeg с GitHub и модель распознавания с Hugging Face; если эти сайты с вашего компьютера открываются, удобнее взять его. Обновляются оба выпуска одинаково — кнопкой «Настройки → О программе → Проверить обновления».

Лёгкий — v1.0.0_compact, рекомендуется Полный, сжатые веса — v1.0.0_full_int8 Полный, полные веса — v1.0.0_full_fp32
Файл Hagen-v1.0.0-windows.zip, 69 МБ Hagen-v1.0.0-windows-full-int8.zip, 0,7 ГБ Hagen-v1.0.0-windows-full-fp32.zip, 1,3 ГБ
Что докачивается при установке около 0,6 ГБ: библиотеки с PyPI, ffmpeg с GitHub и модель с Hugging Face ничего ничего
Точная модель сжатые веса (полные — кнопкой в Настройках) сжатые веса (полные — в Настройках) полные веса (сжатые — в Настройках)
Кнопка «Проверить обновления» есть есть есть

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Как поставить

  1. Скачайте Hagen-v1.0.0-windows-full-fp32.zip (ниже, в Assets), 1,3 ГБ — готовая программа, всё внутри.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он ничего не скачивает: настраивает пути, спрашивает папку хранилища Obsidian и создаёт ярлык «Hagen».
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Программа сразу работает на полных весах. Им нужно около 0,9 ГБ памяти; если памяти мало, возьмите v1.0.0_full_int8 — сжатые веса в памяти втрое меньше.

Что в архиве

  • точная модель распознавания русской речи GigaAM v3 через onnx-asr, полные веса (890 МБ) — текст слово в слово как у исходной модели;
  • разметка голосов — модель pyannote community-1 на ONNX Runtime, без регистрации и токенов;
  • поиск речи — Silero VAD на ONNX Runtime;
  • Python 3.12, библиотеки (без torch), ffmpeg.

Что нового в v1.0.0

  • Без torch. Поиск речи, обе русские модели распознавания, английская и разметка голосов считаются на onnxruntime. Из выпуска ушли torch и его спутники (около 550 МБ библиотек; sympy остаётся — его требует onnxruntime) и пакет gigaam: библиотек в папке становится 0,3 ГБ вместо 1,0, памяти в простое — примерно на 160 МБ меньше. Модель поиска речи (Silero VAD, 2 МБ) теперь лежит в папке программы и едет с кодом; границы речи те же, что были, — бит в бит. Быстрая модель берётся в готовом ONNX с Hugging Face, как и точная (850 МБ; раньше 440 МБ весов переводились в ONNX на компьютере несколько минут), и считает на 20 % быстрее. Выбор «движок torch» из «Настройки → Модели» убран; у кого он стоял, тот молча переводится на полные веса — текст тот же слово в слово. Файлы прежних версий (веса torch, свой экспорт в ONNX, до 2,5 ГБ) программа больше не читает и предлагает удалить в «Настройки → Модели». Релиз с разметкой через pyannote остаётся отдельной сборкой со своим torch.
  • По умолчанию — точная модель со сжатыми весами. Её ставит установщик и везёт полный архив: 230 МБ вместо 890, в памяти втрое меньше и примерно на 20 % быстрее; слова совпадают с полными весами на 98 %. Если качество стенограмм не устраивает — переключите в «Настройки → Модели» веса на «полные». У кого выбор уже сделан, у того он не меняется.

И всё, что пришло в v0.9.9:

  • Записи с телефона. Новый раздел настроек «С телефона» (включается в «Возможностях»). Две дороги в одни входящие: папки входящих — программа следит за указанными папками и берёт новый звуковой или видеофайл, когда он дописан (чем наполнять папку — LocalSend, Quick Share, «Связь с телефоном», облачный диск, загрузки Telegram Desktop, — программе всё равно; что лежало в папке до её добавления, не берётся; оригинал остаётся на месте); и страница в локальной сети — QR-код в настройках, телефон открывает ссылку в браузере и отправляет файл, приложения не нужно. Страница слушает свой порт, умеет только принять файл и открывается только по ссылке с ключом; «Новый ключ» закрывает старую. Пришедший файл распознаётся и раскладывается по голосам, документ — по кнопке. Новая зависимость segno (QR-код, чистый Python).
  • Сколько стоит документ. Если сервис по ключу сам отдаёт цены в списке моделей (Polza, OpenRouter), цена видна под полем «Модель», примерная стоимость — в окне «Сделать документ», а потраченное — в подписи под готовым документом. Своих таблиц цен в программе нет: не назвал сервис цену — её и не показываем.
  • Todoist снова принимает задачи. Todoist отключил прежний адрес API (ответ 410), и ни список проектов, ни отправка не работали. Программа перешла на новый; токен тот же. Проект в настройках, возможно, придётся выбрать заново: у проектов теперь другие номера.
  • Подпись под документом больше не уходит в задачи. Когда раздел задач стоял в документе последним, строка «Подготовил Hagen…» попадала в поручения — и в Todoist, и в «С прошлого раза осталось».
  • Во время записи готовые записи не теряют вкладок. Пока шла запись, любая открытая запись показывала блок записи вместо вкладок, «+ Документ», «Отправить» и «Править». Теперь у готовой записи всё на месте, а сверху — строка «идёт запись · Стоп». Кнопка у свёрнутых устройств теперь и сворачивает их обратно.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 1,5 ГБ на диске;
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v1.0.0 распознавание речи и поиск речи работают без torch, на onnxruntime; с v0.9 так же работает разметка голосов. На замерах по настоящим совещаниям результат совпал с прежним путём (полные веса — слово в слово, сжатые — около 98 % слов), но в повседневной работе это проверяется только сейчас.

Лицензия

GNU GPL v3.0. Сторонние компоненты и их лицензии — в THIRD-PARTY-NOTICES.md. В архиве лежит сборка FFmpeg под GPL; её исходники — https://www.gyan.dev/ffmpeg/builds/ и https://git.ffmpeg.org/ffmpeg.git.

Hagen v1.0.0 (лёгкий) — без torch, модели скачиваются после установки

Choose a tag to compare

@prankhitevil prankhitevil released this 23 Sep 18:52

Что нового

  • Без torch. Поиск речи, обе русские модели распознавания, английская и разметка голосов считаются на onnxruntime. Из выпуска ушли torch и его спутники (около 550 МБ библиотек; sympy остаётся — его требует onnxruntime) и пакет gigaam: библиотек в папке становится 0,3 ГБ вместо 1,0, памяти в простое — примерно на 160 МБ меньше. Модель поиска речи (Silero VAD, 2 МБ) теперь лежит в папке программы и едет с кодом; границы речи те же, что были, — бит в бит. Быстрая модель берётся в готовом ONNX с Hugging Face, как и точная (850 МБ; раньше 440 МБ весов переводились в ONNX на компьютере несколько минут), и считает на 20 % быстрее. Выбор «движок torch» из «Настройки → Модели» убран; у кого он стоял, тот молча переводится на полные веса — текст тот же слово в слово. Файлы прежних версий (веса torch, свой экспорт в ONNX, до 2,5 ГБ) программа больше не читает и предлагает удалить в «Настройки → Модели». Релиз с разметкой через pyannote остаётся отдельной сборкой со своим torch.
  • По умолчанию — точная модель со сжатыми весами. Её ставит установщик и везёт полный архив: 230 МБ вместо 890, в памяти втрое меньше и примерно на 20 % быстрее; слова совпадают с полными весами на 98 %. Если качество стенограмм не устраивает — переключите в «Настройки → Модели» веса на «полные». У кого выбор уже сделан, у того он не меняется.

И всё, что пришло в v0.9.9:

  • Записи с телефона. Новый раздел настроек «С телефона» (включается в «Возможностях»). Две дороги в одни входящие: папки входящих — программа следит за указанными папками и берёт новый звуковой или видеофайл, когда он дописан (чем наполнять папку — LocalSend, Quick Share, «Связь с телефоном», облачный диск, загрузки Telegram Desktop, — программе всё равно; что лежало в папке до её добавления, не берётся; оригинал остаётся на месте); и страница в локальной сети — QR-код в настройках, телефон открывает ссылку в браузере и отправляет файл, приложения не нужно. Страница слушает свой порт, умеет только принять файл и открывается только по ссылке с ключом; «Новый ключ» закрывает старую. Пришедший файл распознаётся и раскладывается по голосам, документ — по кнопке. Новая зависимость segno (QR-код, чистый Python).
  • Сколько стоит документ. Если сервис по ключу сам отдаёт цены в списке моделей (Polza, OpenRouter), цена видна под полем «Модель», примерная стоимость — в окне «Сделать документ», а потраченное — в подписи под готовым документом. Своих таблиц цен в программе нет: не назвал сервис цену — её и не показываем.
  • Todoist снова принимает задачи. Todoist отключил прежний адрес API (ответ 410), и ни список проектов, ни отправка не работали. Программа перешла на новый; токен тот же. Проект в настройках, возможно, придётся выбрать заново: у проектов теперь другие номера.
  • Подпись под документом больше не уходит в задачи. Когда раздел задач стоял в документе последним, строка «Подготовил Hagen…» попадала в поручения — и в Todoist, и в «С прошлого раза осталось».
  • Во время записи готовые записи не теряют вкладок. Пока шла запись, любая открытая запись показывала блок записи вместо вкладок, «+ Документ», «Отправить» и «Править». Теперь у готовой записи всё на месте, а сверху — строка «идёт запись · Стоп». Кнопка у свёрнутых устройств теперь и сворачивает их обратно.

Как обновиться

  • Стоит v0.9.2 или новее — «Настройки → О программе → Проверить обновления». Выбор моделей у вас сохранится: у кого стоял вариант на torch, тот перейдёт на полные веса — текст тот же слово в слово.
  • Стоит v0.9 или v0.9.1 — поставьте этот выпуск в новую папку и перенесите из старой data\ (записи и база голосов) и settings.json. Дальше версии будут приходить кнопкой.

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Какой выпуск скачать

Лёгкий — v1.0.0_compact, рекомендуется Полный, сжатые веса — v1.0.0_full_int8 Полный, полные веса — v1.0.0_full_fp32
Файл Hagen-v1.0.0-windows.zip, 69 МБ Hagen-v1.0.0-windows-full-int8.zip, 0,7 ГБ Hagen-v1.0.0-windows-full-fp32.zip, 1,3 ГБ
Что докачивается при установке около 0,6 ГБ: библиотеки с PyPI, ffmpeg с GitHub и модель с Hugging Face ничего ничего
Точная модель сжатые веса (полные — кнопкой в Настройках) сжатые веса (полные — в Настройках) полные веса (сжатые — в Настройках)
Кнопка «Проверить обновления» есть есть есть

Как поставить с нуля

  1. Скачайте Hagen-v1.0.0-windows.zip (ниже, в Assets). «Source code» не нужен.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он докачает около 0,6 ГБ: библиотеки (без torch), ffmpeg и точную модель распознавания со сжатыми весами — из их открытых источников (PyPI, GitHub, Hugging Face), без регистрации и токенов. Всё ровно тех версий, на которых выпуск проверен, каждый файл сверяется с контрольной суммой. Прервалось — запустите ещё раз, скачанное не пропадёт.
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Если качество стенограмм не устраивает — переключите в «Настройки → Модели» веса точной модели на «полные» (докачается 890 МБ).

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 1 ГБ на диске;
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v1.0.0 распознавание речи и поиск речи работают без torch, на onnxruntime; с v0.9 так же работает разметка голосов. На замерах по настоящим совещаниям результат совпал с прежним путём (полные веса — слово в слово, сжатые — около 98 % слов), но в повседневной работе это проверяется только сейчас.

Hagen v0.9.9 (лёгкий) — с torch, модели скачиваются после установки

Choose a tag to compare

@prankhitevil prankhitevil released this 23 Sep 18:22

Что нового

  • Записи с телефона. Новый раздел настроек «С телефона» (включается в «Возможностях»). Две дороги в одни входящие: папки входящих — программа следит за указанными папками и берёт новый звуковой или видеофайл, когда он дописан (чем наполнять папку — LocalSend, Quick Share, «Связь с телефоном», облачный диск, загрузки Telegram Desktop, — программе всё равно; что лежало в папке до её добавления, не берётся; оригинал остаётся на месте); и страница в локальной сети — QR-код в настройках, телефон открывает ссылку в браузере и отправляет файл, приложения не нужно. Страница слушает свой порт, умеет только принять файл и открывается только по ссылке с ключом; «Новый ключ» закрывает старую. Пришедший файл распознаётся и раскладывается по голосам, документ — по кнопке. Новая зависимость segno (QR-код, чистый Python).
  • Сколько стоит документ. Если сервис по ключу сам отдаёт цены в списке моделей (Polza, OpenRouter), цена видна под полем «Модель», примерная стоимость — в окне «Сделать документ», а потраченное — в подписи под готовым документом. Своих таблиц цен в программе нет: не назвал сервис цену — её и не показываем.
  • Todoist снова принимает задачи. Todoist отключил прежний адрес API (ответ 410), и ни список проектов, ни отправка не работали. Программа перешла на новый; токен тот же. Проект в настройках, возможно, придётся выбрать заново: у проектов теперь другие номера.
  • Подпись под документом больше не уходит в задачи. Когда раздел задач стоял в документе последним, строка «Подготовил Hagen…» попадала в поручения — и в Todoist, и в «С прошлого раза осталось».
  • Во время записи готовые записи не теряют вкладок. Пока шла запись, любая открытая запись показывала блок записи вместо вкладок, «+ Документ», «Отправить» и «Править». Теперь у готовой записи всё на месте, а сверху — строка «идёт запись · Стоп». Кнопка у свёрнутых устройств теперь и сворачивает их обратно.

Как обновиться

  • Стоит v0.9.2 или новее — «Настройки → О программе → Проверить обновления».
  • Стоит v0.9 или v0.9.1 — поставьте этот выпуск в новую папку и перенесите из старой data\ (записи и база голосов) и settings.json. Дальше версии будут приходить кнопкой.

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Какой выпуск скачать

Лёгкий — этот, рекомендуется Полный — v0.9.4_full
Файл Hagen-v0.9.9-windows.zip, 67 МБ Hagen-v0.9.4-windows-full.zip, 1,6 ГБ (код v0.9.4)
Что докачивается при установке около 1,3 ГБ: библиотеки с PyPI и сайта pytorch, ffmpeg с GitHub и модель с Hugging Face ничего
Кнопка «Проверить обновления» есть есть

Как поставить с нуля

  1. Скачайте Hagen-v0.9.9-windows.zip (ниже, в Assets). «Source code» не нужен.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он докачает около 1,3 ГБ: библиотеки (с torch), ffmpeg и модель распознавания — из их открытых источников (PyPI, сайт pytorch, GitHub, Hugging Face), без регистрации и токенов. Всё ровно тех версий, на которых выпуск проверен, каждый файл сверяется с контрольной суммой. Прервалось — запустите ещё раз, скачанное не пропадёт.
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 2 ГБ на диске (до 6 ГБ со всеми моделями);
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v0.9 разметка голосов работает на ONNX вместо pyannote. На замере по четырём настоящим совещаниям она совпала с pyannote по кадрам на 100 %, но в повседневной работе проверяется только сейчас.

Hagen v0.9.4.1 — Claude CLI не уходит в сеть без VPN

Choose a tag to compare

@prankhitevil prankhitevil released this 23 Sep 08:12

Что нового

  • Claude CLI не уходит в сеть без VPN. Серверы Anthropic отказывают запросам из части стран, а запрос с «не того» адреса всё равно уносил токен аккаунта и текст стенограммы. Теперь перед каждым запуском программа решает, каким путём пойдёт CLI: по умолчанию — только через локальный порт VPN-клиента (Hiddify, Happ, v2rayN, Nekoray); порт не слушает — CLI не запускается, наружу не уходит ни одного пакета. Для туннеля без локального порта — режим «сначала спросить Anthropic» без токена. Настройки — кнопка «Сеть для CLI…» рядом с выбором модели: режимы, порты, «Проверить выход в сеть» (с какого адреса и из какой страны уходят запросы, пускает ли Anthropic) и короткое руководство. Автообновление и телеметрия CLI выключены всегда. На экране «Готов к записи» рядом с «Claude CLI найден» видно, слушает ли порт VPN.
  • Обновление программы надёжнее. Файл с состоянием обновления пишется так же, как настройки и карточки записей: целиком или никак, с повтором, если файл занят антивирусом. Раньше при потере питания он мог остаться пустым.
  • Сочетание диктовки занимается снова после неудачной попытки. Если клавишу не удалось занять (например, она уже у другой программы), прежний слушатель оставался жить с обнулённым состоянием, и после смены настройки сочетание не занималось вовсе.
  • Время в ходе скачивания видео пишется одинаково везде: 00:05:12, а не 0:05:12 у одних источников и 00:05:12 у других.
  • Внутри программа переложена по слоям — логика записи, разметки и «Перечитать точнее» ушла из маршрутов в ядро, четыре окна поверх всех стоят на одном основании, семьдесят копий служебного кода проверок стали одной. Поведение от этого не менялось; см. «Как устроен Hagen», раздел 2.

Как обновиться

  • Стоит v0.9.2 или новее — «Настройки → О программе → Проверить обновления».
  • Стоит v0.9 или v0.9.1 — поставьте этот выпуск в новую папку и перенесите из старой data\ (записи и база голосов) и settings.json. Дальше версии будут приходить кнопкой.

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Какой выпуск скачать

Лёгкий — этот, рекомендуется Полный — v0.9.4_full
Файл Hagen-v0.9.4.1-windows.zip, 67 МБ Hagen-v0.9.4-windows-full.zip, 1,6 ГБ (код v0.9.4)
Что докачивается при установке около 1,3 ГБ: библиотеки с PyPI и сайта pytorch, ffmpeg с GitHub и модель с Hugging Face ничего
Кнопка «Проверить обновления» есть есть

Как поставить с нуля

  1. Скачайте Hagen-v0.9.4.1-windows.zip (ниже, в Assets). «Source code» не нужен.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он докачает около 1,3 ГБ: библиотеки (с torch), ffmpeg и модель распознавания — из их открытых источников (PyPI, сайт pytorch, GitHub, Hugging Face), без регистрации и токенов. Всё ровно тех версий, на которых выпуск проверен, каждый файл сверяется с контрольной суммой. Прервалось — запустите ещё раз, скачанное не пропадёт.
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 2 ГБ на диске (до 6 ГБ со всеми моделями);
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v0.9 разметка голосов работает на ONNX вместо pyannote. На замере по четырём настоящим совещаниям она совпала с pyannote по кадрам на 100 %, но в повседневной работе проверяется только сейчас.

Hagen v0.9.4 (полный) — то же, что v0.9.4, но всё в архиве

Choose a tag to compare

@prankhitevil prankhitevil released this 22 Sep 18:01

Это тот же выпуск, что v0.9.4, только архивом со всем внутри: модель распознавания речи, библиотеки, ffmpeg. При установке ничего не скачивается. Лёгкий v0.9.4 (архив 67 МБ) при установке докачивает библиотеки с PyPI и сайта pytorch, ffmpeg с GitHub и модель распознавания с Hugging Face; если эти сайты с вашего компьютера открываются, удобнее взять его. Обновляются оба выпуска одинаково — кнопкой «Настройки → О программе → Проверить обновления».

Лёгкий — v0.9.4, рекомендуется Полный — этот
Файл Hagen-v0.9.4-windows.zip, 67 МБ Hagen-v0.9.4-windows-full.zip, 1,6 ГБ
Что докачивается при установке около 1,3 ГБ: библиотеки с PyPI и сайта pytorch, ffmpeg с GitHub и модель с Hugging Face ничего
Кнопка «Проверить обновления» есть есть

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Как поставить

  1. Скачайте Hagen-v0.9.4-windows-full.zip (ниже, в Assets), около 1,6 ГБ — готовая программа, всё внутри.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он ничего не скачивает: настраивает пути, спрашивает папку хранилища Obsidian и создаёт ярлык «Hagen».
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Что в архиве

  • точная модель распознавания русской речи GigaAM v3 (через onnx-asr, полные веса);
  • разметка голосов — модель pyannote community-1 на ONNX Runtime, без регистрации и токенов;
  • Python 3.12, библиотеки, ffmpeg.

Что нового в v0.9.4

  • Разметка голосов больше не мешает звонку. Её считает отдельная программа с низким приоритетом, а пока идёт запись — в режиме эффективности Windows. Раньше разметка длинной встречи отбирала процессор у живой записи: текст запаздывал, звук собеседников поднимался с задержкой. Что делать с обработкой во время записи — выбирается в «Настройки → Основное»: помощник, пауза до «Стоп» или как раньше.
  • Полоска разметки движется с первых секунд. Первым делом разметка ищет речь по всей записи — на полуторачасовой встрече это минуты, и раньше всё это время полоска стояла на нуле.
  • Экран записи собран вокруг «Старт» и «Стоп»: таймер после старта, устройства названы по имени, подсказки зависят от состояния, сообщения — в углу. Удаление записи — только в меню «⋯», «Отправить» — кнопкой рядом с «+ Документ», «Сохранить заметку» видна, только когда заметки ещё нет.
  • Настройки разложены заново: закреплённый заголовок раздела, группы, строки «подпись — поле», списки строками, виды документов — в своём окне.
  • Тексты по всей программе: «голоса» вместо «говорящих», «краткое содержание» вместо «саммари», без обращений от первого лица.
  • Снимки экрана. Папки, за которыми следит программа, видны и правятся в «Настройки → Основное». Папка Win+Shift+S находится и тогда, когда «Изображения» перенесены в OneDrive, — раньше такие снимки в заметку не попадали.
  • Имя записи по встрече. Если в календаре две встречи подряд и они наложились, берётся та, что начинается ближе к звонку. Другую можно выбрать кнопкой прямо в уведомлении «Идёт звонок».
  • Запись без звука видна отдельной строкой с кнопкой «Удалить».
  • Видео: поля формы — по выбранному источнику, категория — по типу записи.
  • «+ Документ» больше не выглядит рабочей, пока по записи идёт обработка: кнопка бледная и в подсказке говорит, чем занята запись.
  • Карточка записи не теряется, если Windows не дала переписать файл с первого раза. Из-за этого при остановке звонка терялись последние правки карточки и заметка.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 6 ГБ на диске;
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

С v0.9 разметка голосов работает на ONNX вместо pyannote. На замере по четырём настоящим совещаниям она совпала с pyannote по кадрам на 100 %, но в повседневной работе проверяется только сейчас.

Лицензия

GNU GPL v3.0. Сторонние компоненты и их лицензии — в THIRD-PARTY-NOTICES.md. В архиве лежит сборка FFmpeg под GPL; её исходники — https://www.gyan.dev/ffmpeg/builds/ и https://git.ffmpeg.org/ffmpeg.git.

Hagen v0.9.4 — обработка не мешает звонку, новый вид настроек и экрана записи

Choose a tag to compare

@prankhitevil prankhitevil released this 22 Sep 17:39

Что нового

  • Разметка голосов больше не мешает звонку. Её считает отдельная программа с низким приоритетом, а пока идёт запись — в режиме эффективности Windows. Раньше разметка длинной встречи отбирала процессор у живой записи: текст запаздывал, звук собеседников поднимался с задержкой. Что делать с обработкой во время записи — выбирается в «Настройки → Основное»: помощник, пауза до «Стоп» или как раньше.
  • Полоска разметки движется с первых секунд. Первым делом разметка ищет речь по всей записи — на полуторачасовой встрече это минуты, и раньше всё это время полоска стояла на нуле.
  • Экран записи собран вокруг «Старт» и «Стоп»: таймер после старта, устройства названы по имени, подсказки зависят от состояния, сообщения — в углу. Удаление записи — только в меню «⋯», «Отправить» — кнопкой рядом с «+ Документ», «Сохранить заметку» видна, только когда заметки ещё нет.
  • Настройки разложены заново: закреплённый заголовок раздела, группы, строки «подпись — поле», списки строками, виды документов — в своём окне.
  • Тексты по всей программе: «голоса» вместо «говорящих», «краткое содержание» вместо «саммари», без обращений от первого лица.
  • Снимки экрана. Папки, за которыми следит программа, видны и правятся в «Настройки → Основное». Папка Win+Shift+S находится и тогда, когда «Изображения» перенесены в OneDrive, — раньше такие снимки в заметку не попадали.
  • Имя записи по встрече. Если в календаре две встречи подряд и они наложились, берётся та, что начинается ближе к звонку. Другую можно выбрать кнопкой прямо в уведомлении «Идёт звонок».
  • Запись без звука видна отдельной строкой с кнопкой «Удалить».
  • Видео: поля формы — по выбранному источнику, категория — по типу записи.
  • «+ Документ» больше не выглядит рабочей, пока по записи идёт обработка: кнопка бледная и в подсказке говорит, чем занята запись.
  • Карточка записи не теряется, если Windows не дала переписать файл с первого раза. Из-за этого при остановке звонка терялись последние правки карточки и заметка.

Как обновиться

  • Стоит v0.9.2 или новее — «Настройки → О программе → Проверить обновления».
  • Стоит v0.9 или v0.9.1 — поставьте этот выпуск в новую папку и перенесите из старой data\ (записи и база голосов) и settings.json. Дальше версии будут приходить кнопкой.

Hagen записывает совещания и звонки на Windows, расшифровывает речь, разводит реплики по голосам и делает из стенограммы протокол, краткое содержание или конспект — заметкой в Obsidian. Распознавание речи и разметка голосов идут на вашем компьютере: звук никуда не отправляется.

Какой выпуск скачать

Лёгкий — этот, рекомендуется Полный — v0.9.4_full
Файл Hagen-v0.9.4-windows.zip, 67 МБ Hagen-v0.9.4-windows-full.zip, 1,6 ГБ
Что докачивается при установке около 1,3 ГБ: библиотеки с PyPI и сайта pytorch, ffmpeg с GitHub и модель с Hugging Face ничего
Кнопка «Проверить обновления» есть есть

Как поставить с нуля

  1. Скачайте Hagen-v0.9.4-windows.zip (ниже, в Assets). «Source code» не нужен.
  2. Распакуйте в постоянное место, например C:\Apps\Hagen — не на рабочий стол и не в облачную папку.
  3. Запустите Ustanovka.cmd. Он докачает около 1,3 ГБ: библиотеки (с torch), ffmpeg и модель распознавания — из их открытых источников (PyPI, сайт pytorch, GitHub, Hugging Face), без регистрации и токенов. Всё ровно тех версий, на которых выпуск проверен, каждый файл сверяется с контрольной суммой. Прервалось — запустите ещё раз, скачанное не пропадёт.
  4. Если антивирус спросит — разрешите из папки программы python\python.exe и ffmpeg\bin\ffmpeg.exe, ffprobe.exe.
  5. Запуск — ярлык «Hagen» или Hagen.cmd.

Что нужно

  • Windows 10 или 11;
  • 8 ГБ памяти (16 — комфортно), около 2 ГБ на диске (до 6 ГБ со всеми моделями);
  • микрофон; для записи собеседников — звук, который выводит компьютер;
  • для документов — Claude CLI по подписке Claude или API-ключ любого облачного сервиса / роутера.

Планы

  • Документы локальными языковыми моделями: подключение настраивается в программе. Туда же — Codex CLI и другие агенты с командной строкой.
  • Теги и проекты: доработка, плотнее обмен с Obsidian и Todoist.

Почему «предварительный»

Что менялось от выпуска к выпуску — CHANGELOG.md.

С v0.9 разметка голосов работает на ONNX вместо pyannote. На замере по четырём настоящим совещаниям она совпала с pyannote по кадрам на 100 %, но в повседневной работе проверяется только сейчас.