Releases: satspace-cpu/llamastudio
Release list
Llama Studio v1.3.0
Llama Studio 1.3.0 / Llama Studio 1.3.0
Русская версия
Llama Studio 1.3.0 — автономный менеджер локальных моделей GGUF и серверов llama.cpp для Windows x64.
Главное
- Полностью обновлена главная страница: состояние сервера, активная модель, профиль, версия llama.cpp, обновление приложения и быстрые действия собраны в одном обзоре.
- Добавлена полноценная работа с несколькими GPU: выбор устройств, основной GPU, ручное распределение
tensor-splitи автоматический режим llama.cpp. - Настройки GPU, распределения памяти, KV-кэша и аргументов сохраняются вместе с профилем.
- Выбор версии сервера синхронизирован между главной страницей, разделом «Сервер» и «Релизами llama.cpp».
- Поддержаны CUDA 12, CUDA 13, Vulkan, CPU и другие варианты сборок с учетом доступных устройств и допустимых аргументов.
Мониторинг
- Мониторинг нескольких видеокарт на главной странице, в разделе «Мониторинг», в разделе «Сервер» и в плавающем окне.
- Отображаются VRAM, загрузка GPU, мощность, температура GPU, температура памяти при наличии датчика, частота, вентилятор и Compute Capability.
- Добавлены общие полосы ОЗУ и суммарной мощности всех GPU.
- В плавающем окне доступны вкладки «Все», «GPU0», «GPU1» и карточки отдельных видеокарт.
- Измеритель скорости стал устойчивее: отдельно измеряются скорость промпта и скорость генерации, интерфейс не блокируется во время запроса.
Модели и загрузки
- Поиск моделей Hugging Face, выбор найденного репозитория и получение списка файлов.
- Поддержка GGUF-файлов, разделенных на части, с выбором необходимых файлов.
- Пауза, отмена, возобновление и докачка больших файлов.
- При загрузке отображаются прогресс, скорость, загруженный объем и оставшийся объем.
- После аварийного закрытия или выключения компьютера загрузку можно продолжить.
Профили и стабильность
- Исправлены выбор профиля при запуске, автозапуск выбранной модели, сохранение настроек GPU и очистка профилей удаленных моделей.
- Исправлены ошибки переключения серверных сборок и недопустимых аргументов
--device. - Исправлено зависание интерфейса при измерении скорости и улучшено поведение копирования профилей.
- Чат перенесен в браузерный интерфейс локального
llama-server.
Локализация и распространение
- Поддерживаются русский и английский языки интерфейса.
- В публичный релиз входит только один файл:
LlamaStudio.exe. - Исходники и рабочие материалы хранятся отдельно в приватном репозитории.
Обновление
Встроенный обновлятор проверяет latest.json в публичном репозитории, сравнивает версии, скачивает новый LlamaStudio.exe и заменяет файл после подтверждения и перезапуска приложения.
English version
Llama Studio 1.3.0 is a self-contained Windows x64 manager for local GGUF models and llama.cpp servers.
Highlights
- Redesigned dashboard with server state, active model, profile, llama.cpp version, application update status and quick actions.
- Full multi-GPU workflow: device selection, main GPU, manual
tensor-splitdistribution and llama.cpp automatic mode. - GPU, memory distribution, KV-cache and custom argument settings are persisted with profiles.
- Server selection is synchronized across Dashboard, Server and llama.cpp Releases.
- CUDA 12, CUDA 13, Vulkan, CPU and other backend builds are handled according to available devices and supported arguments.
Monitoring
- Multi-GPU monitoring on Dashboard, Monitoring, Server and the floating monitor window.
- VRAM, GPU load, power, GPU temperature, memory temperature when a sensor is available, clock, fan and Compute Capability metrics.
- Aggregate system RAM and total GPU power bars.
- Floating monitor tabs for All, GPU0 and GPU1 plus individual GPU cards.
- More reliable speed testing with separate prompt and generation rates without blocking the UI.
Models and downloads
- Hugging Face model search, repository selection and file listing.
- GGUF sharded-file support with selection of the required parts.
- Pause, cancel, resume and partial-download continuation for large files.
- Progress, speed, transferred amount and remaining amount are shown while downloading.
- Downloads can continue after an unexpected application or system shutdown.
Profiles and stability
- Fixed startup profile/model selection, GPU setting persistence and cleanup of profiles pointing to deleted models.
- Fixed backend switching and invalid
--devicearguments. - Fixed speed-test UI stalls and improved profile-copy dialog layout.
- Chat is opened through the local
llama-serverbrowser interface.
Localization and distribution
- English and Russian UI localization are supported.
- The public release contains one file only:
LlamaStudio.exe. - Source code and development materials are kept in a separate private repository.
Updates
The built-in updater reads latest.json from the public repository, compares versions, downloads the new LlamaStudio.exe, and replaces it after confirmation and application restart.
Review screenshots / Скриншоты для проверки
The current English screenshots, including the two-GPU monitoring cards and manual distribution controls, are published in the project guide. They are stored in the repository documentation, not as release assets, so the public release remains a single-file distribution.
Актуальные скриншоты английской сборки, включая мониторинг двух GPU и распределение модели, опубликованы в инструкции проекта. В релиз они не добавляются отдельными файлами, чтобы дистрибутив оставался одним LlamaStudio.exe.
v1.2.3
🔥 Llama Studio v1.2.3
🔥 Критические исправления:
• Кнопка «Сделать дефолтным» — полностью переписана логика. Раньше: профили менялись, сервер перезапускался с чужой моделью, UI ломался. Теперь: профиль получает зелёную точку без перезапуска сервера, выделение в ComboBox сохраняется, зелёные точки обновляются мгновенно, кнопка становится неактивной сразу после нажатия
🐛 Исправления версий llama.cpp:
• Папки с произвольными названиями — версии серверов определяются из llama-server.exe --version, а не из названия папки
• BuildType в цветных квадратах — теперь отображается текст (Cuda12x, Cuda13x и т.д.) внутри квадратика
• Версии не исчезают после перезапуска — все версии сохраняются в списке после закрытия приложения
• Старые версии при смене папки — при смене папки llama.cpp старые версии из предыдущей папки больше не отображаются
• Новая версия появляется в списке после установки — после скачивания новой версии она сразу отображается в панели «Установленные версии»
• Сообщение «Серверы не найдены» — пустая папка показывает предупреждение вместо пустого экрана
🛡️ Стабильность:
• Ошибка загрузки DLL — сервер не вылетает с «Entry Point Not Found» при запуске из папок с несовместимыми DLL
• Диалог ошибки DLL — больше не появляется окно Windows «Entry Point Not Found» при сканировании папок
• Ошибки сохранения настроек — теперь логируются вместо молчаливого сбоя
📊 Сравнение версий:
• BuildType учтён при сравнении — b9780 (Cuda12x) не предлагается как «обновление» для b9763 (Cuda13x)
• Статус «Установлено» — проверяется точное совпадение версии и типа сборки
🔥 Llama Studio v1.2.3
🔥 Critical Fixes:
• «Set as Default» button — completely rewritten logic. Previously: profiles changed, server restarted with wrong model, UI broke. Now: profile gets a green dot without server restart, ComboBox selection preserved, green dots update instantly, button disabled immediately after click
🐛 Version Management Fixes:
• Arbitrary folder names — server versions now read from llama-server.exe --version, not from folder names
• BuildType text in colored squares — now shows text (Cuda12x, Cuda13x etc.) inside the square
• Versions no longer disappear on restart — all versions persist in the list after closing the app
• Stale versions after folder change — switching llama.cpp folder no longer shows versions from previous folder
• New version appears after install — newly installed versions immediately show in «Installed versions» panel
• «No servers found» message — empty folder shows a warning instead of blank screen
🛡️ Stability:
• DLL loading error — server no longer crashes with «Entry Point Not Found» from folders with incompatible DLLs
• DLL error dialog suppressed — Windows «Entry Point Not Found» dialog no longer appears during folder scanning
• Settings save errors — now logged instead of failing silently
📊 Version Comparison:
• BuildType-aware comparison — b9780 (Cuda12x) no longer offered as «update» for b9763 (Cuda13x)
• «Installed» status — now checks exact version AND build type match
📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.3/LlamaStudio.exe
v1.2.2
🔥 Llama Studio v1.2.2
✨ Новое:
• Автозапуск сервера — переключатель в Настройках для автоматического запуска сервера при старте приложения
🐛 Исправления:
• Трей — переключение профиля из системного трея теперь корректно перезапускает сервер даже при свёрнутом приложении
• Трей — переключение профиля из системного трея корректно обновляет UI на главной странице
🔥 Llama Studio v1.2.2
✨ New:
• Auto-start server — toggle in Settings to automatically start the server on application launch
🐛 Fixes:
• Tray menu — profile switching now correctly restarts the server even when the app is minimized to tray
• Tray menu — profile switching now correctly updates the dashboard UI
📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.2/LlamaStudio.exe
v1.2.1
🔥 Llama Studio v1.2.1
✨ Новое:
• Модели на карточке — основная модель и mmproj теперь видны на главной
• Автоперезапуск сервера при смене профиля с информационным окном по центру
🔧 Улучшения:
• Убран дублирующий блок профилей, оставлен компактный
• Зелёная точка дефолтного профиля на странице Сервер
• Окно перезапуска по центру экрана
🐛 Исправления:
• Кнопка «Сделать дефолтным» работает на всех страницах
• Убрано зацикливание при смене профиля
• Исправлена двойная отметка дефолтного профиля
🔥 Llama Studio v1.2.1
✨ New:
• Models on card — main model and mmproj now visible on the dashboard
• Auto server restart on profile switch with centered info dialog
🔧 Improvements:
• Removed duplicate profile block, kept compact version
• Green dot indicator for default profile on Server page
• Restart dialog centered on screen
🐛 Fixes:
• Set as Default button works on all pages
• Fixed profile switch infinite loop
• Fixed double default profile indicator
📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.1/LlamaStudio.exe
v1.2.0
Новое:
📊 Измерение скорости генерации — кнопка «Измерить скорость» в секции сервер и «Проверить скорость» в окне мониторинга. Замеряет скорость обработки промпта и генерации токенов в реальном времени через streaming API. Результаты отображаются в больших цифрах «Ответ» и «Промпт».
🔧 Серверы llama.cpp через профиль:
• Папка с серверами и выбранный сервер привязаны к профилю
• Автоматический скан при выборе папки
• Установка релизов строго в папку профиля
• Смена профиля → подгрузка правильного сервера
📦 Скачивание релизов:
• Кнопка «Отменить» во время скачивания
• Убрано автопереключение версии — релиз появляется в списке, переключение только по кнопке «Использовать»
Исправления:
• Карточки установленных версий — аккуратное выравнивание
• Подсказки на вкладке «KV Кэш» возвращены
• Убраны дублирующиеся пути из «Настроек»
• Страница «Обсуждение и поддержка» — текст и кнопки отображаются корректно
• Кнопка «Проверить обновления» — теперь отображается на языке интерфейса (RU/EN)
v1.1.9
🔒 Исправления безопасности:
• Утечка данных в логах — удалено логирование сообщений из чата
• Code Execution — экранирование метасимволов при создании .bat файлов обновления и экспорта командной строки
• Авто-настройка MCP — удалено автоматическое добавление MCP серверов при запуске
• Race condition в TrayManager — добавлена блокировка при доступе к общему ресурсу
• Memory leak — исправлена утечка памяти в системном трее
🐛 Исправления багов:
• Пользовательский путь к llama.cpp — теперь синхронизируется между страницами Настройки и Сервер
• Смена версии — больше не перезаписывает пользовательский путь к llama.cpp
• Пользовательские аргументы — теперь надёжно сохраняются в профиль и не исчезают после перезапуска
v1.1.8
Llama Studio v1.1.8
Новое и улучшения:
- Полностью переработана и оптимизирована секция «Сервер».
- Интерактивный выбор CLI-аргументов: парсятся все доступные параметры сервера, можно вручную выбрать нужные, изменить значения и сохранить в профиль.
- Импорт пользовательских .bat-файлов: параметры автоматически подтягиваются в интерфейс, отсутствующие в основном UI выносятся в кастомные аргументы.
- Экспорт настроек в автономный .bat-файл: создаётся готовый скрипт для запуска сервера напрямую, без приложения.
Исправления:
- Исправлена работа MTP (Multi-Token Prediction): корректно применяется параметр --spec-type draft-mtp.
- Устранён хардкод текста в интерфейсе: все строки теперь корректно локализуются на EN/RU.
- Улучшена логика определения значений по умолчанию для CLI-аргументов (приоритет отдаётся выводу llama-server.exe --help).
v1.1.7 — Подробные подсказки для всех параметров сервера
--spec-type draft-mtp не применяется при запуске сервера. При выборе любого типа спекуляции флаг не передаётся в командную строку. Исправление готовится в версии 1.1.8.
🆕 Новое:
- Иконки ? рядом с каждым параметром на странице настроек сервера
- При наведении мыши появляется подробное описание в формате мини-гайда:
- Что делает параметр
- Какие значения доступны и что они означают
- Когда включать/отключать
- Рекомендуемые значения для продуктивной работы
📋 Покрыты все вкладки:
- GPU: Слои на GPU, Потоки, Flash Attention, Mmap, Mlock, MMQ, KV Offload, Multi-GPU
- Контекст: Размер контекста, Batch Size, Ubatch Size, Max Tokens
- Сэмплинг: Температура, Top P/K/Min/P, Repeat Penalty, Seed, Mirostat
- KV Cache: Тип кэша K/V, Cache RAM, Cache Reuse
- Спекулятивное декодирование: Spec Type, Draft параметры
- Rope/YARN: Масштабирование и все параметры YARN
- Сервер: Host, Port, Timeout, Slots, NUMA, Cache Prompt, Cont Batching, Context Shift, Verbose Logging, WebUI, Metrics, Reasoning, Embedding Mode
v1.1.6
Исправления
- Полная переработка вкладки «Сервер» — параметры разложены по смысловым вкладкам с подсказками и значениями по умолчанию
- Добавлена поддержка multi-GPU: распределение тензоров (--tensor-split) и выбор основного GPU (-mg)
- Исправлены невалидные флаги --batch/--ubatch → --batch-size/--ubatch-size (краш на b9594+)
- Исправлен --spec-type: работает без черновой модели для MTP
- Добавлены флаги --cache-ram и --cache-reuse в строку запуска
- Параметры, равные дефолтам llama.cpp, больше не пишутся в строку запуска
- Удалены дублирующие блоки HuggingFace и быстрого сканирования из вкладки «Сервер»
v1.1.5
Исправления:
- Галочка в меню трея теперь показывает активный профиль, а не профиль по умолчанию
- Выбор профиля из трея синхронизируется с приложением
- Добавлена пауза между остановкой и запуском сервера при смене профиля из трея
- Порт из профиля теперь имеет приоритет над DefaultPort — при смене порта во вкладке «Подключение» он корректно сохраняется и применяется при запуске сервера
- Чат теперь использует порт из активного профиля вместо DefaultPort — работает на любом порту