Skip to content

Releases: satspace-cpu/llamastudio

Llama Studio v1.3.0

Choose a tag to compare

@satspace-cpu satspace-cpu released this 27 Jul 10:03

Llama Studio 1.3.0 / Llama Studio 1.3.0

Русская версия

Llama Studio 1.3.0 — автономный менеджер локальных моделей GGUF и серверов llama.cpp для Windows x64.

Главное

  • Полностью обновлена главная страница: состояние сервера, активная модель, профиль, версия llama.cpp, обновление приложения и быстрые действия собраны в одном обзоре.
  • Добавлена полноценная работа с несколькими GPU: выбор устройств, основной GPU, ручное распределение tensor-split и автоматический режим llama.cpp.
  • Настройки GPU, распределения памяти, KV-кэша и аргументов сохраняются вместе с профилем.
  • Выбор версии сервера синхронизирован между главной страницей, разделом «Сервер» и «Релизами llama.cpp».
  • Поддержаны CUDA 12, CUDA 13, Vulkan, CPU и другие варианты сборок с учетом доступных устройств и допустимых аргументов.

Мониторинг

  • Мониторинг нескольких видеокарт на главной странице, в разделе «Мониторинг», в разделе «Сервер» и в плавающем окне.
  • Отображаются VRAM, загрузка GPU, мощность, температура GPU, температура памяти при наличии датчика, частота, вентилятор и Compute Capability.
  • Добавлены общие полосы ОЗУ и суммарной мощности всех GPU.
  • В плавающем окне доступны вкладки «Все», «GPU0», «GPU1» и карточки отдельных видеокарт.
  • Измеритель скорости стал устойчивее: отдельно измеряются скорость промпта и скорость генерации, интерфейс не блокируется во время запроса.

Модели и загрузки

  • Поиск моделей Hugging Face, выбор найденного репозитория и получение списка файлов.
  • Поддержка GGUF-файлов, разделенных на части, с выбором необходимых файлов.
  • Пауза, отмена, возобновление и докачка больших файлов.
  • При загрузке отображаются прогресс, скорость, загруженный объем и оставшийся объем.
  • После аварийного закрытия или выключения компьютера загрузку можно продолжить.

Профили и стабильность

  • Исправлены выбор профиля при запуске, автозапуск выбранной модели, сохранение настроек GPU и очистка профилей удаленных моделей.
  • Исправлены ошибки переключения серверных сборок и недопустимых аргументов --device.
  • Исправлено зависание интерфейса при измерении скорости и улучшено поведение копирования профилей.
  • Чат перенесен в браузерный интерфейс локального llama-server.

Локализация и распространение

  • Поддерживаются русский и английский языки интерфейса.
  • В публичный релиз входит только один файл: LlamaStudio.exe.
  • Исходники и рабочие материалы хранятся отдельно в приватном репозитории.

Обновление

Встроенный обновлятор проверяет latest.json в публичном репозитории, сравнивает версии, скачивает новый LlamaStudio.exe и заменяет файл после подтверждения и перезапуска приложения.

English version

Llama Studio 1.3.0 is a self-contained Windows x64 manager for local GGUF models and llama.cpp servers.

Highlights

  • Redesigned dashboard with server state, active model, profile, llama.cpp version, application update status and quick actions.
  • Full multi-GPU workflow: device selection, main GPU, manual tensor-split distribution and llama.cpp automatic mode.
  • GPU, memory distribution, KV-cache and custom argument settings are persisted with profiles.
  • Server selection is synchronized across Dashboard, Server and llama.cpp Releases.
  • CUDA 12, CUDA 13, Vulkan, CPU and other backend builds are handled according to available devices and supported arguments.

Monitoring

  • Multi-GPU monitoring on Dashboard, Monitoring, Server and the floating monitor window.
  • VRAM, GPU load, power, GPU temperature, memory temperature when a sensor is available, clock, fan and Compute Capability metrics.
  • Aggregate system RAM and total GPU power bars.
  • Floating monitor tabs for All, GPU0 and GPU1 plus individual GPU cards.
  • More reliable speed testing with separate prompt and generation rates without blocking the UI.

Models and downloads

  • Hugging Face model search, repository selection and file listing.
  • GGUF sharded-file support with selection of the required parts.
  • Pause, cancel, resume and partial-download continuation for large files.
  • Progress, speed, transferred amount and remaining amount are shown while downloading.
  • Downloads can continue after an unexpected application or system shutdown.

Profiles and stability

  • Fixed startup profile/model selection, GPU setting persistence and cleanup of profiles pointing to deleted models.
  • Fixed backend switching and invalid --device arguments.
  • Fixed speed-test UI stalls and improved profile-copy dialog layout.
  • Chat is opened through the local llama-server browser interface.

Localization and distribution

  • English and Russian UI localization are supported.
  • The public release contains one file only: LlamaStudio.exe.
  • Source code and development materials are kept in a separate private repository.

Updates

The built-in updater reads latest.json from the public repository, compares versions, downloads the new LlamaStudio.exe, and replaces it after confirmation and application restart.

Review screenshots / Скриншоты для проверки

The current English screenshots, including the two-GPU monitoring cards and manual distribution controls, are published in the project guide. They are stored in the repository documentation, not as release assets, so the public release remains a single-file distribution.

Актуальные скриншоты английской сборки, включая мониторинг двух GPU и распределение модели, опубликованы в инструкции проекта. В релиз они не добавляются отдельными файлами, чтобы дистрибутив оставался одним LlamaStudio.exe.

v1.2.3

Choose a tag to compare

@satspace-cpu satspace-cpu released this 24 Jun 17:41

🔥 Llama Studio v1.2.3

🔥 Критические исправления:
• Кнопка «Сделать дефолтным» — полностью переписана логика. Раньше: профили менялись, сервер перезапускался с чужой моделью, UI ломался. Теперь: профиль получает зелёную точку без перезапуска сервера, выделение в ComboBox сохраняется, зелёные точки обновляются мгновенно, кнопка становится неактивной сразу после нажатия

🐛 Исправления версий llama.cpp:
• Папки с произвольными названиями — версии серверов определяются из llama-server.exe --version, а не из названия папки
• BuildType в цветных квадратах — теперь отображается текст (Cuda12x, Cuda13x и т.д.) внутри квадратика
• Версии не исчезают после перезапуска — все версии сохраняются в списке после закрытия приложения
• Старые версии при смене папки — при смене папки llama.cpp старые версии из предыдущей папки больше не отображаются
• Новая версия появляется в списке после установки — после скачивания новой версии она сразу отображается в панели «Установленные версии»
• Сообщение «Серверы не найдены» — пустая папка показывает предупреждение вместо пустого экрана

🛡️ Стабильность:
• Ошибка загрузки DLL — сервер не вылетает с «Entry Point Not Found» при запуске из папок с несовместимыми DLL
• Диалог ошибки DLL — больше не появляется окно Windows «Entry Point Not Found» при сканировании папок
• Ошибки сохранения настроек — теперь логируются вместо молчаливого сбоя

📊 Сравнение версий:
• BuildType учтён при сравнении — b9780 (Cuda12x) не предлагается как «обновление» для b9763 (Cuda13x)
• Статус «Установлено» — проверяется точное совпадение версии и типа сборки


🔥 Llama Studio v1.2.3

🔥 Critical Fixes:
• «Set as Default» button — completely rewritten logic. Previously: profiles changed, server restarted with wrong model, UI broke. Now: profile gets a green dot without server restart, ComboBox selection preserved, green dots update instantly, button disabled immediately after click

🐛 Version Management Fixes:
• Arbitrary folder names — server versions now read from llama-server.exe --version, not from folder names
• BuildType text in colored squares — now shows text (Cuda12x, Cuda13x etc.) inside the square
• Versions no longer disappear on restart — all versions persist in the list after closing the app
• Stale versions after folder change — switching llama.cpp folder no longer shows versions from previous folder
• New version appears after install — newly installed versions immediately show in «Installed versions» panel
• «No servers found» message — empty folder shows a warning instead of blank screen

🛡️ Stability:
• DLL loading error — server no longer crashes with «Entry Point Not Found» from folders with incompatible DLLs
• DLL error dialog suppressed — Windows «Entry Point Not Found» dialog no longer appears during folder scanning
• Settings save errors — now logged instead of failing silently

📊 Version Comparison:
• BuildType-aware comparison — b9780 (Cuda12x) no longer offered as «update» for b9763 (Cuda13x)
• «Installed» status — now checks exact version AND build type match

📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.3/LlamaStudio.exe

v1.2.2

Choose a tag to compare

@satspace-cpu satspace-cpu released this 23 Jun 08:07

🔥 Llama Studio v1.2.2

✨ Новое:
• Автозапуск сервера — переключатель в Настройках для автоматического запуска сервера при старте приложения

🐛 Исправления:
• Трей — переключение профиля из системного трея теперь корректно перезапускает сервер даже при свёрнутом приложении
• Трей — переключение профиля из системного трея корректно обновляет UI на главной странице


🔥 Llama Studio v1.2.2

✨ New:
• Auto-start server — toggle in Settings to automatically start the server on application launch

🐛 Fixes:
• Tray menu — profile switching now correctly restarts the server even when the app is minimized to tray
• Tray menu — profile switching now correctly updates the dashboard UI

📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.2/LlamaStudio.exe

v1.2.1

Choose a tag to compare

@satspace-cpu satspace-cpu released this 18 Jun 12:11

🔥 Llama Studio v1.2.1

✨ Новое:
• Модели на карточке — основная модель и mmproj теперь видны на главной
• Автоперезапуск сервера при смене профиля с информационным окном по центру

🔧 Улучшения:
• Убран дублирующий блок профилей, оставлен компактный
• Зелёная точка дефолтного профиля на странице Сервер
• Окно перезапуска по центру экрана

🐛 Исправления:
• Кнопка «Сделать дефолтным» работает на всех страницах
• Убрано зацикливание при смене профиля
• Исправлена двойная отметка дефолтного профиля


🔥 Llama Studio v1.2.1

✨ New:
• Models on card — main model and mmproj now visible on the dashboard
• Auto server restart on profile switch with centered info dialog

🔧 Improvements:
• Removed duplicate profile block, kept compact version
• Green dot indicator for default profile on Server page
• Restart dialog centered on screen

🐛 Fixes:
• Set as Default button works on all pages
• Fixed profile switch infinite loop
• Fixed double default profile indicator

📥 Download: https://github.com/satspace-cpu/llamastudio/releases/download/v1.2.1/LlamaStudio.exe

v1.2.0

Choose a tag to compare

@satspace-cpu satspace-cpu released this 16 Jun 13:49

Новое:
📊 Измерение скорости генерации — кнопка «Измерить скорость» в секции сервер и «Проверить скорость» в окне мониторинга. Замеряет скорость обработки промпта и генерации токенов в реальном времени через streaming API. Результаты отображаются в больших цифрах «Ответ» и «Промпт».

🔧 Серверы llama.cpp через профиль:
• Папка с серверами и выбранный сервер привязаны к профилю
• Автоматический скан при выборе папки
• Установка релизов строго в папку профиля
• Смена профиля → подгрузка правильного сервера

📦 Скачивание релизов:
• Кнопка «Отменить» во время скачивания
• Убрано автопереключение версии — релиз появляется в списке, переключение только по кнопке «Использовать»

Исправления:
• Карточки установленных версий — аккуратное выравнивание
• Подсказки на вкладке «KV Кэш» возвращены
• Убраны дублирующиеся пути из «Настроек»
• Страница «Обсуждение и поддержка» — текст и кнопки отображаются корректно
• Кнопка «Проверить обновления» — теперь отображается на языке интерфейса (RU/EN)

v1.1.9

Choose a tag to compare

@satspace-cpu satspace-cpu released this 15 Jun 17:22

🔒 Исправления безопасности:
• Утечка данных в логах — удалено логирование сообщений из чата
• Code Execution — экранирование метасимволов при создании .bat файлов обновления и экспорта командной строки
• Авто-настройка MCP — удалено автоматическое добавление MCP серверов при запуске
• Race condition в TrayManager — добавлена блокировка при доступе к общему ресурсу
• Memory leak — исправлена утечка памяти в системном трее

🐛 Исправления багов:
• Пользовательский путь к llama.cpp — теперь синхронизируется между страницами Настройки и Сервер
• Смена версии — больше не перезаписывает пользовательский путь к llama.cpp
• Пользовательские аргументы — теперь надёжно сохраняются в профиль и не исчезают после перезапуска

v1.1.8

Choose a tag to compare

@satspace-cpu satspace-cpu released this 15 Jun 10:41

Llama Studio v1.1.8

Новое и улучшения:

  • Полностью переработана и оптимизирована секция «Сервер».
  • Интерактивный выбор CLI-аргументов: парсятся все доступные параметры сервера, можно вручную выбрать нужные, изменить значения и сохранить в профиль.
  • Импорт пользовательских .bat-файлов: параметры автоматически подтягиваются в интерфейс, отсутствующие в основном UI выносятся в кастомные аргументы.
  • Экспорт настроек в автономный .bat-файл: создаётся готовый скрипт для запуска сервера напрямую, без приложения.

Исправления:

  • Исправлена работа MTP (Multi-Token Prediction): корректно применяется параметр --spec-type draft-mtp.
  • Устранён хардкод текста в интерфейсе: все строки теперь корректно локализуются на EN/RU.
  • Улучшена логика определения значений по умолчанию для CLI-аргументов (приоритет отдаётся выводу llama-server.exe --help).

v1.1.7 — Подробные подсказки для всех параметров сервера

Choose a tag to compare

@satspace-cpu satspace-cpu released this 12 Jun 08:23

⚠️ Известная проблема: Вкладка MTP / Много-токенное предсказание — параметр --spec-type draft-mtp не применяется при запуске сервера. При выборе любого типа спекуляции флаг не передаётся в командную строку. Исправление готовится в версии 1.1.8.


🆕 Новое:

  • Иконки ? рядом с каждым параметром на странице настроек сервера
  • При наведении мыши появляется подробное описание в формате мини-гайда:
    • Что делает параметр
    • Какие значения доступны и что они означают
    • Когда включать/отключать
    • Рекомендуемые значения для продуктивной работы

📋 Покрыты все вкладки:

  • GPU: Слои на GPU, Потоки, Flash Attention, Mmap, Mlock, MMQ, KV Offload, Multi-GPU
  • Контекст: Размер контекста, Batch Size, Ubatch Size, Max Tokens
  • Сэмплинг: Температура, Top P/K/Min/P, Repeat Penalty, Seed, Mirostat
  • KV Cache: Тип кэша K/V, Cache RAM, Cache Reuse
  • Спекулятивное декодирование: Spec Type, Draft параметры
  • Rope/YARN: Масштабирование и все параметры YARN
  • Сервер: Host, Port, Timeout, Slots, NUMA, Cache Prompt, Cont Batching, Context Shift, Verbose Logging, WebUI, Metrics, Reasoning, Embedding Mode

⚠️ Важно: Для параметров Verbose Logging и Embedding Mode добавлены красные предупреждения ❌ — эти параметры могут сломать ответы сервера.

v1.1.6

Choose a tag to compare

@satspace-cpu satspace-cpu released this 11 Jun 21:15

Исправления

  • Полная переработка вкладки «Сервер» — параметры разложены по смысловым вкладкам с подсказками и значениями по умолчанию
  • Добавлена поддержка multi-GPU: распределение тензоров (--tensor-split) и выбор основного GPU (-mg)
  • Исправлены невалидные флаги --batch/--ubatch → --batch-size/--ubatch-size (краш на b9594+)
  • Исправлен --spec-type: работает без черновой модели для MTP
  • Добавлены флаги --cache-ram и --cache-reuse в строку запуска
  • Параметры, равные дефолтам llama.cpp, больше не пишутся в строку запуска
  • Удалены дублирующие блоки HuggingFace и быстрого сканирования из вкладки «Сервер»

v1.1.5

Choose a tag to compare

@satspace-cpu satspace-cpu released this 11 Jun 15:13

Исправления:

  • Галочка в меню трея теперь показывает активный профиль, а не профиль по умолчанию
  • Выбор профиля из трея синхронизируется с приложением
  • Добавлена пауза между остановкой и запуском сервера при смене профиля из трея
  • Порт из профиля теперь имеет приоритет над DefaultPort — при смене порта во вкладке «Подключение» он корректно сохраняется и применяется при запуске сервера
  • Чат теперь использует порт из активного профиля вместо DefaultPort — работает на любом порту