Skip to content

Llama Studio v1.3.0

Choose a tag to compare

@satspace-cpu satspace-cpu released this 27 Jul 10:03

Llama Studio 1.3.0 / Llama Studio 1.3.0

Русская версия

Llama Studio 1.3.0 — автономный менеджер локальных моделей GGUF и серверов llama.cpp для Windows x64.

Главное

  • Полностью обновлена главная страница: состояние сервера, активная модель, профиль, версия llama.cpp, обновление приложения и быстрые действия собраны в одном обзоре.
  • Добавлена полноценная работа с несколькими GPU: выбор устройств, основной GPU, ручное распределение tensor-split и автоматический режим llama.cpp.
  • Настройки GPU, распределения памяти, KV-кэша и аргументов сохраняются вместе с профилем.
  • Выбор версии сервера синхронизирован между главной страницей, разделом «Сервер» и «Релизами llama.cpp».
  • Поддержаны CUDA 12, CUDA 13, Vulkan, CPU и другие варианты сборок с учетом доступных устройств и допустимых аргументов.

Мониторинг

  • Мониторинг нескольких видеокарт на главной странице, в разделе «Мониторинг», в разделе «Сервер» и в плавающем окне.
  • Отображаются VRAM, загрузка GPU, мощность, температура GPU, температура памяти при наличии датчика, частота, вентилятор и Compute Capability.
  • Добавлены общие полосы ОЗУ и суммарной мощности всех GPU.
  • В плавающем окне доступны вкладки «Все», «GPU0», «GPU1» и карточки отдельных видеокарт.
  • Измеритель скорости стал устойчивее: отдельно измеряются скорость промпта и скорость генерации, интерфейс не блокируется во время запроса.

Модели и загрузки

  • Поиск моделей Hugging Face, выбор найденного репозитория и получение списка файлов.
  • Поддержка GGUF-файлов, разделенных на части, с выбором необходимых файлов.
  • Пауза, отмена, возобновление и докачка больших файлов.
  • При загрузке отображаются прогресс, скорость, загруженный объем и оставшийся объем.
  • После аварийного закрытия или выключения компьютера загрузку можно продолжить.

Профили и стабильность

  • Исправлены выбор профиля при запуске, автозапуск выбранной модели, сохранение настроек GPU и очистка профилей удаленных моделей.
  • Исправлены ошибки переключения серверных сборок и недопустимых аргументов --device.
  • Исправлено зависание интерфейса при измерении скорости и улучшено поведение копирования профилей.
  • Чат перенесен в браузерный интерфейс локального llama-server.

Локализация и распространение

  • Поддерживаются русский и английский языки интерфейса.
  • В публичный релиз входит только один файл: LlamaStudio.exe.
  • Исходники и рабочие материалы хранятся отдельно в приватном репозитории.

Обновление

Встроенный обновлятор проверяет latest.json в публичном репозитории, сравнивает версии, скачивает новый LlamaStudio.exe и заменяет файл после подтверждения и перезапуска приложения.

English version

Llama Studio 1.3.0 is a self-contained Windows x64 manager for local GGUF models and llama.cpp servers.

Highlights

  • Redesigned dashboard with server state, active model, profile, llama.cpp version, application update status and quick actions.
  • Full multi-GPU workflow: device selection, main GPU, manual tensor-split distribution and llama.cpp automatic mode.
  • GPU, memory distribution, KV-cache and custom argument settings are persisted with profiles.
  • Server selection is synchronized across Dashboard, Server and llama.cpp Releases.
  • CUDA 12, CUDA 13, Vulkan, CPU and other backend builds are handled according to available devices and supported arguments.

Monitoring

  • Multi-GPU monitoring on Dashboard, Monitoring, Server and the floating monitor window.
  • VRAM, GPU load, power, GPU temperature, memory temperature when a sensor is available, clock, fan and Compute Capability metrics.
  • Aggregate system RAM and total GPU power bars.
  • Floating monitor tabs for All, GPU0 and GPU1 plus individual GPU cards.
  • More reliable speed testing with separate prompt and generation rates without blocking the UI.

Models and downloads

  • Hugging Face model search, repository selection and file listing.
  • GGUF sharded-file support with selection of the required parts.
  • Pause, cancel, resume and partial-download continuation for large files.
  • Progress, speed, transferred amount and remaining amount are shown while downloading.
  • Downloads can continue after an unexpected application or system shutdown.

Profiles and stability

  • Fixed startup profile/model selection, GPU setting persistence and cleanup of profiles pointing to deleted models.
  • Fixed backend switching and invalid --device arguments.
  • Fixed speed-test UI stalls and improved profile-copy dialog layout.
  • Chat is opened through the local llama-server browser interface.

Localization and distribution

  • English and Russian UI localization are supported.
  • The public release contains one file only: LlamaStudio.exe.
  • Source code and development materials are kept in a separate private repository.

Updates

The built-in updater reads latest.json from the public repository, compares versions, downloads the new LlamaStudio.exe, and replaces it after confirmation and application restart.

Review screenshots / Скриншоты для проверки

The current English screenshots, including the two-GPU monitoring cards and manual distribution controls, are published in the project guide. They are stored in the repository documentation, not as release assets, so the public release remains a single-file distribution.

Актуальные скриншоты английской сборки, включая мониторинг двух GPU и распределение модели, опубликованы в инструкции проекта. В релиз они не добавляются отдельными файлами, чтобы дистрибутив оставался одним LlamaStudio.exe.