Llama Studio v1.3.0
Llama Studio 1.3.0 / Llama Studio 1.3.0
Русская версия
Llama Studio 1.3.0 — автономный менеджер локальных моделей GGUF и серверов llama.cpp для Windows x64.
Главное
- Полностью обновлена главная страница: состояние сервера, активная модель, профиль, версия llama.cpp, обновление приложения и быстрые действия собраны в одном обзоре.
- Добавлена полноценная работа с несколькими GPU: выбор устройств, основной GPU, ручное распределение
tensor-splitи автоматический режим llama.cpp. - Настройки GPU, распределения памяти, KV-кэша и аргументов сохраняются вместе с профилем.
- Выбор версии сервера синхронизирован между главной страницей, разделом «Сервер» и «Релизами llama.cpp».
- Поддержаны CUDA 12, CUDA 13, Vulkan, CPU и другие варианты сборок с учетом доступных устройств и допустимых аргументов.
Мониторинг
- Мониторинг нескольких видеокарт на главной странице, в разделе «Мониторинг», в разделе «Сервер» и в плавающем окне.
- Отображаются VRAM, загрузка GPU, мощность, температура GPU, температура памяти при наличии датчика, частота, вентилятор и Compute Capability.
- Добавлены общие полосы ОЗУ и суммарной мощности всех GPU.
- В плавающем окне доступны вкладки «Все», «GPU0», «GPU1» и карточки отдельных видеокарт.
- Измеритель скорости стал устойчивее: отдельно измеряются скорость промпта и скорость генерации, интерфейс не блокируется во время запроса.
Модели и загрузки
- Поиск моделей Hugging Face, выбор найденного репозитория и получение списка файлов.
- Поддержка GGUF-файлов, разделенных на части, с выбором необходимых файлов.
- Пауза, отмена, возобновление и докачка больших файлов.
- При загрузке отображаются прогресс, скорость, загруженный объем и оставшийся объем.
- После аварийного закрытия или выключения компьютера загрузку можно продолжить.
Профили и стабильность
- Исправлены выбор профиля при запуске, автозапуск выбранной модели, сохранение настроек GPU и очистка профилей удаленных моделей.
- Исправлены ошибки переключения серверных сборок и недопустимых аргументов
--device. - Исправлено зависание интерфейса при измерении скорости и улучшено поведение копирования профилей.
- Чат перенесен в браузерный интерфейс локального
llama-server.
Локализация и распространение
- Поддерживаются русский и английский языки интерфейса.
- В публичный релиз входит только один файл:
LlamaStudio.exe. - Исходники и рабочие материалы хранятся отдельно в приватном репозитории.
Обновление
Встроенный обновлятор проверяет latest.json в публичном репозитории, сравнивает версии, скачивает новый LlamaStudio.exe и заменяет файл после подтверждения и перезапуска приложения.
English version
Llama Studio 1.3.0 is a self-contained Windows x64 manager for local GGUF models and llama.cpp servers.
Highlights
- Redesigned dashboard with server state, active model, profile, llama.cpp version, application update status and quick actions.
- Full multi-GPU workflow: device selection, main GPU, manual
tensor-splitdistribution and llama.cpp automatic mode. - GPU, memory distribution, KV-cache and custom argument settings are persisted with profiles.
- Server selection is synchronized across Dashboard, Server and llama.cpp Releases.
- CUDA 12, CUDA 13, Vulkan, CPU and other backend builds are handled according to available devices and supported arguments.
Monitoring
- Multi-GPU monitoring on Dashboard, Monitoring, Server and the floating monitor window.
- VRAM, GPU load, power, GPU temperature, memory temperature when a sensor is available, clock, fan and Compute Capability metrics.
- Aggregate system RAM and total GPU power bars.
- Floating monitor tabs for All, GPU0 and GPU1 plus individual GPU cards.
- More reliable speed testing with separate prompt and generation rates without blocking the UI.
Models and downloads
- Hugging Face model search, repository selection and file listing.
- GGUF sharded-file support with selection of the required parts.
- Pause, cancel, resume and partial-download continuation for large files.
- Progress, speed, transferred amount and remaining amount are shown while downloading.
- Downloads can continue after an unexpected application or system shutdown.
Profiles and stability
- Fixed startup profile/model selection, GPU setting persistence and cleanup of profiles pointing to deleted models.
- Fixed backend switching and invalid
--devicearguments. - Fixed speed-test UI stalls and improved profile-copy dialog layout.
- Chat is opened through the local
llama-serverbrowser interface.
Localization and distribution
- English and Russian UI localization are supported.
- The public release contains one file only:
LlamaStudio.exe. - Source code and development materials are kept in a separate private repository.
Updates
The built-in updater reads latest.json from the public repository, compares versions, downloads the new LlamaStudio.exe, and replaces it after confirmation and application restart.
Review screenshots / Скриншоты для проверки
The current English screenshots, including the two-GPU monitoring cards and manual distribution controls, are published in the project guide. They are stored in the repository documentation, not as release assets, so the public release remains a single-file distribution.
Актуальные скриншоты английской сборки, включая мониторинг двух GPU и распределение модели, опубликованы в инструкции проекта. В релиз они не добавляются отдельными файлами, чтобы дистрибутив оставался одним LlamaStudio.exe.