Skip to content

v0.4.1

Choose a tag to compare

@slrelease slrelease released this 28 May 15:08
· 170 commits to main since this release

Added Qwen3.6-27B model support and updated the Linux GPU dependency stack to CUDA 12.9. Generation requests are now dispatched separately from shared inference queues.