Docker setup for running Ollama with Vulkan acceleration on Intel Arc GPUs (tested on Arc A770).
- ✅ Latest Ollama with Vulkan support
- ✅ Full Intel Arc GPU acceleration
- ✅ Optional Open WebUI interface
- ✅ Easy configuration via environment variables
- ✅ Portainer compatible
- Clone this repository:
git clone https://github.com/lexiismadd/ollama-vulkan-arc.git
cd ollama-vulkan-arc
- Copy and configure environment:
cp .env.example .env
# Edit .env with your preferences- Build and start:
docker compose build
docker compose up -d- Test:
docker exec ollama-vulkan-arc ollama pull llama3.2
docker exec ollama-vulkan-arc ollama run llama3.2See Portainer Setup below.
Edit .env file to customize:
OLLAMA_VERSION- Ollama version to buildOLLAMA_NUM_GPU- GPU layer offloading (999 = all layers)OLLAMA_NUM_CTX- Context window sizeMEMORY_LIMIT- Maximum RAM usageENABLE_WEBUI- Enable/disable Open WebUI
- In Portainer, go to Stacks → Add stack
- Choose Git Repository
- Enter your repository URL:
https://github.com/lexiismadd/ollama-vulkan-arc - Set Compose path:
docker-compose.yml - Add environment variables or upload your
.envfile - Click Deploy the stack
See detailed Portainer instructions.
# Install tools
sudo apt install intel-gpu-tools
# Monitor GPU
sudo intel_gpu_top- Edit
.envand updateOLLAMA_VERSION - Rebuild:
docker compose down
docker compose build --no-cache
docker compose up -dSee TROUBLESHOOTING.md for common issues and solutions.
- Intel Arc GPU (A770, A750, A380, etc.)
- Intel GPU drivers installed
- Docker or Podman
- Docker Compose
Expected tokens/s on Arc A770 16GB:
- Small models (3-8B): 50-100+ tokens/s
- Medium models (13-20B): 20-40 tokens/s
- Large models (30-70B): 5-15 tokens/s
Feel free to open issues or submit pull requests!
MIT License - feel free to use and modify.
- Ollama
- Intel IPEX-LLM
- Vulkan support contributors