Deploy Ollama-based GenAI LLMs (AI stack)

First published: Wednesday, May 28, 2025 | Last updated: Wednesday, May 28, 2025

Deploy Ollama-based GenAI LLMs (AI stack) using the SloopStash Docker kit.


Previous: Deploy MongoDB replica cluster (Data Lake stack)

Next: Deploy ELK stack (Observability stack)

Deploy and manage AI stack (Ollama-based GenAI LLMs) environments

The Linux machine must have at least 4 GB of RAM for better performance while running these Ollama-based GenAI LLMs.

Docker

# Switch to SloopStash Docker kit directory.
$ cd /opt/kickstart-docker

# Provision OCI containers using Docker compose.
$ docker compose -f compose/ai/ollama.yml --env-file compose/${ENVIRONMENT^^}.env -p sloopstash-${ENVIRONMENT}-ai-s1 up -d

# Stop OCI containers using Docker compose.
$ docker compose -f compose/ai/ollama.yml --env-file compose/${ENVIRONMENT^^}.env -p sloopstash-${ENVIRONMENT}-ai-s1 down

# Restart OCI containers using Docker compose.
$ docker compose -f compose/ai/ollama.yml --env-file compose/${ENVIRONMENT^^}.env -p sloopstash-${ENVIRONMENT}-ai-s1 restart

Ollama

Run DeepSeek

# Access Bash shell of OCI container (Ollama - DeepSeek).
$ docker container exec -ti sloopstash-${ENVIRONMENT}-ai-s1-ollama-deep-seek-1 /bin/bash

# Pull DeepSeek GenAI LLM from Ollama registry.
$ ollama pull deepseek-r1:1.5b

# Run DeepSeek GenAI LLM using Ollama.
$ ollama run deepseek-r1:1.5b

# Exit shell.
$ exit

Run DeepSeek coder

# Access Bash shell of OCI container (Ollama - DeepSeek coder).
$ docker container exec -ti sloopstash-${ENVIRONMENT}-ai-s1-ollama-deep-seek-coder-1 /bin/bash

# Pull DeepSeek coder GenAI LLM from Ollama registry.
$ ollama pull deepseek-coder:1.3b

# Run DeepSeek coder GenAI LLM using Ollama.
$ ollama run deepseek-coder:1.3b

# Exit shell.
$ exit

Run Gemma

# Access Bash shell of OCI container (Ollama - Gemma).
$ docker container exec -ti sloopstash-${ENVIRONMENT}-ai-s1-ollama-gemma-1 /bin/bash

# Pull Gemma GenAI LLM from Ollama registry.
$ ollama pull gemma2:2b

# Run Gemma GenAI LLM using Ollama.
$ ollama run gemma2:2b

# Exit shell.
$ exit

Run Llama

# Access Bash shell of OCI container (Ollama - Llama).
$ docker container exec -ti sloopstash-${ENVIRONMENT}-ai-s1-ollama-llama-1 /bin/bash

# Pull Llama GenAI LLM from Ollama registry.
$ ollama pull llama3.2:3b

# Run Llama GenAI LLM using Ollama.
$ ollama run llama3.2:3b

# Exit shell.
$ exit

Run Qwen coder

# Access Bash shell of OCI container (Ollama - Qwen coder).
$ docker container exec -ti sloopstash-${ENVIRONMENT}-ai-s1-ollama-qwen-coder-1 /bin/bash

# Pull Qwen coder GenAI LLM from Ollama registry.
$ ollama pull qwen2.5-coder:3b

# Run Qwen coder GenAI LLM using Ollama.
$ ollama run qwen2.5-coder:3b

# Exit shell.
$ exit

Previous: Deploy MongoDB replica cluster (Data Lake stack)

Next: Deploy ELK stack (Observability stack)