services: backend: build: context: . dockerfile: backend/Dockerfile args: APP_VERSION: ${APP_VERSION:-0.1.0} APP_BUILD_INFO: ${APP_BUILD_INFO:-dev} environment: AUTH_ENABLED: ${AUTH_ENABLED:-true} OIDC_ISSUER_URL: ${OIDC_ISSUER_URL:?set OIDC_ISSUER_URL} OIDC_AUDIENCE: ${OIDC_AUDIENCE:?set OIDC_AUDIENCE} OIDC_JWKS_URL: ${OIDC_JWKS_URL:-} OIDC_CLOCK_SKEW_SECONDS: ${OIDC_CLOCK_SKEW_SECONDS:-30} LOG_LEVEL: ${LOG_LEVEL:-INFO} LOG_FORMAT: ${LOG_FORMAT:-text} PROMETHEUS_ENABLED: "true" SMTP_HOST: ${SMTP_HOST:-} SMTP_PORT: ${SMTP_PORT:-587} SMTP_USERNAME: ${SMTP_USERNAME:-} SMTP_PASSWORD: ${SMTP_PASSWORD:-} SMTP_FROM_ADDRESS: ${SMTP_FROM_ADDRESS:-} SMTP_FROM_NAME: ${SMTP_FROM_NAME:-Manage} SMTP_USE_TLS: ${SMTP_USE_TLS:-true} SMTP_USE_SSL: ${SMTP_USE_SSL:-false} SMTP_TIMEOUT: ${SMTP_TIMEOUT:-30} SSH_KNOWN_HOSTS_PATH: /app/backend/.cache/known_hosts PROMETHEUS_FILE_SD_DIR: ${PROMETHEUS_FILE_SD_DIR:-/app/backend/.cache/prometheus-file-sd} ALERTMANAGER_URL: ${ALERTMANAGER_URL:-http://alertmanager:9093} ALERTMANAGER_WEBHOOK_URL: ${ALERTMANAGER_WEBHOOK_URL:-} volumes: - ${BACKEND_CACHE_DIR:-./backend-cache}:/app/backend/.cache restart: unless-stopped networks: - web - monitoring expose: - "8000" labels: - "traefik.enable=true" - "traefik.http.routers.${BACKEND_APP_NAME:-manage-backend}.rule=Host(`${BACKEND_APP_HOST:?set BACKEND_APP_HOST}`)" - "traefik.http.routers.${BACKEND_APP_NAME:-manage-backend}.entrypoints=websecure" - "traefik.http.routers.${BACKEND_APP_NAME:-manage-backend}.tls.certresolver=${CERT_RESOLVER:?set CERT_RESOLVER}" - "traefik.http.services.${BACKEND_APP_NAME:-manage-backend}.loadbalancer.server.port=${BACKEND_APP_PORT:-8000}" healthcheck: test: [ "CMD", "python", "-c", "import json, urllib.request; print(json.load(urllib.request.urlopen('http://127.0.0.1:8000/api/health'))['status'])", ] interval: 30s timeout: 5s retries: 3 start_period: 20s frontend: build: context: . dockerfile: frontend/Dockerfile target: prod args: VITE_API_URL: ${VITE_API_URL:-/api} VITE_OIDC_ENABLED: ${VITE_OIDC_ENABLED:-true} VITE_OIDC_ISSUER: ${VITE_OIDC_ISSUER:?set VITE_OIDC_ISSUER} VITE_OIDC_CLIENT_ID: ${VITE_OIDC_CLIENT_ID:?set VITE_OIDC_CLIENT_ID} VITE_OIDC_SCOPE: ${VITE_OIDC_SCOPE:-openid profile email} VITE_OIDC_REDIRECT_URI: ${VITE_OIDC_REDIRECT_URI:?set VITE_OIDC_REDIRECT_URI} VITE_OIDC_POST_LOGOUT_REDIRECT_URI: ${VITE_OIDC_POST_LOGOUT_REDIRECT_URI:?set VITE_OIDC_POST_LOGOUT_REDIRECT_URI} VITE_DEV_API_PROXY_TARGET: ${VITE_DEV_API_PROXY_TARGET:-http://backend:8000} VITE_GRAFANA_URL: ${VITE_GRAFANA_URL:-https://grafana.example.com} VITE_APP_VERSION: ${APP_VERSION:-0.1.0} VITE_APP_BUILD_INFO: ${APP_BUILD_INFO:-dev} depends_on: backend: condition: service_healthy networks: - web labels: - "traefik.enable=true" - "traefik.http.routers.${FRONTEND_APP_NAME:-manage-frontend}.rule=Host(`${FRONTEND_APP_HOST:?set FRONTEND_APP_HOST}`)" - "traefik.http.routers.${FRONTEND_APP_NAME:-manage-frontend}.entrypoints=websecure" - "traefik.http.routers.${FRONTEND_APP_NAME:-manage-frontend}.tls.certresolver=${CERT_RESOLVER:?set CERT_RESOLVER}" - "traefik.http.services.${FRONTEND_APP_NAME:-manage-frontend}.loadbalancer.server.port=${FRONTEND_APP_PORT:-80}" ports: - "8080:80" restart: unless-stopped prometheus: image: prom/prometheus:v2.55.1 container_name: prometheus command: - "--config.file=/etc/prometheus/prometheus.yml" - "--storage.tsdb.path=/prometheus" - "--storage.tsdb.retention.time=30d" - "--web.console.libraries=/usr/share/prometheus/console_libraries" - "--web.console.templates=/usr/share/prometheus/consoles" - "--web.enable-lifecycle" volumes: - ./monitoring/prometheus/prometheus.yml:/etc/prometheus/prometheus.yml:ro - ./monitoring/prometheus/rules:/etc/prometheus/rules:ro - ${BACKEND_CACHE_DIR:-./backend-cache}/prometheus-file-sd:/etc/prometheus/file-sd:ro - prometheus_data:/prometheus expose: - "9090" networks: - web - monitoring restart: unless-stopped healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:9090/-/healthy"] interval: 30s timeout: 5s retries: 3 start_period: 30s deploy: resources: limits: cpus: "1.00" memory: 1G reservations: cpus: "0.25" memory: 256M loki: image: grafana/loki:3.1.1 container_name: loki command: -config.file=/etc/loki/loki.yml volumes: - ./monitoring/loki/loki.yml:/etc/loki/loki.yml:ro - loki_data:/loki expose: - "3100" networks: - monitoring restart: unless-stopped healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:3100/ready"] interval: 30s timeout: 5s retries: 3 start_period: 30s deploy: resources: limits: cpus: "1.00" memory: 1G reservations: cpus: "0.25" memory: 256M alloy: image: grafana/alloy:v1.5.0 container_name: alloy command: - run - /etc/alloy/config.alloy - --storage.path=/var/lib/alloy volumes: - ./monitoring/alloy/config.alloy:/etc/alloy/config.alloy:ro - /var/run/docker.sock:/var/run/docker.sock:ro - /var/lib/docker/containers:/var/lib/docker/containers:ro networks: - monitoring depends_on: loki: condition: service_healthy restart: unless-stopped user: root healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:12345/-/healthy"] interval: 30s timeout: 5s retries: 3 start_period: 30s deploy: resources: limits: cpus: "0.50" memory: 512M reservations: cpus: "0.10" memory: 128M grafana: image: grafana/grafana:11.3.1 container_name: grafana environment: GF_SECURITY_ADMIN_USER: ${GRAFANA_ADMIN_USER:-admin} GF_SECURITY_ADMIN_PASSWORD: ${GRAFANA_ADMIN_PASSWORD:-admin} GF_AUTH_GENERIC_OAUTH_CLIENT_ID: ${GF_AUTH_GENERIC_OAUTH_CLIENT_ID:-} GF_AUTH_GENERIC_OAUTH_CLIENT_SECRET: ${GF_AUTH_GENERIC_OAUTH_CLIENT_SECRET:-} GF_AUTH_GENERIC_OAUTH_AUTH_URL: ${GF_AUTH_GENERIC_OAUTH_AUTH_URL:-} GF_AUTH_GENERIC_OAUTH_TOKEN_URL: ${GF_AUTH_GENERIC_OAUTH_TOKEN_URL:-} GF_AUTH_GENERIC_OAUTH_API_URL: ${GF_AUTH_GENERIC_OAUTH_API_URL:-} LOG_LEVEL: ${LOG_LEVEL:-INFO} volumes: - ./monitoring/grafana/grafana.ini:/etc/grafana/grafana.ini:ro - ./monitoring/grafana/provisioning:/etc/grafana/provisioning:ro - grafana_data:/var/lib/grafana expose: - "3000" networks: - web - monitoring depends_on: prometheus: condition: service_healthy loki: condition: service_healthy restart: unless-stopped healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:3000/api/health"] interval: 30s timeout: 5s retries: 3 start_period: 30s labels: - "traefik.enable=true" - "traefik.http.routers.${GRAFANA_APP_NAME:-grafana}.rule=Host(`${GRAFANA_APP_HOST:?set GRAFANA_APP_HOST}`)" - "traefik.http.routers.${GRAFANA_APP_NAME:-grafana}.entrypoints=websecure" - "traefik.http.routers.${GRAFANA_APP_NAME:-grafana}.tls.certresolver=${CERT_RESOLVER:?set CERT_RESOLVER}" - "traefik.http.services.${GRAFANA_APP_NAME:-grafana}.loadbalancer.server.port=${GRAFANA_APP_PORT:-3000}" deploy: resources: limits: cpus: "1.00" memory: 512M reservations: cpus: "0.25" memory: 128M alertmanager: image: prom/alertmanager:v0.27.0 container_name: alertmanager command: - "--config.file=/etc/alertmanager/alertmanager.yml" - "--storage.path=/alertmanager" environment: SMTP_HOST: ${SMTP_HOST:-smtp.example.com} SMTP_PORT: ${SMTP_PORT:-587} SMTP_USERNAME: ${SMTP_USERNAME:-} SMTP_PASSWORD: ${SMTP_PASSWORD:-} SMTP_FROM_ADDRESS: ${SMTP_FROM_ADDRESS:-no-reply@example.com} ALERT_EMAIL_TO: ${ALERT_EMAIL_TO:-admin@example.com} volumes: - ./monitoring/alertmanager/alertmanager.yml:/etc/alertmanager/alertmanager.yml:ro - alertmanager_data:/alertmanager expose: - "9093" networks: - monitoring restart: unless-stopped healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:9093/-/healthy"] interval: 30s timeout: 5s retries: 3 start_period: 30s deploy: resources: limits: cpus: "0.50" memory: 256M reservations: cpus: "0.10" memory: 64M node-exporter: image: prom/node-exporter:v1.8.2 container_name: node-exporter command: - "--path.rootfs=/host" volumes: - /:/host:ro,rslave networks: - monitoring restart: unless-stopped healthcheck: test: ["CMD", "wget", "-qO-", "http://127.0.0.1:9100/"] interval: 30s timeout: 5s retries: 3 start_period: 10s deploy: resources: limits: cpus: "0.25" memory: 128M reservations: cpus: "0.05" memory: 32M networks: web: external: true monitoring: volumes: prometheus_data: loki_data: grafana_data: alertmanager_data: