Ich richte Claude Code KI-Agenten auf deinem VPS mit Docker ein
Senior DevOps- und Netzwerksicherheitsingenieur sowie Linux-Experte
Über diesen Service
Ich betreibe seit Jahren Produktions-Linux-Server. Das Einrichten von KI-Agenten ist nicht nur "docker run", sondern es geht darum, sie über Neustarts hinweg am Leben zu erhalten, Abstürze zu bewältigen, sicher zu bleiben und deine GPU-Rechnung nicht zum Schmelzen zu bringen.
Was du bekommst:
Dockerisierte Agenten Claude Code, OpenHands, AutoGen oder dein eigener Python/TypeScript-Agent, Multi-Stage-Build, non-root, Gesundheitschecks
Systemd-Service Startet beim Boot, startet bei Absturz neu, Ressourcenlimits (CPU/RAM/GPU), Logrotation via journald
Nginx Reverse Proxy TLS (Let's Encrypt automatisch erneuern), WebSocket-Unterstützung für Streaming, Ratenbegrenzung, Basic-Auth-Option
Redis-Warteschlange Job-Warteschlange mit Priorität, Retry/Backoff, Dead-Letter-Handling (Standard/Premium)
Beobachtbarkeit Loki + Promtail für Logs, Prometheus-Metriken (Warteschlangentiefe, Latenz, Token-Nutzung), Grafana-Dashboard
Vector DB Qdrant/Weaviate für RAG-Agenten, persistent Volume, Backup-Cron (Premium)
Kostenüberwachung Tägliche Ausgabenwarnung (Discord/Slack/E-Mail), automatisches Herunterfahren bei Budgetüberschreitung (Premium)
Runbook Architektur, Skalierungsleitfaden, "Agent hängt?"-Fehlerbehebung, Credential-Rotation-Verfahren
Stack, mit dem ich täglich arbeite: Docker, Nginx, systemd, Redis, Loki/Prometheus/Grafana, Qdrant, NVIDIA Container Toolkit, RunPod/Vast.ai/Lambda APIs, Linux
Mein Portfolio
Meine weiteren Dienstleistungen im Bereich DevOps-Engineering
FAQ
Automatische Übersetzung
Welche Agenten unterstützt du?
Claude Code, OpenHands, AutoGen, CrewAI, LangGraph, eigene Python/Node-Agenten. Jeder containerisierbare Agent funktioniert. Schreib mir mit deinem Repo — ich bestätige die Kompatibilität.
Wie gehst du mit API-Schlüsseln / Secrets um?
Nie in Image oder Compose. Optionen: 1) HashiCorp Vault, 2) 1Password CLI, 3) SOPS/age verschlüsselte Dateien, 4) Docker Secrets (Swarm), 5) GitHub Environments (CI/CD). Wir wählen, was zu deinem Workflow passt.
Kannst du GPU-Kosten optimieren?
Nur Premium: Tägliche Ausgabenwarnungen (Slack/Discord/E-Mail), Idle-Agenten automatisch herunterfahren, Spot-Instance-Fallback (RunPod/Vast.ai), Token-Nutzung pro Agent verfolgen. Typische Einsparungen: 40-60% im Vergleich zu Dauerbetrieb.

