Ich stelle selbst gehostete LLM, RAG, Ollama, VLLM und AI-Agenten auf VPS oder GPU-Server bereit
AIOps und Linux DevOps Engineer
Level 1
Hat bestimmte Leistungskriterien erfüllt und zeigt großes Potenzial auf dem Marktplatz.
Über diesen Service
671 Fünf-Sterne-Bewertungen · 600+ Aufträge · 13+ Jahre in der Produktionsinfrastruktur
Ich setze Open-Source-LLMs und KI-Systeme auf deinen eigenen Servern ein, damit du nicht mehr pro Token zahlst und deine Daten intern bleiben.
Was ich einsetze
- Ollama, vLLM, llama.cpp, OpenWebUI
- Llama, Mistral, Qwen, DeepSeek, Gemma
- RAG mit Qdrant, Chroma, Weaviate, pgvector
- KI-Agenten über n8n, LangChain, LlamaIndex
Wo ich es einsetze
- Dein VPS: Hetzner, DigitalOcean, Contabo, OVH
- GPU-Server und Bare Metal: A100, L40S, RTX 4090
- AWS, GCP, Azure, RunPod
- Vor Ort und air-gapped Setups
Wie es funktioniert
- Du schickst mir deine Server-Spezifikationen und das gewünschte Modell
- Ich bestätige, was deine Hardware realistisch leisten kann
- Ich setze es ein, optimiere und dokumentiere es
Was du bekommst
- Deployment mit Docker oder systemd, reproduzierbar
- Nginx Reverse Proxy mit SSL und API-Authentifizierung
- GPU- und VRAM-Optimierung, damit das Modell schnell läuft
- Monitoring, Logging und automatischer Neustart bei Fehlern
- Ausführliche Übergabedokumentation
Erfahrung
- Nobelpreis-Organisation, Starbucks, T-Mobile, Beasley Media
- Plattformen mit 45.000 gleichzeitigen Nutzern bei 40 Gbps
Schreib mir vor der Bestellung, und ich sage dir ehrlich, ob deine Hardware das schafft.
Tools:
Kubernetes
•
Docker
•
Amazon EKS
•
Google Kubernetes Engine
Frameworks:
Terraform
•
Ansible
•
Puppe
Programmiersprache:
Bash
•
Python
Expertise:
Installation
•
Migration
•
Debuggen
Mein Portfolio
FAQ
Automatische Übersetzung
Welche Hardware brauche ich, um ein LLM zu betreiben?
Das hängt vom Modell ab. Ein 7B- oder 8B-Modell in quantisierter Form läuft auf einer 16GB-GPU oder sogar nur mit CPU und genug RAM. Ein 70B-Modell benötigt 48GB+ VRAM oder mehrere GPUs. Schick mir deine Server-Spezifikationen, bevor du bestellst, und ich sage dir genau, was gut darauf läuft.
Kann ich das auf meinem bestehenden VPS deployen, oder brauche ich einen GPU-Server?
Beides ist möglich. Kleinere Modelle und RAG-Setups laufen gut auf einem normalen CPU-VPS. Wenn du größere Modelle oder schnelle Reaktionszeiten brauchst, helfe ich dir bei der Auswahl eines GPU-Hosts wie RunPod, Hetzner oder Lambda, oder deploye auf Hardware, die du bereits besitzt.
Bleiben meine Daten privat?
Ja. Alles läuft auf deiner eigenen Infrastruktur. Keine Prompts, Dokumente oder Embeddings verlassen deinen Server, was der Hauptgrund ist, warum die meisten Kunden auf gehostete APIs verzichten. Air-gapped und On-Premise-Setups werden unterstützt.
2 Bewertungen für diesen Service
| (2) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Zusammensetzung der Bewertung
- Kommunikation
- Qualität der Lieferung
- Preis-Leistungs-Verhältnis der Lieferung
Sortieren nach:
L lara_chad2

Großbritannien
Excellent service! The deployment was completed quickly and professionally. The seller understood the issue, handled the Dockerized Python AI application deployment smoothly, and kept me updated throughout the process. Everything is working as expected. Highly recommended!
50 $
Preis
1 Tag
Dauer
Hilfreich?D drezin

Vereinigte Staaten
Laufende ZusammenarbeitShazeb was great in understanding the problem and working to fix It. would recommend.
100 $-200 $
Preis
2 Tagen
Dauer
Hilfreich?
2 Bewertungen für diesen Service
| (2) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Zusammensetzung der Bewertung
- Kommunikation
- Qualität der Lieferung
- Preis-Leistungs-Verhältnis der Lieferung
Sortieren nach:
L lara_chad2

Großbritannien
Excellent service! The deployment was completed quickly and professionally. The seller understood the issue, handled the Dockerized Python AI application deployment smoothly, and kept me updated throughout the process. Everything is working as expected. Highly recommended!
50 $
Preis
1 Tag
Dauer
Hilfreich?D drezin

Vereinigte Staaten
Laufende ZusammenarbeitShazeb was great in understanding the problem and working to fix It. would recommend.
100 $-200 $
Preis
2 Tagen
Dauer
Hilfreich?
