Ich werde private selbst gehostete KI auf deinem Server mit Ollama und Open WebUI bereitstellen


Über diesen Service
Automatische Übersetzung
Dein Team möchte eine ChatGPT-ähnliche KI. Deine Compliance-Richtlinie besagt, dass Kundendaten dein Kontrollbereich nicht verlassen dürfen. Dieses Gig löst beides.
Ich installiere einen privaten KI-Stack – Ollama + Open WebUI – auf deinem Server oder VPS. Eingaben, Chatverlauf und Dokumente berühren niemals eine Cloud eines Drittanbieters. Entwickelt für rechtliche, medizinische und jede Art von Unternehmen mit einer No-Cloud-AI-Policy.
Jede Stufe beinhaltet:
- Produktions-Docker-Deployment mit HTTPS-Reverse-Proxy
- 2-3 offene Modelle, die auf deine Hardware abgestimmt sind
- Geschriebene Admin-Anleitung: Updates, Backups, Nutzerverwaltung
- Du besitzt alles: Konfigurationen, Code, Admin-Zugangsdaten
- Direkte Kommunikation aus den USA
Standard umfasst RAG – deine KI antwortet anhand deiner eigenen Dokumente – plus Tailscale sichere Fernzugriffe für dein Team. Premium fügt eine OpenAI-kompatible API-Endpunkt für deine andere Software, Nutzerkonten, einen Übergabegespräch und 14 Tage Support hinzu.
Über mich: B.Sc. Elektrotechnik, zehn Jahre in der Halbleiterindustrie. Ich betreibe diesen Stack 24/7 in Produktion auf Infrastruktur, die ich selbst aufgebaut und gewartet habe – selbst gehostete LLMs, Docker-Dienste, VPN-Mesh-Netzwerke, SIEM-Logging.
Ich bin nicht der günstigste Anbieter hier. Ich bin derjenige, der die Arbeit dokumentiert und dir die Schlüssel übergibt.
Lerne Michael B kennen
AI Automation Engineer, Private LLMs, Alerting, Network Security
- AusVereinigte Staaten
- Mitglied seitJan. 2026
- ⌀ Antwortzeit1 Stunde
Sprachen
Englisch
Automatische Übersetzung
Meine weiteren Dienstleistungen im Bereich KI-Entwicklung
FAQ
Automatische Übersetzung
Warum solltest du uns während der Einrichtung mit Admin-Zugang vertrauen?
Ich kann über Bildschirmfreigabe arbeiten, sodass du jeden Schritt beobachten kannst. Du stellst temporäre Zugangsdaten aus und rotierst alles bei der Übergabe; die Dokumentation zeigt genau, was wo läuft. Alle Software ist Open Source und telefoniert nicht nach Hause. Auf Wunsch NDA – und ich kann dir meine eigene Live-Instanz vor der Bestellung vorführen.
Gibt es laufende API- oder Lizenzkosten nach der Lieferung?
Nein. Ollama, Open WebUI und LiteLLM sind Open Source, und die Modelle laufen auf deiner eigenen Hardware. Es gibt keine Token-Gebühren und keine Abonnements – deine einzigen wiederkehrenden Kosten sind der Server selbst (Strom oder VPS-Miete).
Was muss ich bereitstellen?
Ein Linux-Server oder VPS (ich kann einen empfehlen, der zu deinem Budget passt), eine Möglichkeit, mir Zugang zu gewähren (SSH-Schlüssel oder temporäre Zugangsdaten) und einen Domainnamen, wenn du HTTPS auf einer öffentlichen Adresse möchtest. Für Standard/Premium RAG die Dokumente, die die KI kennen soll.
Welche Hardware braucht das?
Open WebUI läuft fast überall; die Geschwindigkeit der Modelle hängt von RAM und GPU ab. Ein moderner CPU mit 16 GB RAM bewältigt kleine Modelle gut; eine GPU macht größere Modelle schnell. Schick mir deine Spezifikationen (oder Budget), bevor du bestellst, und ich sage dir ehrlich, welche Leistung du erwarten kannst.
Was passiert nach der Lieferung?
Jede Stufe kommt mit einer schriftlichen Admin-Anleitung, die Updates, Backups und Nutzerverwaltung abdeckt. Premium beinhaltet einen Live-Übergabegespräch und 14 Tage Support. Laufende Wartung oder spätere Upgrades – neue Modelle, mehr Nutzer, API-Integrationen – sind als individuelle Angebote erhältlich.
Wird es so gut wie ChatGPT sein?
Für Entwürfe, Zusammenfassungen und Q&A über deine eigenen Dokumente leisten aktuelle offene Modelle (Llama, Qwen, Mistral) hervorragende Arbeit. Frontier-Cloud-Modelle sind bei komplexem Schlussfolgerungsvermögen noch stärker – der Kompromiss, den du eingehst, ist vollständige Datenprivatsphäre. Ich stimme die Modelle ehrlich auf deinen Anwendungsfall ab.
