Ich richte eine private lokale LLM auf deiner eigenen Maschine mit Ollama ein


Über diesen Service
Automatische Übersetzung
Deine Daten bleiben auf deiner Hardware. Das ist der ganze Punkt.
Ich installiere und konfiguriere einen lokalen LLM-Stack auf deinem Rechner oder Server, inklusive Ollama und einer Web-UI, die du tatsächlich nutzen kannst. Modelle werden passend für den RAM und die GPU ausgewählt, die du besitzt, nicht für eine Benchmark-Tabelle. Keine API-Schlüssel, keine monatliche Rechnung, keine Prompts verlassen dein Netzwerk.
Wo das meistens relevant wird: bei einem Anwalt, der Klientendateien nicht in einen Cloud-Chat kopieren kann. Bei einer Klinik mit Patientennotizen. Bei einem Laden mit eigenen Preislisten. Bei jedem, der ein Cloud-Modell ausprobiert, die Bedingungen liest und dann aufhört.
Was du bekommst:
- Ollama installiert und als Dienst laufend, damit es auch nach einem Neustart funktioniert
- Open WebUI auf einem normalen Chat-Fenster in deinem Browser, kein Terminal im Alltag nötig
- Modelle passend für deine tatsächliche Hardware ausgewählt und geladen, mit kurzer Erklärung, wofür jedes gut ist
- Eine einseitige Anleitung: wie man es startet, wie man ein Modell hinzufügt, was zu tun ist, wenn es stoppt
Funktioniert auf Linux, Windows oder einem VPS. Ich betreibe seit 1999 Linux-Server und hoste meine eigenen Projekte selbst, deshalb ist das die Konfiguration, die ich selbst nutze.
Nicht enthalten: Feinabstimmung oder Training deines eigenen Modells, Hardware-Kauf für dich, RAG über dein Dokumentenarchiv, Verbindung zu deinem CRM oder deiner Webseite. Sag mir einfach, wenn du das möchtest, und ich helfe weiter.
Lerne Lamas Toma kennen
IT Pro since 1999, Linux, Cybersecurity, Telegram Bots, n8n
- AusIsrael
- Mitglied seitMai 2026
- Letzte Lieferung2 Monate
Sprachen
Russisch, Hebräisch, Englisch
Automatische Übersetzung
Mein Portfolio
Meine weiteren Dienstleistungen im Bereich KI-Entwicklung
FAQ
Automatische Übersetzung
Welche AI-Apps funktionieren damit?
Alles, was MCP spricht – Claude Desktop, Claude Code, Cursor und mehr.
Hostest du es?
Ich deploye auf deinen Server oder gebe dir den Code zum Ausführen. Cloud- oder Hosting-Kosten gehen auf dich.
Kannst du mein Tool verbinden?
Schick die Dokumente. Wenn eine API oder Datenbank vorhanden ist, ist die Antwort fast immer ja.
Wie reden wir?
Alles im Chat, nach deinem Zeitplan. Du behältst den ganzen Thread als Aufzeichnung.
Was brauchst du von mir, um anzufangen?
Die Dokumente oder das Schema für alles, was du verbinden willst, plus welcher MCP-Client genutzt wird. Das reicht meistens, um loszulegen.
Läuft das auf meinem Computer?
Sag mir die RAM-Größe und ob du eine GPU hast, dann sage ich ehrlich, welches Modell passt. 16 GB laufen ein kleines Modell problemlos. Keine GPU ist machbar, aber langsamer.
Wird irgendetwas ins Internet gesendet?
Nur der einmalige Modell-Download. Danach kannst du das Netzwerkkabel ziehen und es antwortet trotzdem.
Welches Modell bekomme ich?
Kommt auf deine Hardware und Sprache an. Ich ziehe zwei oder drei, damit du vergleichen kannst, und lasse das beste als Standard eingestellt.
Kannst du das auf einem gemieteten Server machen, statt auf meinem Laptop?
Ja. Gleiche Einrichtung, ich brauche nur SSH-Zugang zum Server.
Was, wenn es nach deiner Fertigstellung kaputt geht?
Der schriftliche Leitfaden deckt Neustart und die häufigsten Fehler ab. Wenn bei meiner Einrichtung etwas kaputt geht, repariere ich es.

