Ich repariere dein Ollama, ComfyUI oder lokales AI-Setup auf Linux oder Windows

T
taralyne84
T
taralyne84
Tara Lyne
Einige Informationen wurden automatisch übersetzt.

Über diesen Service

Automatische Übersetzung

Dein Modell lädt, liefert aber nichts zurück. Oder es läuft bei 2 Tokens pro Sekunde auf einer GPU, die eigentlich 40 schaffen sollte. Oder es OOMs bei einem Modell, das reinpassen müsste. Genau das behebe ich.


Ich betreibe einen vollständigen lokalen AI-Stack auf einer einzigen 3090 – Ollama, ComfyUI, LoRA-Training, Sprachmodelle, automatisierte Pipelines. Ich habe all diese Fehler auf meiner eigenen Hardware erlebt und herausgefunden, warum.


Was ich repariere:

  • Leere Antworten von Reasoning-Modellen. Reasoning-Tokens verbrauchen dein ganzes num_predict-Budget, daher liefert es nichts mit done_reason "length". Sieht aus wie ein kaputtes Modell. Ist es aber nicht.
  • Teilweise CPU-Offload, der deine Geschwindigkeit still und heimlich zerstört
  • Der Kontextgröße, die deinen VRAM sprengt (KV-Cache skaliert mit dem Kontext)
  • Modelle, die bei jeder Anfrage neu geladen werden, weil keep-alive noch Standard ist
  • Fehlerhafte ComfyUI-Workflows wegen fehlendem benutzerdefiniertem Node oder Modell im falschen Ordner
  • CUDA-, Treiber- und Container-Mismatches auf Linux
  • Das richtige Modell und die passende Quantisierung für den VRAM, den du tatsächlich hast

Schreib mir zuerst, was passiert, dein OS, GPU und VRAM. Ich sage dir ehrlich, ob ich es reparieren kann, bevor du bestellst. Wenn nicht, sage ich es dir, anstatt dein Geld zu nehmen.


Ich entwickle und verkaufe meine eigenen lokalen AI-Tools, also ist das keine Theorie.

Lerne Tara Lyne kennen

Tara Lyne

AI Automation and LLM Integration Developer

  • AusVereinigte Staaten
  • Mitglied seitFeb. 2026
  • Sprachen

    Englisch
I build AI systems that actually work — not demos, production systems. I run a 5-node AI cluster 24/7 with local LLMs, RAG pipelines, and autonomous agents. I deliver Python automation, FastAPI backends, LLM integration, Flutter mobile apps, and web scraping solutions. Fast delivery. Clean code. Real results.

Automatische Übersetzung

Meine weiteren Dienstleistungen im Bereich KI-Entwicklung