Ich richte Colibri ein, um Kimi GLM DeepSeek und große KI-Modelle lokal auszuführen


Über diesen Service
Automatische Übersetzung
Möchtest du ein sehr großes KI-Modell auf deinem eigenen Computer laufen lassen, ohne jede Eingabe an eine Cloud-API zu schicken?
Ich installiere und konfiguriere Colibri, die Open-Source-Inferenz-Engine, die Mixture-of-Experts-Modellgewichte vom SSD streamt. Auf kompatibler Hardware kann sie kimi, Deepseek v4 Flash und GLM-5.2 744B lokal ausführen.
Je nach deinem Paket kann ich:
- Hardware- und Speicherkompatibilität prüfen
- Colibri auf Linux, Windows oder macOS installieren oder bauen
- ein unterstütztes Modell konfigurieren
- CPU, RAM, GPU, Cache und NVMe-Platzierung optimieren
- CLI-Chat, das Web-Dashboard oder eine lokale API aktivieren
- Diagnosen durchführen und einen Leistungstest machen
Wichtig: Das empfohlene GLM-5.2 int4 Modell benötigt etwa 372 GB freien Speicher. Eine GPU ist optional, aber eine schnelle NVMe-SSD ist wichtig. Langsamere Systeme könnten weniger als ein Token pro Sekunde generieren, daher kann ich keine Geschwindigkeit versprechen, bevor ich deine Hardware geprüft habe.
Bitte schreibe mir vor der Bestellung mit deinem Betriebssystem, CPU, RAM, GPU, Festplattentyp, freiem Speicher und Internetgeschwindigkeit. Ich bestätige die Kompatibilität und das passende Paket.
Lerne Khan kennen
Building Your Future: AI Websites, Automation, Chatbots and SaaS
- AusPakistan
- Mitglied seitJuni 2025
- ⌀ Antwortzeit7 Stunden
- Letzte Lieferung8 Monate
Sprachen
Englisch, Urdu
Automatische Übersetzung
Mein Portfolio
FAQ
Automatische Übersetzung
Kann Colibri GLM-5.2 744B ohne GPU ausführen?
Ja. Colibri unterstützt CPU-only Inferenz. Eine GPU kann bei unterstützter Hardware helfen, aber das Modell kann auch ohne laufen. Speicher-Geschwindigkeit, RAM, CPU und Konfiguration beeinflussen die Leistung.
Welche Hardware brauche ich für GLM-5.2?
Das offizielle Quick-Start-Handbuch nennt etwa 16 GB RAM als Minimum, 24 GB oder mehr als Empfehlung, und etwa 380 GB freien Festplattenspeicher für das int4 Modell. Eine schnelle NVMe-SSD wird dringend empfohlen.
Wird es auf meinem Computer schnell laufen?
Ich kann keine Geschwindigkeit versprechen, bevor ich dein System geprüft habe. Colibri tauscht den Speicherverbrauch gegen Speichertraffic. Eine langsame oder geteilte Festplatte kann deutlich unter einem Token pro Sekunde produzieren. Ich werde die fertige Einrichtung benchmarken und das Ergebnis berichten.
Welche Betriebssysteme unterstützen Sie?
Linux, Windows 10 oder 11 und macOS werden unterstützt. Verfügbare Beschleunigungsoptionen hängen von deiner Hardware und den Treibern ab.
Ist der Modell-Download inklusive?
Standard und Premium beinhalten das Herunterladen und Konfigurieren eines unterstützten Modells auf deinem Rechner. Du musst genügend Speicher und Internetbandbreite bereitstellen und die entsprechende Modell-Lizenz akzeptieren. Ich verkaufe keine Modellgewichte weiter.
Kannst du Colibri mit meiner App oder meinem Workflow verbinden?
Premium umfasst OpenAI-kompatible und Anthropic Messages lokale APIs. Die Verbindung zu einer bestimmten App, n8n-Workflow oder benutzerdefinierten Schnittstelle kann je nach Umfang ein individuelles Angebot erfordern.
Kannst du es mit Claude Code verbinden?
Ja. Colibri 1.4.0 bietet einen Anthropic Messages-Endpunkt, der von Claude Code genutzt werden kann. Große Coding-Agent-Prompts können auf einer CPU- und SSD-Setup lange dauern, daher teste ich es und erkläre die gemessene Leistung, anstatt eine Geschwindigkeit wie in der Cloud zu versprechen.
Kannst du ein anderes Modell als GLM-5.2 einrichten?
Colibri unterstützt derzeit GLM-5.2, Inkling, Kimi K3 und OLMoE. Ihr Speicher- und Speicherbedarf variiert. Sende mir deine Hardware-Details und dein bevorzugtes Modell vor der Bestellung.
Muss ich Passwörter teilen?
Sende keine persönlichen Passwörter im Fiverr-Chat. Wir einigen uns auf eine sichere Einrichtungsmethode, die innerhalb der Fiverr-Regeln bleibt. Ersetze temporäre Zugangsdaten nach der Lieferung.
