Ich erstelle lokale rag AI-Agenten und Transkriptionspipelines mit Python


Über diesen Service
Automatische Übersetzung
Bezahl keine monatlichen API-Gebühren mehr. Behalte deine Daten privat.
Ich entwickle sichere, lokale RAG (Retrieval-Augmented Generation)-Systeme und AI-Automatisierungs-Pipelines, die vollständig auf deiner eigenen Hardware laufen. Im Gegensatz zu generischen GPT-Wrappern verwenden meine Lösungen Open-Source-LLMs (Llama 3, Mistral) und lokale Transkriptions-Engines (Whisper), um 100% Datensouveränität zu gewährleisten.
Was ich entwickle:
- Lokale RAG-Agenten: Mit Dokumenten (PDFs, TXT, CSVs) chatten, ohne externe Uploads.
- Transkription: Audio-zu-Text-Pipelines mit faster-whisper und CUDA (30x schneller als CPU).
- Individuelle APIs: Produktionsreife FastAPI-Backends in Docker-Containern.
- Sichere Bereitstellung: Integration mit bestehenden Auth/RBAC-Systemen.
Technologie-Stack:
- Modelle: Ollama, Llama 3, Mistral, Whisper.
- Datenbanken: ChromaDB, FAISS, PGVector.
- Backend: Python 3.12+, FastAPI.
- Infrastruktur: Docker Compose, Nvidia CUDA.
Warum ich?
- Cybersecurity-Fokus: Ich bin Google-zertifiziert. Sicherheit ist integriert.
- SysAdmin-Erfahrung: Ich optimiere für Hardware- und VRAM-Beschränkungen.
- Kein Lock-in: Du besitzt den Code und die Gewichte.
Hinweis: Für die lokale Ausführung wird eine Nvidia-GPU (6GB+ VRAM) oder eine Hochleistungs-CPU benötigt.
Lerne Scott S. kennen
- AusVereinigte Staaten
- Mitglied seitSept. 2025
- ⌀ Antwortzeit12 Stunden
Sprachen
Englisch, Spanisch
Automatische Übersetzung
FAQ
Automatische Übersetzung
Benötigt das einen OpenAI API-Schlüssel?
Nein. Diese Lösungen laufen lokal mit Open-Source-Modellen wie Llama 3 oder Mistral. Für die KI selbst fallen keine monatlichen Abonnementgebühren an.
Welche Hardware benötige ich?
Für beste Leistung wird eine Nvidia GPU (RTX 3060 oder besser) empfohlen. Falls nötig, kann ich Modelle auch für Hochleistungs-CPUs (Mac M-Serie oder Intel i7/i9) optimieren.
Kann ich mit meinen eigenen PDFs chatten?
Ja. Die Pakete "Standard" und "Premium" beinhalten eine RAG-Pipeline, die speziell dafür entwickelt wurde, deine eigenen Dokumente zu verarbeiten und abzufragen.
Werden meine Daten in die Cloud gesendet?
Nein. Das Hauptverkaufsargument dieses Gigs ist Privatsphäre. Alle Verarbeitung findet auf dem Rechner statt, auf dem der Docker-Container läuft.
Stellst du den Source Code bereit?
Ja. Alle Pakete beinhalten den vollständigen Python-Quellcode und eine docker-compose.yml-Datei für eine einfache Bereitstellung.

