Ich prüfe deinen KI-Agenten und mache ihn einsatzbereit
AI-Ingenieur und Lösungsarchitekt für RAG und AI-Agenten
Über diesen Service
Willst du eine KI oder LLM-App starten? Ich teste sie so, wie es ein Angreifer oder ein Vorfall in der Produktion tun würde, und sage dir genau, was du beheben musst.
Ich bin KI-Ingenieur und entwickle Produktions-KI-Systeme für eine regulierte Bank, bei der Sicherheit, Datenschutz und Zuverlässigkeit oberste Priorität haben.
Was ich überprüfe:
- Prompt-Injection und Jailbreaks, direkt und versteckt in Dokumenten oder Webseiten
- Datenlecks: System-Prompts, PII, Geheimnisse, Daten anderer Nutzer
- Tool- und API-Berechtigungen: Was dein Agent tun kann, was er eigentlich nicht sollte
- Zuverlässigkeit: Fehlerbehandlung, Wiederholungen, Timeouts, Schleifen und Fallbacks
- Bewertung: Ob die Antwortqualität gemessen wird oder nur gehofft wird
- Logging, Tracing, Rate-Limits und unkontrollierte Token-Kosten
- Deployment: Docker, CI/CD und Geheimnisverwaltung
Du erhältst einen Schweregrad-bewerteten Bericht mit Beweisen, zugeordnet zu den OWASP LLM Top 10, plus einen priorisierten Fix-Plan. Im Top-Paket setze ich die Fixes um und teste erneut.
Stacks: LangGraph, LangChain, CrewAI, n8n Agents und eigene Python/FastAPI-Lösungen, mit OpenAI, Claude oder lokalen Modellen.
Schreib mir, was dein Agent macht und wie er deployed ist, bevor du bestellst.
Entwicklungstechnologie:
Python

