Ich teste dein KI-Chatbot, LLM-App-Tests und führe eine grundlegende Sicherheitsüberprüfung durch
Ukraine
5 Aufträge abgeschlossen
QA-Ingenieur, manuelles und automatisiertes Testen, Web, Mobile, API
Über diesen Service
Ein KI-Chatbot, LLM-Anwendung oder Web-Tool bereitstellen?
Stelle sicher, dass dein KI präzise, hallucinationsfreie Antworten liefert und deine Nutzerdaten sowie Endpunkte vor Schwachstellen und Prompt-Injection schützt.
Als spezialisierter QA-Ingenieur führe ich umfassende AI Chatbot Testing, LLM Evaluation (Prompt Red Teaming) und Baseline Security Audits für Web-Apps, SaaS und KI-basierte Plattformen durch.
️ Was ich teste & liefere:
- AI & LLM Funktionstests: Antwortgenauigkeit, Halluzinations-Erkennung, Intent-Recognition, Kontextbeibehaltung, Edge Cases und Gesprächsfluss-Logik.
- Prompt Injection & AI Jailbreak (Red Teaming): Tests gegen Prompt-Leaks, System-Prompt-Overrides, Bias und toxische Ausgaben.
- Chatbot-Integrationstests: UI/UX-Widget-Checks, API-Antwortlatenz, Multi-Turn-Dialoge auf Web- und Mobilplattformen.
- Grundlegende Sicherheits- & Schwachstellen-Überprüfung: OWASP Top 10 Baseline-Checks (XSS, SQLi, sensible Datenexposition, SSL/TLS-Checks).
- Umsetzbare Fehlerberichte: Detaillierte Ergebnisse mit Reproduktionsschritten, Beweis-Screenshots/Logs und Sicherheitsmaßnahmen.
Fokusbereiche: OpenAI/ChatGPT-Bots, Claude, eigene LLMs, RAG-Apps, Customer Support Bots, OWASP, API-Sicherheit.
Anwendung testen:
Software
Entwicklungstechnologie:
C / C ++
•
Go
•
Java
•
Node.js
•
Python
Gerät:
PC
•
iPhone
•
Android-Mobiltelefon
Mein Portfolio
FAQ
Automatische Übersetzung
Was ist in AI Chatbot & LLM-Tests enthalten?
Ich evaluiere Multi-Turn-Dialogflüsse, überprüfe Ton und Kontextbeibehaltung, erkenne Halluzinationen und führe Edge-Case-Szenarien durch, um sicherzustellen, dass dein Bot unerwartete Nutzereingaben elegant verarbeitet.
Wie führst du Prompt Injection und Jailbreak-Tests durch?
Ich agiere als "Red Teamer" und versuche, deine System-Prompts und Sicherheitsvorrichtungen (mit adversarial inputs, indirekter Injection und Override-Versuchen) zu umgehen, um zu prüfen, ob vertrauliche Daten oder interne Systemanweisungen nicht geleakt werden können.
Was deckt die Baseline-Sicherheitsüberprüfung ab?
Ich führe nicht-destruktive Baseline-Checks nach OWASP-Prinzipien durch: Überprüfung auf gängige Front-End/API-Schwachstellen (XSS, Input-Sanitization-Fehler, sensible Datenexposition, Cookie-/Sitzungssicherheit und Endpunkt-Response-Validierungen).
Welche Leistungen erhalte ich?
Du erhältst einen strukturierten PDF-/Excel-Bericht mit kategorisierten Problemen (Schweregrad: Kritisch/Hoch/Mittel/Niedrig), Proof-of-Concept-Schritten, Screenshots/Logs und praktischen Empfehlungen zur Behebung.
Brauche ich meinen System-Prompt zum Testen?
Nicht unbedingt, aber es hilft — wenn ich die vorgesehenen Regeln des Bots kenne, kann ich genauer testen, ob er getäuscht werden kann, um sie zu brechen. Ohne ihn teste ich basierend auf vernünftigen Erwartungen an einen Chatbot in deinem Bereich.

