Ich werde deinen AI-Agenten auf Prompt-Injection und Sicherheitsrisiken prüfen


Level 1
Über diesen Service
Automatische Übersetzung
Ist dein AI-Agent sicher genug, um ihn echten Nutzern vorzustellen? Die meisten AI-Agents werden ohne Prompt-Injection-Tests ausgeliefert, was bedeutet, dass jeder deinen Chatbot austricksen kann, um seine Anweisungen zu ignorieren, dein Systemprompt zu leaken oder Aktionen auszuführen, die er nicht sollte.
Ich führe eine vollständige Sicherheitsprüfung für AI-Agents durch: Prompt-Injection-Versuche, Jailbreak-Tests, Datenleck-Checks und Missbrauchsszenarien bei API- oder Tool-Aufrufen – die gleichen Techniken, die ein böswilliger Nutzer versuchen würde, aber dokumentiert, damit du sie beheben kannst, bevor sie ausgenutzt werden.
Was abgedeckt wird:
- LLM-Sicherheitsprüfung: Systemprompt-Leak, Instruktionsüberschreibung, Jailbreak-Widerstand
- Prompt-Injection-Tests: direkte und indirekte Injection über Nutzereingaben, Dokumente oder Tool-Ausgaben
- AI-Red-Teaming: adversarielle Tests gegen die tatsächlichen Tool-Aufrufe und Berechtigungen deines Agents
- Schwachstellen-Tests für API-Schlüssel, unsicheren Tool-Zugriff und zu viele Agenten-Berechtigungen
- Ein schriftlicher Bericht, der die Ergebnisse nach Schweregrad bewertet und Empfehlungen zur Behebung enthält
Hintergrund: Über 2 Jahre Erfahrung in Python-Backend- und LLM/GenAI-Engineering, RAG-Pipelines und AI-Automatisierung in mehr als 30 Freelance-Projekten.
Sende mir Zugriff auf deinen Agenten (oder eine sandboxed/demo Version), und ich werde den Umfang der Prüfung vor Beginn festlegen.
Lerne Anchal kennen
AI ML Developer: NLP Generative AI RAG and Automation Expert
Level 1
- AusIndien
- Mitglied seitJuli 2024
- ⌀ Antwortzeit1 Stunde
- Letzte Lieferung2 Wochen
Sprachen
Hindi, Englisch
Automatische Übersetzung
Mein Portfolio
Meine weiteren Dienstleistungen im Bereich Software-Entwicklung
FAQ
Automatische Übersetzung
Brauche ich vollen Zugriff auf mein System oder kann ich eine sandboxed-Version geben?
Eine sandboxed- oder Demo-Version ist ausreichend – ich benötige keinen Produktionszugriff oder deine echten Nutzerdaten, um die Prüfung durchzuführen.
Wirst du versuchen, meinen Agenten zu knacken, oder nur den Code überprüfen?
Beides. Ich teste ihn wie ein Angreifer (live Prompt-Injection-Versuche) und überprüfe die zugrunde liegende Prompt- und Berechtigungs-Konfiguration, da echte Schwachstellen oft in beiden Bereichen liegen.
Was passiert, wenn du ein kritisches Problem findest – behebst du es auch?
Basic und Standard decken nur die Prüfung und den Bericht ab. Premium beinhaltet die Umsetzung von Guardrails, um gefundene Probleme zu beheben. Wenn im Basic/Standard etwas Kritisches auftaucht, werde ich es sofort kennzeichnen, anstatt auf die Lieferung zu warten.
