Ich führe Objekterkennung und Tracking in yolov8 durch
Simulation und Computer Vision Ingenieur
Über diesen Service
Objekterkennung, Verfolgung und Zählung in Bildern, Videos und Live-Streams.
WAS ICH BAUE
- Erkennung, die auf deine Objekte abgestimmt ist, inklusive open-vocabulary Erkennung ohne Trainingsset
- Multi-Objekt-Verfolgung, die IDs über Frames hinweg hält, mit Kamerabewegungskompensation
- Zählung, Richtungs- und Verweilzeit-Analyse
- Frame-Triage für lange Videos: die wichtigsten Frames aus Stunden von Aufnahmen heraussuchen
- Vorverarbeitung, Annotation und Dataset-Erstellung
WOHER DAS KOMMT
Ich habe ein Multi-Signal-Keyframe-Auswahl-Framework für Live-Videos entwickelt, das ORB-Strukturänderungs-Erkennung mit YOLOv8 und BoT-SORT-Verfolgung unter einem online adaptiven Schwellenwert kombiniert. Es wurde auf einem 148-Clip UCF-Crime Benchmark mit Ablations- und Sensitivitätsstudien validiert, läuft auf einer Dual-GPU-Pipeline und ist im IEEE-Format dokumentiert.
STACK
YOLOv8, YOLO-World, ByteTrack, BoT-SORT, ORB, OpenCV, PyTorch, Python. Vision-Sprachmodelle wie Qwen2.5-VL, bei denen die Erkennung allein nicht ausreicht.
Sende einen Beispielclip oder eine Handvoll Bilder und sag mir, was erkannt werden soll. Ich sage dir, welche Genauigkeit realistisch ist, bevor du bestellst.
Mein Portfolio
FAQ
Automatische Übersetzung
Was brauchst du von mir, um anzufangen?
Ein repräsentatives Beispiel: ein kurzer Clip oder 20-30 Bilder von derselben Kamera und unter den gleichen Bedingungen wie die echten Daten, plus eine einfache Beschreibung dessen, was als Erkennung gilt. Beispieldaten sind wichtiger als die Menge. Ich sage dir, was vor der Bestellung realistisch ist.
Brauche ich einen gelabelten Datensatz?
Nicht immer. Open-vocabulary detection kann Objekte anhand einer Textbeschreibung finden, ohne Trainingsdaten, was oft für gängige Objekte ausreicht. Für ungewöhnliche Objekte oder hohe Genauigkeit hilft ein gelabelter Datensatz, und ich kann die Annotationen im Rahmen der Arbeit übernehmen.
Welche Genauigkeit kannst du versprechen?
Keine, bevor ich deine Daten gesehen habe, und sei vorsichtig bei jedem, der das behauptet. Die Genauigkeit hängt von Objektgröße, Verdeckung, Beleuchtung und Kamerabewegung ab. Schick mir ein Sample und ich gebe dir eine ehrliche Einschätzung und sage dir, ob das Filmmaterial das eigentliche Problem ist.
Kannst du Objekte verfolgen, nicht nur erkennen?
Ja. Verfolgung hält eine Identität über Frames hinweg, damit du zählen, die Verweildauer messen oder die Richtung verfolgen kannst. Ich nutze BoT-SORT und ByteTrack, inklusive Kamerabewegungskompensation für Aufnahmen von einer bewegten oder wackelnden Kamera.
