Ich erstelle eine AI-Scanner-App mit OCR und YOLO-Erkennung zum Textscan für iPhone, Android
Full-Stack-Entwicklung, OpenCV, WebApp, AR, VR App und KI-Entwicklung
Über diesen Service
Suchst du eine schnelle, zuverlässige mobile Scanner-App, die Objekte in Echtzeit erkennt und Text aus Bildern extrahiert? Ich entwickle plattformübergreifende AI-Scanner-Apps für iOS und Android mit YOLO (Echtzeit-Objekterkennung) für die Erkennung und OCR (Tesseract / ML Kit / Vision API) für präzises Text-Scanning. Die Apps umfassen Kameraaufnahme, Live-Erkennungs-Overlay, Ergebnisexport (CSV/JSON) sowie optionale Cloud-Synchronisation oder Backend-Integration.
Was ich liefere:
- Echtzeit-Objekterkennung basierend auf YOLO (YOLOv5 / YOLOv8 / Nano-Modelle)
- OCR/Text-Scanning (Tesseract / Google ML Kit / Apple Vision)
- Native plattformübergreifende App (React Native / Flutter oder native Swift/Kotlin auf Wunsch)
- Live-Kamera-Overlay mit Bounding-Boxen + Labels + Confidence
- Schnapp-zu-erfassen, Stapel-Scanning & Multi-Frame-Aggregation
- Fehlerbehebung bei YOLO, TFLite oder TensorFlow in deiner App
- Inference auf dem Gerät (quantisierte Modelle) oder Server-Inference (optional)
- Benutzereinstellungen: Modellwahl, Erkennungs-Schwelle, Sprache für OCR
- Kamera-Zensur-App
- AR-App
- Einfache Benutzeroberfläche für Scan-Historie, Ergebnisse und Export/Sharing
- Barcode/QR-Code-Scanner
- Cloud-Speicher, Admin-Dashboard
Ergebnisexport: CSV, JSON oder Push an REST API / Firebase
Kontaktiere mich und lass uns die Idee zum Leben erwecken
Programmiersprache:
Python
•
Java
•
NoSQL
•
MLflow
Frameworks:
scikit-learn
•
DeepPy
•
Google ML Kit
•
SimpleCV
•
PyTorch
Meine weiteren Dienstleistungen im Bereich Datenwissenschaft & ML
FAQ
Automatische Übersetzung
Brauchst du meine Dataset oder Bilder?
Wenn du benutzerdefinierte Erkennungs-Klassen möchtest, ja — liefere gelabelte Bilder (ich kann sie gegen Gebühr annotieren). Ich arbeite auch mit öffentlichen Modellen für allgemeine Objekte.
Läuft die Erkennung offline auf dem Telefon?
Ja, Inference auf dem Gerät mit quantisierten Modellen wird unterstützt, um Geschwindigkeit und Privatsphäre zu gewährleisten. Server-Inference ist optional für schwerere Modelle.
Kann die App mehrere Sprachen erkennen?
Ja, OCR-Engines unterstützen mehrere Sprachen; Sprachpakete können erforderlich sein.
Veröffentlichst du im App Store & Play Store?
Ja, ich helfe bei Verpackung, TestFlight, Play Console-Uploads und Store-Einreichung (falls erforderlich).

