Ich entwerfe spezialisierte kleine GPT-BERT-Modelle für Edge-Geräte


Über diesen Service
Automatische Übersetzung
Benötigst du KI, die lokal ohne Cloud-APIs, Internetzugang oder externen Server funktioniert?
Ich entwerfe und implementiere aufgaben-spezifische transformerartige KI-Modelle für ressourcenbeschränkte eingebettete Plattformen, unter Verwendung herkömmlicher Vektor-, Matrix- und Tensoroperationen.
Je nach Zielaufgabe kann ich leichte:
- GPT-ähnliche Architekturen für Textgenerierung oder Sequenzvorhersage
- BERT-ähnliche Architekturen für Klassifikation, Einbettungen und Merkmalsextraktion
- Encoder-Decoder-Architekturen für spezialisierte Sequenz-zu-Sequenz-Aufgaben
- Aufmerksamkeit-basierte Modelle, die für eingebettete Inferenz optimiert sind
- Quantisierte und speicheroptimierte Modelle für 32-Bit-MCUs
- Multi-MCU/MCU-Cluster-Inferenzarchitekturen
Als Zielplattformen kommen ESP32-S3, STM32, andere 32-Bit-MCUs infrage, abhängig vom verfügbaren RAM, Flash, PSRAM und spezifischen Anforderungen.
Das Ziel ist vollständig offline Edge AI: Die Inferenz läuft direkt auf deinem Gerät, ohne auf OpenAI-APIs, Cloud-Server oder ständige Internetverbindung angewiesen zu sein.
Wichtig: Dabei handelt es sich um anwendungsspezifische eingebettete KI-Systeme, keine vollwertigen ChatGPT-Alternativen. Bitte kontaktiere mich vor der Bestellung, damit ich deine MCU-Ressourcen, Dataset, Modellanforderungen und Zielaufgabe einschätzen kann.
Lerne Saikat M kennen
Embedded ML
- AusIndien
- Mitglied seitJuni 2026
- ⌀ Antwortzeit1 Stunde
Sprachen
Bengalisch, Englisch, Hindi
Automatische Übersetzung

