Ich werde Mandarin-Audio für AI-Datensätze transkribieren und annotieren
Big Data und AI Ingenieur
Über diesen Service
Bereite Mandarin-Audio für KI-Datensätze vor, mit menschlich überprüften Transkripten und strukturierten Labels.
Ich bin ein Muttersprachler in Mandarin und ein Big Data- und KI-Ingenieur, der chinesisches Sprachverständnis mit strukturierter Datenvorbereitung verbindet.
Ich transkribiere klares Mandarin, markiere bis zu 2 Sprecher, füge Turn-zeitstempel hinzu und kennzeichne unklare oder überlappende Sprache, ohne zu raten. Lieferumfang: TXT und CSV; JSON in Standard und Premium.
Basic: 2 Minuten Audio, bis zu 100 Segmente. Standard: 5 Minuten, bis zu 200 Segmente, plus bis zu 5 vom Kunden definierte Intent-Labels. Premium: 10 Minuten, bis zu 300 Segmente, plus beobachtbare KI-Dialogprobleme wie irrelevante Antworten oder klare Transkriptfehler. Sowohl Dauer- als auch Segmentbegrenzungen gelten.
Stelle Audio, Richtlinien für Labeling und Terminologie bereit. Sende zuerst eine Probe bei Rauschen, Akzenten oder Fachthemen. Wortgenaue Ausrichtung, Übersetzung, Sprachaufnahme und kommerzielle Synchronisation sind nicht enthalten.
Revisionen korrigieren die Arbeit innerhalb des ursprünglichen Audios und der vereinbarten Regeln. Neue Dateien oder geänderte Labels benötigen einen neuen Umfang. Teile nur autorisiertes Audio und entferne vertrauliche Details.
Technik:
Anleitung
Tagging-Typ:
Text
•
Audio
FAQ
Automatische Übersetzung
Nimmst du Stimmen auf oder synchronisierst du Stimmen?
Dieses Gig annotiert dein vorhandenes Audio. Menschliche Sprachaufnahmen und kommerzielle Synchronisation sind nicht enthalten.
Wie genau sind die Zeitstempel?
Zeitstempel markieren Sprecherwechsel. Wortgenaue Ausrichtung ist nicht enthalten. Sowohl die Dauer des Audios als auch die Segmentbegrenzungen gelten.
Kannst du Intent labeln oder KI-Antworten reviewen?
Standard und Premium unterstützen bis zu 5 vereinbarte Intent-Labels. Premium fügt beobachtbare Probleme aus dem bereitgestellten Audio und Kontext hinzu; es garantiert keine vollständige Faktenüberprüfung.
Kannst du mit verrauschtem Aufnahmematerial oder Dialekten umgehen?
Sende zuerst eine kurze Probe. Die Pakete decken klares Mandarin mit bis zu 2 Sprechern ab. Unklare Abschnitte werden markiert, anstatt erfunden zu werden.
