Zum Hauptinhalt gehen
Erstellt am 20. Juli 2026

AI Data Annotation Specialist (Mensch)

Neura Robotics
Riederich, Baden-Wurttemberg, Germany Vollzeit
Reference: 490_778970_dddcd503-ac7e-49a6-b807-9de4fa7bcc84

Deine Mission & Herausforderungen

Als AI Data Annotation Specialist bewegst du dich an der Schnittstelle von Data Ingestion, Annotation-Workflow-Design und Machine Learning - mit einem starken Fokus auf den Aufbau von Trainingsdatensatzen fur multimodale Foundation-Modelle, die Wahrnehmung, Sprache und Roboteraktion miteinander verbinden. Deine Hauptverantwortung ist die Konzeption und Pflege skalierbarer Workflows fur automatisierte und Human-in-the-Loop-Annotation, damit Datensatze korrekt gelabelt, kuratiert, validiert und fur effizientes Modelltraining sowie Evaluation aufbereitet sind.

Du spielst eine entscheidende Rolle dabei, hochwertige Embodied-AI-Systeme zu ermoglichen, indem du rohe multimodale Roboterdaten in strukturierte, verlassliche und semantisch reichhaltige Trainingsdatensatze verwandelst.

  • Du konzipierst, baust und pflegst Pipelines fur automatisierte, semi-automatisierte und Human-in-the-Loop-Datenannotation, mit Fokus auf Subtask-Labeling fur Long-Horizon-Roboterdemonstrationen

  • Du entwickelst Annotation-Workflows fur sprachbasiertes Robot Learning und Visual-Question-Answering(VQA)-Datensatze, einschlielich Instruction Generation, Subtask-Decomposition und der Verankerung naturlicher Sprache in visuellen und Aktionsdaten

  • Du nimmst multimodale Daten (Video, Tiefe, Propriozeption, Gripper States, Sprachinstruktionen) auf und integrierst sie in strukturierte Annotation-Workflows

  • Du wendest Pre-Labeling-Techniken mit Foundation-Modellen (z. B. Vision-Language-Modelle, LLMs) an, um die Annotation zu beschleunigen und manuellen Aufwand zu reduzieren

  • Du definierst und implementierst Datenqualitatsprufungen: Inter-Annotator Agreement, Label-Konsistenz, Coverage-Analyse und Erkennung von Annotation Drift

  • Du treibst Data-Curation-Initiativen voran: Dataset Balancing, Deduplizierung, Failure-Case Mining, Task-Diversity-Analyse und gezielte Datenerhebung zur Schlieung von Capability Gaps

  • Du identifizierst und behebst Datenqualitatsprobleme, Labeling-Inkonsistenzen, Verteilungs-Bias sowie Lucken in der Task-/Skill-Abdeckung

Was du mitbringst

  • Abschluss in Informatik, Data Science, Ingenieurwesen oder einem verwandten Bereich

  • 4+ Jahre Erfahrung in Machine Learning Operations, AI oder Software Engineering

  • Praktische Erfahrung mit Data-Annotation-Tools und Labeling-Workflows (z. B. Encord, CVAT, Label Studio oder vergleichbare Plattformen)

  • Erfahrung mit Subtask-Annotation, Ontologie-/Taxonomie-Design und VQA-Style-Labelling

  • Vertrautheit mit Robotik-Datensatzformaten und multimodaler Datenstrukturierung (z. B. LeRobot, RLDS, Open X-Embodiment)

  • Erfahrung mit Cloud-Plattformen (AWS, GCP, Azure) von Vorteil

  • Erfahrung im Verfassen von Annotation Guidelines / Taxonomien (erganzt die oben genannte Verantwortung)

  • Vertrautheit mit VLMs/LLMs fur Auto-Labeling (z. B. Open-Vocabulary-Detektoren, Modelle der Gemini-/GPT-Klasse)

  • Grundkenntnisse in Data Engineering - sicherer Umgang mit groskaligen/Streaming-Daten und Formaten wie ROS Bags/MCAP sowie S3-artigem Object Storage

  • Erfahrung im Aufbau von Backend-Services und Tooling (z. B. Node.js/TypeScript, REST-APIs) zur Integration von Annotation-Plattformen in interne Dateninfrastruktur

  • Von Vorteil: direkte Erfahrung mit Embodied-AI-/Teleoperationsdaten

Jobbenachrichtigungen per Newsletter erhalten