About The Opportunity
A quick-scaling AI data annotation and linguistic services firm operating at the intersection of human intelligence and machine learning, we build high-accuracy training datasets for global NLP, conversational AI, and generative AI platforms. Our team fuels the next wave of multilingual LLMs, voice assistants, and AI chatbots by curating, annotating, and validating linguistic data with precision, cultural nuance, and linguistic rigor across 30+ Indic and global languages.
Role & Responsibilities
Lead end-to-end linguistic annotation projects across speech, text, and conversational AI datasets—ensuring linguistic accuracy, cultural context, and domain-specific relevance.
Design, document, and enforce annotation guidelines and quality rubrics for multilingual NLP tasks (NER, intent classification, sentiment, QA, paraphrasing, etc.).
Train and mentor distributed linguistic annotators, QA analysts, and team leads on linguistic best practices, edge-case handling, and inter-annotator agreement protocols.
Own quality assurance workflows: conduct random audits,
resolve disputes, calibrate teams, and drive continuous quality improvement using SLA dashboards and error trend analytics.
Partner with AI/ML engineers to translate model performance feedback into actionable annotation refinements and dataset enhancements.
Develop linguist training modules (video, quizzes, case studies) and manage certification programs to scale annotation quality across remote teams in India.
Skills & Qualifications
Must-Have
Linguistic annotation
NLP data labeling
Speech transcription
Text classification
Intent detection
Quality assurance in AI datasets
Inter-annotator agreement
Annotation guidelines design
Preferred
Experience with Prodigy, Label Studio, or similar annotation platforms
Working knowledge of Indian languages (Hindi, Tamil, Telugu, Bengali, Marathi, etc.)
Familiarity with transformer-based models or LLMs (e.g., fine-tuning, prompt tuning)
Benefits & Cul
📌 Linguistic Training (India)
🏢 MG
📍 India