Seeking Dutch Audio Specialist for AI project involving audio model evaluations and structured training data generation. Role centers on evaluating AI's conversational accuracy and creating training scenarios.
Responsibilities
Operate autonomously to design complex evaluation frameworks and provide structured training data.
Role-Play Scenario Execution: Creating and executing complex, role-play-based evaluation scenarios that simulate realistic customer service interactions across travel, finance, and technical support domains.
Model Performance Auditing: Evaluating AI model performance across standardized qualitative and quantitative metrics, focusing strictly on task completion accuracy, conversational naturalness, and audio comprehension.
Technical Metric Evaluation: Assessing the model's basic computer programming literacy, including its understanding of JSON structures, functions, methods, and ability to reason about structured data within a support context.
Representative Dataset Generation: Contributing to the development of diverse, high-quality audio datasets that accurately reflect real customer expectations for clarity, efficiency, and natural conversational flow.
Requirements
Demonstrable professional expertise in complex customer support, technical troubleshooting, or conversational AI evaluation.
Native or bilingual proficiency in the target language, including fluency across all language skills (reading, listening, writing, and speaking), alongside strong analytical and verbal communication skills to confidently conduct simulated customer support role-plays.
Basic computer programming literacy, specifically a comfortable understanding of JSON structures, functions, methods, and simple logic.
A meticulous, detail-oriented approach to working with structured prompts, complex evaluation rubrics, and technical guidelines.
Required Equipment: Access to a high-quality microphone to ensure clean, reliable audio input during voice evaluations.
Benefits
Company-sponsored benefits such as health insurance and PTO do not apply.
Technology, data and AI advisory leader building Leo Berwick’s power, utilities and renewables practice. Leading diligence, AI value creation and M&A technology work for PE and infrastructure clients.
AI Linguistic Evaluator assessing Telugu AI - generated content for RWS. Translating English prompts and evaluating linguistic accuracy, localization, and cultural relevance remotely from Canada.
Bengali AI linguistic evaluator assessing linguistic accuracy, localization, and cultural relevance. Providing structured feedback to improve RWS’s next - generation AI systems.
AI Linguistic Evaluator assessing Gujarati AI responses for RWS. Translating English prompts and evaluating linguistic accuracy, localization, and cultural relevance.
Freelance AI Linguistic Evaluator assessing Malayalam AI responses for RWS. Translating English prompts and evaluating linguistic accuracy, localization, and cultural relevance.
AI linguistic evaluator assessing Tamil AI - generated content for RWS. Translating English prompts, evaluating localization quality, and providing structured linguistic feedback.
AI Linguistic Evaluator assessing Marathi AI - generated content for RWS. Evaluating translation, linguistic accuracy, localization, and cultural relevance remotely from Canada.
Head of AI Operations building Supabase’s AI - native operating system for its Postgres development platform. Establishing standards, assessments, automated reporting, and company - wide AI - enabled operations.
Generative AI Artist creating AI - driven visuals, sequences, and previs for Rodeo FX’s visual - effects and advertising productions. Building ComfyUI workflows and collaborating with compositing, 3D, and art - direction teams.
Administrateur IA assurant la gouvernance, la sécurité et les opérations de Microsoft 365 Copilot chez EDC. Soutien de l’IA d’entreprise pour aider les entreprises canadiennes à réussir à l’étranger.