AI Safety Expert – English, Gujarati

🔥 2 minutes ago

🇺🇸 United States – Remote

💵 $16 - $22 / hour

⏳ Contract/Temporary

🟡 Mid-level

🟠 Senior

🤖 Artificial Intelligence

👻 Ghost score 8%

infoinfo
Apply Now
Find Similar Remote Jobs

📊 Check your resume score for this job

Improve your chances of getting an interview by checking your resume score before you apply.

Logo of Mercor

Mercor

51 - 200 employees

Founded 2023

🔥 Funding within the last year

💰 $350M Series C - Mercor on 2025-10

Mercor is a company for which no descriptive text was provided in the input. Additional information (products, services, target customers, or industry specifics) is needed to create an accurate summary and select appropriate industries.

📋 Description

• Red-team conversational AI models and agents using jailbreaks, prompt injections, misuse cases, bias exploitation, and multi-turn manipulation • Generate human data by annotating failures, classifying vulnerabilities, and flagging systemic risks • Apply taxonomies, benchmarks, and playbooks to keep testing consistent • Produce reproducible reports, datasets, and attack cases for customers • Review AI outputs involving sensitive topics such as bias, misinformation, and harmful behaviors • Uncover vulnerabilities that automated tests miss • Expand evaluation coverage and reduce production surprises

🎯 Requirements

• Fluent/native fluency in English and Gujarati required • Strong judgment about language and content • Ability to assess whether AI responses are accurate, complete, and appropriate • Ability to explain reasoning clearly to technical and non-technical audiences • Ability to notice subtle errors, inconsistencies, and gaps • Ability to follow guidelines and quality standards consistently • Adaptability across projects, task types, and customers • Independent contractor status • Must not require H1-B or STEM OPT support • Nice-to-have: adversarial ML experience, including jailbreak datasets, prompt injection, RLHF/DPO attacks, or model extraction • Nice-to-have: cybersecurity experience, including penetration testing, exploit development, or reverse engineering • Nice-to-have: socio-technical risk experience, including harassment/disinformation probing, abuse analysis, or conversational AI testing • Nice-to-have: psychology, acting, or writing experience for unconventional adversarial thinking

🏖️ Benefits

• Fully remote role • Flexible schedule / work on your own schedule • Weekly payments via Stripe or Wise • Higher-sensitivity project participation is optional • Clear guidelines and wellness resources for sensitive-content work • Competitive pay • Reasonable accommodations upon request • Opportunity to build experience in human data-driven AI red teaming • Opportunity to collaborate with leading researchers

Apply Now

Similar Jobs

🕒 Yesterday

Heritage Werks

51 - 200

📱 Media

📣 Marketing

Fractional strategic alliances consultant activating consulting and systems-integrator relationships for Heritage Werks Group’s Authority AI. Building partner-sourced opportunities, pilots, proposals, and revenue.

🕒 2 days ago

Sia

1001 - 5000

🏥 Healthcare

🏭 Manufacturing

📦 Logistics

AI Product Community Manager building an engaged community around a next-generation consumer AI product. Driving advocacy, growth, user insights, and product feedback for Sia’s technology client.

🕒 4 days ago

Aston Carter

1001 - 5000

🎯 Recruiter

💼 Consulting

🤝 B2B

Life sciences AI trainer evaluating scientific AI outputs for accuracy and training data quality. Aston Carter provides corporate talent solutions to clients globally.

🕒 6 days ago

Sigma AI

501 - 1000

💼 Consulting

🏥 Healthcare

📦 Logistics

Mandarin Chinese linguistic freelancer performing annotation, translation, transcription, and validation for Sigma.AI’s artificial intelligence data projects. Remote commercial contract across multiple eligible countries.

🗣️🇨🇳 Chinese Required

🕒 September 23

Donato Technologies, Inc.

201 - 500

💼 Consulting

📣 Marketing

📦 Logistics

LLM AI Quality Analyst evaluating personalized Gemini responses for Donato Technologies. Testing prompts, comparing outputs, and identifying personalization errors and hallucinations.