AI Safety Specialist - Fully Remote | Upto $62/hr

🏢 mercor · all mercor jobs
📍 Finland
💰 USD 48 - 62 / hourly
📅 Posted 2026-08-29 · via Himalayas
🏷 AI-Safety,Red-Teaming,AI-Security,Machine-Learning-Safety,Adversarial-ML-Testing,AI-Safety-Specialist,AI-Safety-Analyst,AI-Safety-Practitioner,AI-Safety-Expert,AI-Safety-Researcher,AI-Security-Specialist,Safety-AI,Safety-AI-Engineering,Remote-AI-Specialist
Apply on original site ↗

About the job

Mercor connects elite creative and technical talent with leading AI research labs. Headquartered in San Francisco, our investors include Benchmark , General Catalyst , Peter Thiel , Adam D'Angelo , Larry Summers , and Jack Dorsey .

Position: AI Safety Experts — English & Finnish
Type: Contract
Compensation: $48–$62/hour
Location: Remote
Role Responsibilities

- Red team conversational AI models and agents to identify jailbreaks, prompt injections, misuse cases, and bias exploitation.

- Generate high-quality human data by annotating failures, classifying vulnerabilities, and flagging systemic risks.

- Apply structure by following taxonomies, benchmarks, and playbooks to maintain consistent testing.

- Document reproducibly by producing reports, datasets, and attack cases that customers can act on.

- Work independently and asynchronously to meet deadlines while improving AI model performance .

Qualifications

Must-Have

- Native fluency in English and Finnish .

- Prior red teaming experience in AI adversarial work , cybersecurity , or socio-technical probing.

- Strong communication skills to explain risks clearly to technical and non-technical stakeholders.

- Ability to thrive on moving across projects and customers.

Preferred

- Experience in Adversarial ML : jailbreak datasets, prompt injection, RLHF/DPO attacks, model extraction.

- Background in Cybersecurity : penetration testing, exploit development, reverse engineering.

- Expertise in socio-technical risk: harassment/disinfo probing, abuse analysis, conversational AI testing .

- Creative probing skills: psychology, acting, writing for unconventional adversarial thinking.

Application Process (Takes 20–30 mins to complete)

- Upload resume

- AI interview based on your resume

- Submit form

Resources & Support

- For details about the interview process and platform information, please check:

- For any help or support, reach out to:

PS: Our team reviews applications daily. Please complete your AI interview and application steps to be considered for this opportunity.

Originally posted on Himalayas

← All remote jobs

Similar for you