Member of Technical Staff, Coding Research
Design coding evaluations and research data to advance frontier model capability.
Design coding evaluations and research data to advance frontier model capability.
Secure AI products and build LLM security tooling and evaluations.
Design enterprise AI research data and translate findings into model improvements.
Build RL environments and research data pipelines for frontier model training.
Evaluate military and IHL scenarios to inform AI safety policy and red-teaming.
Assess nuclear and radiological misuse risks to strengthen AI safety evaluations.
Lead offensive security red-teaming to evaluate and harden AI systems.
Assess biosecurity misuse risks to strengthen AI model safety guardrails.
Probe models with jailbreaks and prompt injections to strengthen AI safety defenses.
Research vulnerabilities and red-team systems to build AI security evaluation data.
Lead red-teaming quality assurance efforts, identifying vulnerabilities and safety risks in AI model outputs through adversarial evaluation.
Not Accepting Applications
Design adversarial prompts that probe AI models for failure modes and unsafe behaviour.
Page 3 of 5 · 60 total