Reliability engineer ensuring OpenAI's infrastructure scales safely and performs reliably.
A senior-level permanent position in San Francisco focused on ensuring infrastructure scales safely and performs reliably. You'll work onsite full-time with Kubernetes, Terraform, CloudFormation, DataDog, Prometheus, Grafana, and Splunk. English language proficiency required.
Membership is €29/month, cancel anytime: every rate, every original listing link, and a daily alert for roles matching your filters.
Found at a specialist agency · listed 27 July 2026 · InsideJobs links you to the original posting.