SA

Surge AI

Verified Job Source

Human intelligence for AGI

San Francisco, California

Software Development
201–500 people

About

Our mission is to raise AGI with the richness of humanity — curious, witty, imaginative, and full of breathtaking brilliance.

Open positions

Senior Software Engineer (Agentic Coding RL Environments)

Remote · Argentina, Australia, Brazil, Canada, Denmark, Germany, India, Ireland, Netherlands, New Zealand, Norway, Philippines, Poland, Romania, Sweden, Ukraine, United Kingdom, United States

Build coding RL environments and benchmarks to evaluate AI agents on realistic software engineering tasks. Design tasks, write success criteria, and provide structured feedback to improve future models.

Senior Software Engineer (Agentic Coding RL Environments)

Remote · Argentina, Australia, Brazil, Canada, Denmark, Germany, India, Ireland, Netherlands, New Zealand, Norway, Philippines, Poland, Romania, Sweden, Ukraine, United Kingdom, United States

Build coding RL environments and benchmarks to evaluate how AI agents perform on realistic software engineering tasks. This includes designing tasks, reviewing model outputs for failures, and writing success criteria and rubrics.

Senior Software Engineer (Agentic Coding RL Environments)

Remote · Argentina, Australia, Brazil, Canada, Denmark, Germany, India, Ireland, Netherlands, New Zealand, Norway, Philippines, Poland, Romania, Sweden, Ukraine, United Kingdom, United States

Build coding RL environments and benchmarks to evaluate agent performance on realistic software engineering tasks. Design tasks, write success criteria, and provide structured feedback to improve future AI models.

Senior Software Engineer (Agentic Coding RL Environments)

Remote · Argentina, Australia, Brazil, Canada, Denmark, Germany, India, Ireland, Netherlands, New Zealand, Norway, Philippines, Poland, Romania, Sweden, Ukraine, United Kingdom, United States

Build coding RL environments and benchmarks to test agent performance on realistic software engineering tasks. Design tasks, review model outputs, and establish success criteria to improve future AI models.