
OpenAI
AI Infrastructure Engineer, pAGI
개발인프라·DevOps연구·R&D
AI 요약
OpenAI의 pAGI Research 조직에서 대규모 모델 학습·평가를 뒷받침할 AI Infrastructure Engineer를 채용합니다. 분산 학습 인프라, 추론/채점 플랫폼, 컴퓨트 스케줄링, 연구 도구를 구축·운영하며, 병목 분석과 성능 최적화를 통해 연구가 더 빠르고 안정적으로 진행되도록 지원하는 역할입니다.
주요 업무
대규모 학습 및 평가 인프라 구축·운영, 공유 inference/grading 플랫폼 개발, 자동 capacity management와 health monitoring 구현, compute scheduling 및 resource allocation 개선, training/inference/orchestration 전반의 병목 진단 및 성능 개선, 연구자가 실험을 더 적은 수작업으로 실행·진단·비교할 수 있는 self-service tools와 automated validation/observability 구축.
자격 요건
필수: 강한 software engineering fundamentals, 대규모 distributed systems 구축 또는 운영 경험, ML infrastructure/inference systems/GPU performance/infrastructure tooling 경험 중 하나 이상, 자기주도적으로 열린 문제를 해결할 수 있는 역량, 시스템 경계를 넘나드는 디버깅 및 측정 기반 개선 능력. 우대/선호: 개인 AGI의 가능성에 대한 관심, 연구자 및 엔지니어와의 협업 역량.
기술 스택
distributed systemsML infrastructureinference systemsGPU performancecompute schedulingobservability
OpenAI의 다른 공고
Model Policy Manager, Multimodal Safety
Model Policy Manager, National Security
Dedicated Support Engineering Lead
고객지원Deputy General Counsel, Commercial (Marketing)
경영지원Global Transportation Programs, Senior Manager
경영지원Applied AI Engineer, Quants
AI·머신러닝, 개발, 연구·R&DHead of Finance - Data Centers
경영지원International Marketing Lead, SMB Ads
마케팅, 영업