
Anthropic
Data Center Operations Lead - Partner Site Operations
인프라·DevOps현장운영
AI 요약
Anthropic의 Data Center Operations 팀에서 파트너 운영 데이터센터 사이트를 총괄하는 Site Lead를 채용합니다. 서버·네트워크·랙 수준의 인프라를 바탕으로 가용성, 배포 속도, 장애 대응, 벤더 성과, EHS/보안 준수까지 운영 전반을 관리하며, 현장 팀을 직접 지휘하기보다 기준 수립과 성과 관리에 집중하는 역할입니다.
주요 업무
사이트 가용성, 배포 마일스톤, 수리 턴어라운드 관리 및 독립 데이터 기반 검증, 벤더의 일일·주간 우선순위 설정과 운영 리듬(standup, business review) 주도, deployment/break-fix/change management/security/EHS 절차 수립 및 개선, SLA·staffing commitment 대비 벤더 성과 추적과 시정조치, 인시던트 escalation 온콜 참여 및 필요 시 Incident Commander로 대응 지휘, 엔지니어링 요구사항을 벤더 실행 지침으로 변환하고 리더십에 사이트 제약·리스크 전달, 운영 트렌드 분석 및 전사/전 사이트 표준화 개선 추진.
자격 요건
필수: 데이터센터 운영(하드웨어, IT 인프라, critical facilities) 관련 8년 이상 경력, 생산 가용성에 대한 책임 경험, 벤더/MSP/계약 인력 관리 및 SOW·SLA·운영 리뷰·시정조치 경험, 서버·네트워크·랙 수준 인프라에 대한 실무적 기술 이해, 운영 프로세스 설계/개선 경험, 인시던트 커맨드 또는 lead-responder 경험, 불확실한 상황에서 명확한 커뮤니케이션 능력, 비정규 시간/온콜/배포·유지보수 윈도우 대응 가능, 관련 분야 학사 또는 동등한 실무 경험. 우대: 제3자 코로케이션/파트너 운영 사이트 경험, 신규 사이트/데이터홀 구축 및 운영 준비 경험, GPU/가속기 또는 고밀도 액체냉각 인프라 경험, 멀티벤더 환경 경험, 부서 간 프로젝트 리딩 경험, incident management framework, contract/SLA 설계, EHS 프로그램 경험.
기술 스택
hardwareIT infrastructureservernetworkrack-level infrastructureSLASOWEHS