
Anthropic
Staff Software Engineer, Infrastructure (Distributed Systems)
개발인프라·DevOps
AI 요약
Anthropic 인프라 조직의 Staff Software Engineer로, 대규모 분산 시스템과 클라우드 인프라를 설계·운영하며 AI 모델 학습/서빙/보안을 뒷받침하는 역할입니다. Kubernetes, AWS/GCP, IaC 기반의 인프라 프로젝트를 주도하고, 연구·제품팀과 협업해 확장성·신뢰성·보안성을 높이는 것이 핵심입니다.
주요 업무
대규모 인프라 프로젝트의 범위 설정 및 리드, 아키텍처 의사결정 수행, 팀 간 기술 방향성 정렬, 연구·제품팀의 인프라/컴퓨팅 요구를 기술 설계로 전환, 시스템의 신뢰성·확장성·보안성 책임, 인프라 기술 전략 및 표준 수립, incident response/postmortems/on-call 등 운영 프로세스 개선, 다른 엔지니어 멘토링 및 기술 수준 향상.
자격 요건
필수: 대규모 분산 시스템 또는 인프라를 프로덕션에서 설계·구축·운영한 경험, 모호한 문제를 포함한 복잡한 멀티먼스 기술 프로젝트를 독립적으로 정의하고 완료한 경험, 다른 엔지니어와 팀이 의존하는 아키텍처 결정을 내린 경험, Python/Rust/Go/Java 중 최소 1개 언어에 대한 강한 소프트웨어 엔지니어링 역량, Kubernetes 및 AWS/GCP 기반 인프라-as-code 경험, 팀/이해관계자 간 정렬을 이끄는 뛰어난 문서·구두 커뮤니케이션 능력. 우대: 10년 이상 소프트웨어 엔지니어링 경력, GPU/TPU/Trainium 및 NCCL 등 ML 인프라 경험, Linux kernel tuning 또는 eBPF 같은 저수준 시스템 경험, 보안/프라이버시 엔지니어링 베스트 프랙티스 경험, 기술 리드 또는 멘토 경험.
기술 스택
PythonRustGoJavaKubernetesAWSGCPinfrastructure-as-codeGPUTPUTrainiumNCCLLinuxeBPF
Anthropic의 다른 공고
Repairs Program Lead - Data Center Operations
인프라·DevOps, 하드웨어·임베디드, 경영지원Product Engineer - Manufacturing Operations
하드웨어·임베디드Data Center Sourcing Manager
경영지원, 현장운영Staff + Sr. Software Engineer, Scaling
개발, 인프라·DevOps, AI·머신러닝Regional Manager EMEA, Data Center Capacity Delivery
현장운영Global Supply Manager - Contract Manufacturing
현장운영, 경영지원Reporting and Controls Lead, Data Center Capacity Delivery
경영지원Environmental Health & Safety Manager, Data Center Construction and Operations
현장운영