
Anthropic
[Expression of Interest] Research Engineer / Scientist, Alignment - London
개발AI·머신러닝연구·R&D
AI 요약
Anthropic에서 런던 기반의 Alignment Science 팀 리서치 엔지니어를 채용합니다. 강력한 AI 시스템의 안전성과 정렬(Alignment)을 보장하기 위한 실험적 연구를 수행하며, AI 제어 및 스트레스 테스트 등을 통해 모델의 잠재적 위험을 분석하고 개선하는 핵심적인 역할을 담당합니다.
주요 업무
AI 안전 및 정렬을 위한 머신러닝 실험 설계 및 실행; AI 제어 및 정렬 스트레스 테스트 방법론 개발; 다중 에이전트 강화학습 실험 수행; LLM 평가 도구 및 스크립트 작성; 연구 논문, 블로그 포스트 및 발표 자료 기여; 책임 있는 확장 정책(Responsible Scaling Policy) 설계 및 구현 지원.
자격 요건
상당한 수준의 소프트웨어, ML 또는 리서치 엔지니어링 경험; 실증적 AI 연구 프로젝트 참여 경험; 기술적 AI 안전 연구에 대한 이해도; 협업 중심의 프로젝트 선호; (우대) ML/NLP/AI 안전 분야 논문 저자 경험; LLM 및 강화학습(RL) 경험; Kubernetes 클러스터 및 복잡한 공유 코드베이스 활용 능력; 관련 분야 학사 학위 이상 또는 그에 준하는 경력.
기술 스택
MLNLPLLMReinforcement LearningKubernetesPython
Anthropic의 다른 공고
Manager, Applied AI Architect, Enterprise Tech
Regional Manager APAC, Data Center Capacity Delivery
Applied AI Engineer, Beneficial Deployments (Life Sciences)
Data Center Energy Lead, EMEA
Energy Scheduling & Portfolio Lead
Platform Security Engineer, DRTM / Secure Launch
US Regional Manager, Data Center Capacity Delivery
Supply Chain Delivery Manager, Data Center Power & Cooling OFE