Jobs
크래프톤 로고

크래프톤

[AI Research Div.] ML Serving Engineer (5년 이상)

정규직(풀타임)대면근무AI·머신러닝인프라·DevOps

AI 요약

크래프톤 AI Research 본부의 MLSys & Ops 팀에서 대규모 LLM/딥러닝 모델을 안정적이고 비용 효율적으로 서빙할 서빙 엔지니어를 채용합니다. GPU 인프라 위에서 프로덕션 수준의 모델 서빙 아키텍처 설계·운영, 추론 가속화, 관측성/CI/CD 구축이 핵심입니다.

주요 업무

대규모 모델 서빙 아키텍처 설계 및 운영, 인게임 환경용 LLM 서빙 인프라 구축 및 운영 안정화, 코딩 에이전트 및 최신 딥러닝 모델 서빙/가속화, 공통 서빙 체계 수립, 모니터링·로깅·알람 등 관측성 시스템 구축, 무중단 배포/자동 롤백/테스트 자동화를 위한 CI/CD 및 GitOps 체계 설계, 추론 가속화 및 서빙 최적화 기술 연구·적용

자격 요건

실제 대규모 트래픽이 발생하는 프로덕션 환경에서 AI/LLM 모델 서빙 시스템을 설계·구축·운영한 경험이 있는 분. vLLM, TensorRT-LLM 등 고성능 LLM 추론 엔진 실무 적용 경험, KV Cache Offloading/Loading·PagedAttention·양자화 등 메모리/연산 효율화 경험, 장애 및 지연시간 이슈를 GPU 하드웨어까지 포함해 분석·개선한 경험, 모니터링/관측성 및 CI/CD 환경 구축 경험이 필요합니다. 해외 출장에 결격 사유가 없어야 합니다.

기술 스택

vLLMTensorRT-LLMPyTorch DynamoFlashInferNVIDIA TritonCUDAFP8INT4PagedAttentionContinuous BatchingGitOpsCI/CDObservabilityGPU
AI 점수 95core

크래프톤의 다른 공고

알림

알림이 없습니다