Jobs
파두 로고

파두

AI Infrastructure Operations Engineer

정규직(풀타임)대면근무AI·머신러닝개발인프라·DevOps

AI 요약

사내 On-Premise AI Infrastructure와 AI Service를 운영하며, GPU 서버/LLM 서빙/RAG·Knowledge Graph/모니터링·CI/CD를 담당하는 AI 인프라·서비스 운영 포지션입니다.

주요 업무

On-Premise AI Infrastructure 운영, GPU 서버(H200/B300/DGX Spark 등) 운영 및 리소스 스케줄링, LLM·Embedding·Reranker 모델 GPU 배치 및 서빙 파이프라인 관리, 서빙 성능/가용성/SLA 모니터링 및 튜닝, GPU utilization 최적화 및 인프라 확장, 장애 대응 및 RCA 수립, 용량 계획 및 비용 최적화, RAG·Knowledge Graph 서버 운영, AI Chat·AI Search 서비스 SLA 관리 및 사용성 개선, Retrieval/Agent 응답 품질 모니터링, AI 서비스 배포 자동화(CI/CD) 및 무중단 배포/롤백 운영, 모니터링 대시보드·알림 체계 구축, 운영 매뉴얼 작성 및 신규 서비스 온보딩 지원

자격 요건

컴퓨터공학/전기전자공학/AI·Data Science 관련 전공 학사 이상, 3년 이상의 AI·ML system/backend/대규모 서비스 SW 개발 경력, 전문적인 Python 개발 역량, Linux 및 container(Docker) 실무 경험, LLM·RAG·Agent 중 하나 이상에 대한 실제 서비스 구축 또는 운영 경험

기술 스택

PythonLinuxDockerGPULLMRAGAgentvLLMSGLangTensorRT-LLMTGIOllamaCUDAcuDNNNCCLMIGNVLinkMilvusQdrantWeaviatepgvectorNeo4jLangSmithPhoenixRagasDeepEvalGitJiraConfluenceCI/CD
AI 점수 95AI 핵심 직무

파두의 다른 공고

알림

알림이 없습니다