포지션 상세
[우리팀을 소개합니다]
엔터프라이즈 AI 솔루션이 모든 고객 배포 환경에서 같은 품질로 동작하도록 책임지는 팀입니다.
금융기관·공공기관을 포함한 온프레미스 환경에 솔루션을 설치·배포하고, 반복되는 결함의 근본 원인을 개선합니다.
설치·구성 작업에 대한 표준과 자동화 프로세스를 구축합니다.
Claude Code, Codex 등 AI 도구가 표준 업무 환경입니다.
팀의 AI Platform Engineer로서 배포·운영 표준을 정의하는 포지션입니다.
솔루션 애플리케이션 계층의 배포 표준 설계 및 소유 — 설치 패키지, 환경별 구성, 업그레이드·롤백 절차
공통 인프라 표준화(TechOps와 공동) — PostgreSQL, Redis, Ingress, nvidia-device-plugin, 모니터링·로깅, 공용 컨테이너 이미지
Kubernetes·Docker 및 사용 중인 오픈소스의 보안 취약점 대응
함께 하는 일
고객 환경에서 발생한 장애의 인프라 계층 원인 규명 및 재발 방지 조치
GPU를 포함한 하드웨어 사양 산정과 배포 아키텍처 설계
워크로드 특성에 따른 파드 리소스 산정 및 클러스터 자원 배분
AI 모델 서빙·GPU 워크로드를 운영해보신 분 (vLLM, Triton, CUDA, nvidia-device-plugin 등)
Python 등으로 백엔드 개발 또는 운영 작업 자동화를 해보신 분
운영 중인 시스템에서 로그·메트릭을 근거로 원인 가설을 세우고 검증할 수 있는 분
엔터프라이즈 AI 솔루션이 모든 고객 배포 환경에서 같은 품질로 동작하도록 책임지는 팀입니다.
금융기관·공공기관을 포함한 온프레미스 환경에 솔루션을 설치·배포하고, 반복되는 결함의 근본 원인을 개선합니다.
설치·구성 작업에 대한 표준과 자동화 프로세스를 구축합니다.
Claude Code, Codex 등 AI 도구가 표준 업무 환경입니다.
팀의 AI Platform Engineer로서 배포·운영 표준을 정의하는 포지션입니다.
주요업무
주 업무: 배포·운영 표준화솔루션 애플리케이션 계층의 배포 표준 설계 및 소유 — 설치 패키지, 환경별 구성, 업그레이드·롤백 절차
공통 인프라 표준화(TechOps와 공동) — PostgreSQL, Redis, Ingress, nvidia-device-plugin, 모니터링·로깅, 공용 컨테이너 이미지
Kubernetes·Docker 및 사용 중인 오픈소스의 보안 취약점 대응
함께 하는 일
고객 환경에서 발생한 장애의 인프라 계층 원인 규명 및 재발 방지 조치
GPU를 포함한 하드웨어 사양 산정과 배포 아키텍처 설계
워크로드 특성에 따른 파드 리소스 산정 및 클러스터 자원 배분
자격요건
Linux 환경에서 서비스를 운영하고, Docker·Kubernetes 기반으로 배포·운영해보신 분AI 모델 서빙·GPU 워크로드를 운영해보신 분 (vLLM, Triton, CUDA, nvidia-device-plugin 등)
Python 등으로 백엔드 개발 또는 운영 작업 자동화를 해보신 분
운영 중인 시스템에서 로그·메트릭을 근거로 원인 가설을 세우고 검증할 수 있는 분


