Server/NPU Infrastructure Engineer

제소업

IT

location_onGangseo-gu, 해외 Overseas
work_outline풀타임
work_outline직업 교육
acute정규직

링크 복사link

About Company:

국내 AI 반도체 기업 | DC 위치: 서울 강서구 마곡


자체 AI 반도체(NPU)와 소프트웨어, 서버·랙 단위 AI 인프라를 개발하는 기업에서 서버 인프라 엔지니어를 채용합니다.

NPU 서버의 설치와 구성 관리, 하드웨어 장애 대응을 담당하며, 데이터센터 현장에서 장비의 안정적인 운영을 지원하는 포지션입니다.


근무 조건

  • 근무지: 서울 강서구 마곡
  • 주간 현장 상주 근무
  • 야간·주말 팀 순환 On-Call 운영: 원격으로 1차 대응하며 필요 시 현장 출동
  • 오퍼레터 서명 후 4주 이내 입사 가능자

Key Competencies:

  • 서버 입고·랙 설치·이전·폐기 및 NPU 카드 장착·교체 등 장비 구성 작업
  • BIOS/BMC/Firmware 구성 관리 및 서버 호환성 검증
  • 온도·전력·팬·디스크·NPU 등 HW 상태 모니터링 및 알람 대응
  • 서버 HW 장애 진단, 부품 교체와 복구, 장애 등급별 대응 및 이력 관리
  • 제조사·유지보수 벤더와의 기술 커뮤니케이션 및 A/S·RMA 관리
  • 서버·부품의 재고, 시리얼, 랙 위치 등 자산 정보 관리
  • 정기 점검·결과 보고 및 비상대응·작업 절차서 작성·유지
  • 랙 공간과 전력 여유율 확인 및 인프라 증설 계획 수립 지원

An Ideal Candidate:

  • 서버 인프라 운영 경력 3년 이상~10년 미만
  • x86 서버 구성요소(CPU·메모리·PCIe·스토리지·전원)에 대한 이해와 HW 장애 처리 경험
  • IPMI/Redfish 등 BMC 기반 서버 원격 관리 경험
  • 데이터센터(IDC) 현장에서의 서버 설치·운영 경험
  • Linux 환경에서 로그 확인 및 HW 진단 도구를 활용할 수 있는 기본 운영 역량


우대 사항

  • GPU/NPU 등 가속기 서버 운영 경험
  • 수백 대 이상 규모의 서버 운영 경험
  • Prometheus·InfluxDB·Zabbix·Grafana 등 모니터링 시스템 구축·운영 경험
  • Bash/Python을 활용한 운영 자동화 경험
  • 서버 제조사·총판 대응 및 RMA 프로세스 경험


Ref: JN-092026-209899