에버엑스-[기술혁신실] MLOps Engineer
에버엑스-[기술혁신실] MLOps Engineer
에버엑스-[기술혁신실] MLOps Engineer
1/3
에버엑스서울 서초구경력 5-11년

[기술혁신실] MLOps Engineer

포지션 상세

[합류하게 될 팀에 대해 알려드려요]

"Bringing Personalized Rehabilitation to Everyone"이라는 Mission 아래, EverEx는 디지털 헬스케어 기술로 재활 치료의 패러다임을 바꾸고 있어요.

기술혁신실의 AI팀은 Human Pose Estimation 모델과 Multimodal LLM을 중심으로 사용자의 움직임을 정확하게 분석하고, 재활과 운동에 특화된 개인 맞춤형 피드백을 제공하고 있어요. 그리고 이 모든 것이 빠르고 안전하게 순환하도록 만드는 토대에는 MLOps 파트가 직접 만들어가는 두 개의 시스템이 있어요.

• FoundEx: 데이터 수집 요청부터 자동 수집, 저장, 가공/검수, 학습 데이터화까지 여러 내부 플랫폼을 연동해 데이터가 "학습 가능한 상태"로 흘러가게 만드는 데이터 파이프라인이에요.
• FlowEx: 데이터 관리 학습 실험 평가 배포로 이어지는 모델 라이프사이클 전체를 하나의 흐름으로 관리하는 학습·배포 관리 플랫폼이에요. 중복 실험을 방지하고, 데이터 정합성을 지키고, ISO/IEC 42001이 요구하는 데이터·모델 관리 기준을 시스템 수준에서 보장하는 것을 목표로 해요.

우리는 이 시스템들을 "AI 연구자가 모델에만 집중할 수 있는 환경"으로 완성하고, 나아가 수집 가공 학습 평가 배포 모니터링이 자동으로 순환하는 ML 파이프라인으로 발전시키려 해요. 이미 만들어진 플랫폼을 운영만 하는 것이 아니라, 파이프라인의 다음 단계를 직접 설계하고 주도할 MLOps Engineer를 찾고 있어요.

주요업무

• ML 파이프라인(FoundEx)을 고도화하고 운영해요. 영상/이미지 데이터의 수집 요청 자동 수집 스토리지(Ceph) 저장 가공/검수 annotation 등재까지 이어지는 이벤트 기반 워크플로우를 운영하고, 병목 구간의 자동화 수준을 높여요. Data Manager의 승인 워크플로우, 가공 도구 연동, Slack 알림 체계 등 여러 시스템의 연결 지점을 안정적으로 유지하는 역할이에요.
• 모델 라이프사이클 플랫폼(FlowEx)을 설계하고 발전시켜요. 데이터 관리 학습 실험 평가 배포로 이어지는 4개 보드의 워크플로우를 고도화해요. 데이터셋 버전 관리와 실험 추적으로 재현성을 보장하고, 배포 포맷(TFLite, CoreML) 변환을 자동화하고, 비개발 직군을 포함한 전사가 모델 성능을 확인할 수 있는 배포 보드를 발전시켜요. 웹 애플리케이션 개발은 Backend Engineer와 함께하고, MLOps는 스토리지 동기화, 실험 추적, 변환 자동화 등 ML 워크플로우와 파이프라인 로직을 책임져요.
• 배포 이후를 책임지는 모델 품질 모니터링 체계를 0부터 만들어요. 지금은 배포까지의 파이프라인이 잘 갖춰진 반면, 배포 이후는 계획 문서만 있는 초기 상태예요. 제품에 탑재된 모델로부터 성능을 추정할 수 있는 데이터가 아직 수집되지 않고 있거든요. 제품팀과 함께 On-device 환경(나아가 Serving 환경까지)과 개인정보 규제 제약 안에서 어떤 데이터를 수집할지 정의하는 것부터 시작해서, 수집 성능 추정 이상 탐지 알림 rollback으로 이어지는 피드백 루프 전체를 직접 설계하는 역할이에요.
• ML 인프라를 운영하고, 인프라 Observability를 구축해요. Multi-node on-prem GPU 클러스터와 스토리지를 운영하고 있어요. 그동안 Slurm 기반으로 운영해온 실험 환경을 Kubernetes 기반으로 전환하는 작업을 진행 중이고, 이 전환을 함께 완성하고 새 환경의 운영을 안정화하는 역할이에요. 문제를 사전에 탐지하고 대응할 수 있는 모니터링·알림 체계를 만들고, 실험 환경 표준화와 CI/CD 개선도 함께 해요.
• 헬스케어 규제 친화적인 거버넌스를 시스템으로 구현해요. ISO/IEC 42001(AIMS)이 요구하는 데이터·모델 관리 기준을 문서가 아닌 파이프라인으로 충족시키고, 재현 가능성(reproducibility)과 감사 추적성(auditability)을 시스템 수준에서 보장해요.
• 다양한 직군과 협업해요. AI Research Scientist/Engineer, Backend Engineer, Data Manager, Mobile Engineer, RA/QA와 긴밀히 협업하며, 연구 단계의 모델이 제품 환경까지 안전하게 도달하도록 연결하는 역할을 해요.

자격요건

• MLOps, ML Platform, DevOps, 백엔드 등 시스템 구축·운영 분야에서 5년 이상의 실무 경험이 있으신 분을 찾고 있어요.
• Python에 능숙하고, PyTorch 기반 딥러닝 모델의 학습·추론 파이프라인 구조를 이해하고 계신 분이면 좋아요. 모델을 직접 연구하지 않더라도, 연구자의 워크플로우를 시스템으로 옮길 수 있어야 해요.
• 서로 다른 시스템(스토리지, 데이터 가공 도구, 메시징/알림, 실험 관리 등)을 연동해 end-to-end 워크플로우를 자동화해본 경험이 있으신 분이면 좋아요. 우리의 파이프라인은 하나의 거대한 솔루션이 아니라 여러 플랫폼의 유기적인 연결로 이루어져 있어요.
• Docker와 Kubernetes 기반 환경에서 ML 워크로드를 직접 운영해보신 분이면 좋아요 (단순 사용을 넘어 리소스 관리·장애 대응 경험이 있다면 더 좋아요)
• 데이터·모델 버전 관리, 실험 추적, 모델 레지스트리 체계를 구축하거나 운영해본 경험(MLflow, W&B, DVC 등 도구 무관)이 있으신 분이면 좋아요.
• 진행 상황을 유기적으로 공유하고, 문서를 통해 소통하는 것에 익숙하신 분이면 좋아요. 특히, 규제 산업에서는 "기록되는 시스템"만큼 "기록하는 문화"도 중요해요.

기술 스택 • 툴

태그

마감일

상시채용

근무지역

서울 서초구 강남대로 311, 12층 에버엑스
본 채용정보는 원티드랩의 동의없이 무단전재, 재배포, 재가공할 수 없으며, 구직활동 이외의 용도로 사용할 수 없습니다.
본 채용 정보는 에서 제공한 자료를 바탕으로 원티드랩에서 표현을 수정하고 이의 배열 및 구성을 편집하여 완성한 원티드랩의 저작자산이자 영업자산입니다. 본 정보 및 데이터베이스의 일부 내지는 전부에 대하여 원티드랩의 동의 없이 무단전재 또는 재배포, 재가공 및 크롤링할 수 없으며, 게재된 채용기업의 정보는 구직자의 구직활동 이외의 용도로 사용될 수 없습니다. 원티드랩은 에서 게재한 자료에 대한 오류나 그 밖에 원티드랩이 가공하지 않은 정보의 내용상 문제에 대하여 어떠한 보장도 하지 않으며, 사용자가 이를 신뢰하여 취한 조치에 대해 책임을 지지 않습니다.
<저작권자 (주)원티드랩. 무단전재-재배포금지>

더 많은 포지션을 찾아 볼까요?

지원할 만한 매력적인 포지션들이 기다리고 있어요.