에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
에이아이트릭스(AITRICS)-AI Engineer
1/7
에이아이트릭스(AITRICS)∙서울 강남구∙경력 3-8년

AI Engineer

포지션 상세

[Omni-Care, Powered by AI]
'인공지능 기술로 사람의 생명을 살릴 수 있을까?'라는 질문에서 에이아이트릭스는 시작됐습니다. 우리는 인공지능 기술을 통해 의료의 한계를 뛰어넘을 수 있다면, 더 많은 사람들에게 보다 나은 의료 서비스를 제공할 수 있다고 생각합니다.
우리는 최고의 인공지능 역량을 바탕으로 의료 서비스의 질을 개선하고 환자의 건강을 보호하며, 의료진의 업무 효율성을 높이기 위해 최선을 다할 것입니다.


[About the Position]
AI Engineering 팀은 AI가 실제 의료 현장에서 안정적이고 효율적으로 동작하도록 만드는
엔지니어링을 담당합니다.
에이아이트릭스에서는 Research, Backend, AI Engineering이 각각 전문 영역을 가지고 협업합니다.
• Research가 새로운 모델과 AI 기술을 연구하고 개발한다면,
• Backend는 제품과 서비스의 비즈니스 로직 및 백엔드 시스템을 개발하고,
• AI Engineering은 모델이 실제 서비스 환경에서 빠르고 안정적으로 실행되고, 다양한
제품에서 활용될 수 있도록 AI Runtime과 Serving Platform을 설계하고 구축합니다.
저희는 모델 학습부터 배포, 추론, 모니터링까지 AI 시스템의 전체 생명주기를 다루며, Research 단계의 기술을 실제 Production 환경으로 연결합니다.
최근에는 LLM을 비롯한 다양한 AI 모델의 효율적인 추론 환경뿐만 아니라, AI Agent를 개발하고 실행하기 위한 공통 플랫폼과 Runtime을 만들고 있습니다.
단순히 이미 만들어진 기술을 조합하는 것이 아니라, “어떻게 하면 AI를 더 빠르고, 안정적이고, 확장 가능하게 제품화할 수 있을까?” 라는 문제를 해결하는 팀입니다.
모델과 소프트웨어, GPU 인프라의 경계를 넘나들며 AI 시스템의 핵심 기반을 직접 만들어보고 싶은 분을 찾습니다.

주요업무

1. AI Serving
• Python / Go 기반 AI Serving System 개발
• LLM 및 Deep Learning 모델의 Serving Architecture 설계 및 고도화
• vLLM 등 LLM Serving Engine을 활용한 추론 시스템 구축
• Latency / Throughput / GPU Memory를 고려한 추론 성능 최적화
• 다양한 AI 모델을 일관된 방식으로 배포하고 운영할 수 있는 Serving Platform 개발 GPU 자원의 효율적인 활용을 위한 Scheduling 및 Runtime 최적화

2. AI Platform & Runtime
• 모델 배포, 버전 관리, 모니터링 등 AI Model Lifecycle을 위한 플랫폼 개발
• Research에서 개발된 모델을 실제 Production 환경으로 연결하기 위한 Engineering
• 다양한 제품에서 AI 기능을 쉽게 활용할 수 있도록 공통 Interface 및 Runtime 설계
• AI 서비스의 성능, 안정성 및 Observability 개선

3. Agent Platform
• AI Agent 개발·실행·운영을 위한 공통 플랫폼 설계 및 구축
• LLM, Tool, Workflow를 연결하는 Agent Runtime 개발
• Agent 실행 과정의 상태 관리, 추적 및 모니터링 시스템 개발
• 다양한 Agent를 제품에 안정적으로 적용할 수 있는 실행 환경 및 개발 도구 구축

자격요건

• Python을 능숙하게 사용하고 실제 서비스 수준의 시스템을 개발해 보신 분
• PyTorch 등 Python 기반 Deep Learning Framework를 이용해 모델을 학습하거나 활용해 보신 분
• LLM 또는 Deep Learning 모델의 추론 서비스를 직접 설계하고 운영해 보신 분
• vLLM 등 LLM Serving Framework를 사용해 보신 분
• 모델 Serving 과정에서 Latency, Throughput, GPU Memory 등의 성능 특성을 이해하고 개선해 보신 분
• 모델 뿐 아니라 이를 실행하는 Software/System 영역까지 관심을 가지고 문제를 해결하시는 분

기술 스택 • 툴

태그

마감일

상시채용

근무지역

서울 강남구 테헤란로98길 8, KT&G 대치타워 4층, 5층
본 채용정보는 원티드랩의 동의없이 무단전재, 재배포, 재가공할 수 없으며, 구직활동 이외의 용도로 사용할 수 없습니다.
본 채용 정보는 에서 제공한 자료를 바탕으로 원티드랩에서 표현을 수정하고 이의 배열 및 구성을 편집하여 완성한 원티드랩의 저작자산이자 영업자산입니다. 본 정보 및 데이터베이스의 일부 내지는 전부에 대하여 원티드랩의 동의 없이 무단전재 또는 재배포, 재가공 및 크롤링할 수 없으며, 게재된 채용기업의 정보는 구직자의 구직활동 이외의 용도로 사용될 수 없습니다. 원티드랩은 에서 게재한 자료에 대한 오류나 그 밖에 원티드랩이 가공하지 않은 정보의 내용상 문제에 대하여 어떠한 보장도 하지 않으며, 사용자가 이를 신뢰하여 취한 조치에 대해 책임을 지지 않습니다.
<저작권자 (주)원티드랩. 무단전재-재배포금지>

더 많은 포지션을 찾아 볼까요?

지원할 만한 매력적인 포지션들이 기다리고 있어요.