노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
노타(Nota)-[NetsPresso] AI Compiler Engineer
1/8
노타(Nota)서울 강남구경력 5년 이상

[NetsPresso] AI Compiler Engineer

포지션 상세

AI for everyone, everywhere
AI를 누구에게나, 어디에서나

노타는 AI 최적화 기술을 통해 AI의 일상화를 선도하는 기업입니다.

우리는 다양한 디바이스와 산업 전반에 걸쳐, 누구나 어디서나 AI를 사용할 수 있는 세상을 만들고자 합니다.

노타의 핵심 제품인 넷츠프레소(NetsPresso)는 하드웨어의 특성을 이해하는 AI 모델 최적화 플랫폼입니다. 또한, 차세대 영상 관제 솔루션 (NVA: Nota Vision Agent), 지능형 교통 시스템(ITS) 등 온디바이스 생성형 AI 솔루션을 통해 실제 산업 현장에서의 AI 실현 가능성을 넓히고 있습니다.

국내 스타트업으로는 최초로 삼성과 LG의 투자 유치 기록을 보유하고 있으며, 네이버 DS2F의 첫 투자 기업이기도 합니다. 최근에는 두바이 교통국과의 AI 솔루션 공급 계약을 체결하고, CB Insights AI 100에도 선정되는 등 글로벌 무대에서의 성과를 이어가고 있습니다.

노타는 빠르게 성장하는 조직과 함께할 다양한 직군의 노타 크루를 찾고 있습니다. 직급과 경력에 관계없이 누구나 동등한 입장에서 의견을 나눌 수 있는 수평적인 문화 속에서, 공동의 목표를 향해 자율적으로 일할 수 있는 분과 함께하고 싶습니다.

누구나, 어디에서나 AI의 가치를 경험할 수 있도록 하는 여정, 지금 노타에서 함께하세요.


우리 ​팀을 ​소개합니다.
NetsPresso Platform 팀은 Nota AI의 AI 모델 경량화 및 최적화 기술을 바탕으로, 연구·개발된 기술을 실제 제품으로 구현하여 사용자에게 제공하는 핵심 플랫폼과 소프트웨어를 설계·구현하는 조직입니다.
Model Representation, Quantization, Graph Optimization, Model Engineering, SW Engineering 파트로 구성되어 있으며, 그중 Model Representation Part는 다양한 딥러닝 프레임워크로부터 유입되는 모델들을 자사 고유의 통합 IR (Intermediate Representation)인 NPIR로 변환하여, Quantization, Graph Optimization, Compression 등의 최적화 기술을 적용 가능케 합니다.
• 다양한 프레임워크 모델을 자사 고유의 **NPIR**로 통합하여 기술적 범용성을 확보하며
• 최신 AI 모델들과 다양한 하드웨어를 지원 가능하도록 확장하고
• 딥러닝 모델의 논리적 구조를 타겟 런타임 환경에 최적화하여 실제 하드웨어에서의 추론 효율을 극대화 합니다.


​해당 포지션으로 합류하신다면
NetsPresso의 기반이 되는 통합된 IR을 제품화하는 과정에 참여합니다. 다양한 딥러닝 프레임워크와 하드웨어의 특성을 파악하고, 노타만의 고유한 IR(NPIR)을 설계하고 개발하는 데 기여하게 됩니다. 이 과정에서 On-device AI를 위한 다양한 경량화 및 최적화 기술이 실제 제품에 어떻게 적용되는지 경험하며, 최신 모델들이 다양한 하드웨어에서 효율적으로 구동될 수 있도록 기술적 문제를 해결해 나갑니다. AI 컴파일러 엔지니어로서 이론적인 연구 결과물을 실제 소프트웨어 스택으로 구현해내는 성취감을 느끼실 수 있습니다.


팀의 메세지
새로운 컴파일러 기술과 하드웨어 백엔드 최적화에 대한 높은 관심, 그리고 이를 실제 소프트웨어 스택으로 정교하게 구현해내는 실행력이 중요합니다. 이론적인 설계에 머물지 않고, NPIR이 다양한 하드웨어 백엔드(NPU, GPU 등)에서 최상의 성능을 낼 수 있도록 변환(Lowering)하고 최적화하는 과정을 제품화하는 포지션입니다. 하드웨어 아키텍처에 대한 이해를 바탕으로 타 파트와 긴밀하게 소통하는 주도적인 협업 태도를 중요하게 생각합니다. 복잡한 연산 스케줄링과 메모리 최적화 문제를 깊이 있게 파고들며, On-device AI의 기술적 한계를 하드웨어 단에서 돌파하고 싶은 분이라면 우리 팀에서 큰 성장을 이룰 수 있을 것입니다.

주요업무

• IR 구현 및 유지보수
- NPIR 그래프 구조 개발: 다양한 딥러닝 프레임워크의 다양한 모델 구조를 표현할 수 있는 NetsPresso Intermediate Representation (NPIR)의 데이터 구조를 구현하고 기능을 확장합니다.
- 프레임워크 변환 로직 개발: PyTorch, ONNX 등 다양한 프레임워크와 NPIR 간의 변환 로직을 구현하고 검증합니다.
• 하드웨어 친화적 IR 변환 및 로워링
- 백엔드 변환 로직 개발: NPIR을 ExecuTorch, TensorRT 등 타겟 런타임 및 하드웨어 전용 IR로 변환하는 로워링 패스를 구현합니다.
- 하드웨어 제약 기반 그래프 변환: 타겟 HW 오퍼레이터 및 제약 사항 분석, 컴파일러/Low-level IR 분석 기술을 기반으로 한 하드웨어 최적화 기술 연구 개발

자격요건

• 컴퓨터공학, 전자공학 등 관련 전공 학위를 소지하신 분
• Python 언어에 능숙하며, 객체 지향 프로그래밍(OOP) 및 클린 코드 작성이 가능하신 분
• PyTorch, ONNX, Python, Linux, Git/GitHub, Docker 경험을 보유하신 분
• 관련 분야 5년 이상의 경력을 지니신 분
• 해외 여행에 결격 사유가 없는 분

기술 스택 • 툴

태그

마감일

상시채용

근무지역

서울 강남구 테헤란로 521, 파르나스타워 16층 Nota
본 채용정보는 원티드랩의 동의없이 무단전재, 재배포, 재가공할 수 없으며, 구직활동 이외의 용도로 사용할 수 없습니다.
본 채용 정보는 에서 제공한 자료를 바탕으로 원티드랩에서 표현을 수정하고 이의 배열 및 구성을 편집하여 완성한 원티드랩의 저작자산이자 영업자산입니다. 본 정보 및 데이터베이스의 일부 내지는 전부에 대하여 원티드랩의 동의 없이 무단전재 또는 재배포, 재가공 및 크롤링할 수 없으며, 게재된 채용기업의 정보는 구직자의 구직활동 이외의 용도로 사용될 수 없습니다. 원티드랩은 에서 게재한 자료에 대한 오류나 그 밖에 원티드랩이 가공하지 않은 정보의 내용상 문제에 대하여 어떠한 보장도 하지 않으며, 사용자가 이를 신뢰하여 취한 조치에 대해 책임을 지지 않습니다.
<저작권자 (주)원티드랩. 무단전재-재배포금지>

더 많은 포지션을 찾아 볼까요?

지원할 만한 매력적인 포지션들이 기다리고 있어요.