포지션 상세
직무 Summary
넥스트증권 AI데이터플랫폼팀과 함께 금융 데이터의 원천부터 서빙까지를 책임질 데이터 엔지니어(경력)를 모집합니다. 종목·발행사·기업행사 등 금융 마스터 데이터와 계정계·채널계·내부 데이터를 수집·표준화하고, Databricks Delta Lake 기반 Bronze/Silver/Gold 파이프라인과 데이터 품질 체계를 구축합니다. 나아가 FIBO 등 금융 표준과 벤더 분류체계, 내부 데이터 모델을 연결하는 금융 온톨로지를 설계·운영하여, 검색·추천·RAG·데이터 포털이 공통으로 사용하는 의미 계층을 만듭니다. 데이터를 옮기는 일에서 그치지 않고 "이 데이터가 무엇을 뜻하는가"를 정의하는 자리입니다.
· 내부 데이터 수집·가공: 계정계·채널계·ERP 등 사내 시스템 데이터를 CDC 및 배치로 수집하고 분석 가능한 형태로 가공합니다.
· 레이크하우스 파이프라인 운영: Bronze→Silver→Gold 메달리온 파이프라인과 데이터 품질 체계를 구축하고, 재처리·백필과 데이터 신선도(freshness)를 관리합니다.
· 서빙·피처 데이터 제공: 검색·추천·랭킹이 사용하는 Gold·Feature·Serving 데이터셋을 설계하고 제공합니다.
· 금융 분류체계 설계: 종목·섹터·산업·테마·기업행사 등 금융 데이터의 분류체계(taxonomy)를 정의하고 버전을 관리합니다.
· 온톨로지 설계·운영: FIBO 등 금융 표준 온톨로지, 벤더 분류체계, 내부 데이터 모델을 연결하는 온톨로지를 설계하고 운영합니다.
· 식별자 매핑 관리: 종목코드·티커·ISIN·RIC 등 식별자와 금융 엔티티 간 매핑을 구축하고 정합성을 유지합니다.
· 활용 인터페이스 제공: 분류체계와 온톨로지를 검색·추천·RAG·데이터 포털이 쓸 수 있도록 테이블·API·그래프 형태로 제공합니다.
· 데이터 거버넌스: 데이터 계약(contract), 리니지, 품질 게이트와 온톨로지 버전·변경 이력을 관리합니다.
· 온콜 대응: 데이터 파이프라인 온콜 rotation에 참여합니다.
• Python 또는 Java 중 하나 이상의 프로그래밍 언어에 능숙하신 분
• SQL 활용 능력이 뛰어나고 데이터 모델링에 대한 깊은 이해를 갖추신 분
• Apache Kafka 기반 대규모 실시간 스트리밍 데이터 처리 경험이 있으신 분
• Apache Spark 또는 Databricks 등 대용량 데이터 처리 프레임워크 사용 경험이 있으신 분
• CDC(Change Data Capture) 파이프라인 구축 경험이 있으신 분 (Flink CDC, Debezium 등)
• AWS 등 퍼블릭 클라우드 환경에서 데이터 인프라 구축 및 운영 경험이 있으신 분
• RDBMS(Oracle, PostgreSQL 등)에 대한 이해가 있으신 분
넥스트증권 AI데이터플랫폼팀과 함께 금융 데이터의 원천부터 서빙까지를 책임질 데이터 엔지니어(경력)를 모집합니다. 종목·발행사·기업행사 등 금융 마스터 데이터와 계정계·채널계·내부 데이터를 수집·표준화하고, Databricks Delta Lake 기반 Bronze/Silver/Gold 파이프라인과 데이터 품질 체계를 구축합니다. 나아가 FIBO 등 금융 표준과 벤더 분류체계, 내부 데이터 모델을 연결하는 금융 온톨로지를 설계·운영하여, 검색·추천·RAG·데이터 포털이 공통으로 사용하는 의미 계층을 만듭니다. 데이터를 옮기는 일에서 그치지 않고 "이 데이터가 무엇을 뜻하는가"를 정의하는 자리입니다.
주요업무
· 금융 마스터 데이터 구축: 종목·발행사·증권유형·섹터·산업·테마·기업행사·경제지표 등 금융 마스터 데이터를 벤더 및 내부 원천에서 수집하고 표준화합니다.· 내부 데이터 수집·가공: 계정계·채널계·ERP 등 사내 시스템 데이터를 CDC 및 배치로 수집하고 분석 가능한 형태로 가공합니다.
· 레이크하우스 파이프라인 운영: Bronze→Silver→Gold 메달리온 파이프라인과 데이터 품질 체계를 구축하고, 재처리·백필과 데이터 신선도(freshness)를 관리합니다.
· 서빙·피처 데이터 제공: 검색·추천·랭킹이 사용하는 Gold·Feature·Serving 데이터셋을 설계하고 제공합니다.
· 금융 분류체계 설계: 종목·섹터·산업·테마·기업행사 등 금융 데이터의 분류체계(taxonomy)를 정의하고 버전을 관리합니다.
· 온톨로지 설계·운영: FIBO 등 금융 표준 온톨로지, 벤더 분류체계, 내부 데이터 모델을 연결하는 온톨로지를 설계하고 운영합니다.
· 식별자 매핑 관리: 종목코드·티커·ISIN·RIC 등 식별자와 금융 엔티티 간 매핑을 구축하고 정합성을 유지합니다.
· 활용 인터페이스 제공: 분류체계와 온톨로지를 검색·추천·RAG·데이터 포털이 쓸 수 있도록 테이블·API·그래프 형태로 제공합니다.
· 데이터 거버넌스: 데이터 계약(contract), 리니지, 품질 게이트와 온톨로지 버전·변경 이력을 관리합니다.
· 온콜 대응: 데이터 파이프라인 온콜 rotation에 참여합니다.
자격요건
• 5년 이상의 데이터 엔지니어 경력• Python 또는 Java 중 하나 이상의 프로그래밍 언어에 능숙하신 분
• SQL 활용 능력이 뛰어나고 데이터 모델링에 대한 깊은 이해를 갖추신 분
• Apache Kafka 기반 대규모 실시간 스트리밍 데이터 처리 경험이 있으신 분
• Apache Spark 또는 Databricks 등 대용량 데이터 처리 프레임워크 사용 경험이 있으신 분
• CDC(Change Data Capture) 파이프라인 구축 경험이 있으신 분 (Flink CDC, Debezium 등)
• AWS 등 퍼블릭 클라우드 환경에서 데이터 인프라 구축 및 운영 경험이 있으신 분
• RDBMS(Oracle, PostgreSQL 등)에 대한 이해가 있으신 분




