그룹바이
그룹바이
미리디 로고
미리디
93.7도
서울 구로구450인 ‧ Series BSW/App ‧ UX/UI ‧ 산업디자인 ‧ 브랜드/패키지 디자인
미리디는 디자인과 관련된 모든 문제를 해결하는 [디자인 올인원 플랫폼] 을 향해 나아가고 있습니다.
미리디는 디자인과 관련된 모든 문제를 해결하는 [디자인 올인원 플랫폼] 을 향해 나아가고 있습니다.
유연근무
행복개발비
아침 도시락
점심 포인트
제휴 카페 포인트
3년 리프레시
업무 비용 100%
도서 구입 무제한

[미리디] Data Engineer

빠른 응답
성실 검토
포지션데이터 엔지니어
경력 구분경력 3~6년
특이사항CTO 있음, 원격근무 없음

스킬

Kafka
Spark
Kubernetes
AWS
SQL

주요업무

| ​팀 ​소개

데이터 엔지니어링 팀이 어떤 문제를 풀고 있는지 궁금하다면?

-> 데이터 엔지니어링팀 알아보기


Data ​Engineering 파트는 ​Kafka/Debezium 기반 CDC 스트리밍 ​파이프라인과 ​Airflow·Databricks·DuckDB(Arrow) 기반 ​배치 파이프라인으로 사내 ​여러 서비스의 ​데이터를 ​수집하고, 256TB ​이상 ​규모의 ​Databricks Delta Lake ​기반 ​데이터 레이크하우스에 적재·운영합니다.

이를 ​통해 ​전사가 신뢰하고 즉시 ​활용할 수 ​있는 ​분석 데이터의 ​기반을 만들어 ​가고 ​있습니다.


현재는 Silver·Gold 레이어의 ​마트 테이블과 ​워크플로를 재설계해 마트 데이터의 접근성과 신뢰도를 높이고 있습니다. 마트의 변환·검증·배포 과정을 CI/CD로 표준화해 품질 문제를 배포 전에 선제적으로 걸러내고, 정합성·freshness 지표를 상시 모니터링하는 품질 관리 체계를 갖춰 가고 있습니다.

동시에 Unity Catalog 기반 접근 제어와 개인정보 마스킹, 메타데이터·데이터 리니지 관리를 통해 데이터 거버넌스를 강화하고 있습니다. 이렇게 정비한 마트와 메타데이터는 사람뿐 아니라 Agent도 정확히 이해하고 활용할 수 있는 분석 기반이 됩니다.

이를 바탕으로 미리디 구성원 누구나 Agent를 통해 쉽게 데이터를 분석할 수 있는 환경을 만들고, Agent 기반 마트 생성 자동화와 셀프 서비스 환경도 함께 구성하고 있습니다.


데이터 플랫폼의 활용 범위도 넓혀 가고 있습니다. 미리캔버스에서 매일 2억 건 이상 발생하는 사용자 행동 로그를 수집하기 위해 Server-side GTM 기반 스트리밍 수집 인프라를 구축하고, 실시간으로 수집된 데이터를 분석하는 실시간 분석 시스템을 개발하고 있습니다.

또한 80억 건 이상 적재된 비정형 디자인 에셋 데이터를 AI/ML 모델 학습과 디자인 데이터 분석에 쉽고 빠르게 활용할 수 있도록 비정형 데이터 레이크를 구성하는 것도 중요한 미션입니다.


Data Engineering 파트는 수집부터 적재, 모델링, 품질, 거버넌스, 서빙까지 데이터가 흐르는 전 과정을 설계·운영하며, 미리디 구성원 누구나 믿고 쓸 수 있는 데이터 기반을 책임지는 팀입니다.



| 입사 후 3개월 성장 목표

[1개월 차]

• 데이터 플랫폼, 수집 파이프라인, 거버넌스 운영에 필요한 지식을 익힙니다. 수집 지연·장애 같은 운영 이슈에 직접 1차 대응할 수 있는 수준이 됩니다.


[2개월 차]

• 신규 데이터 소스의 수집 파이프라인과 필요한 인프라를 혼자 설계하고 구현합니다. 리뷰를 거쳐 운영 환경에 배포하고 안정적으로 운영합니다.


[3개월 차]

• 담당 도메인의 수집부터 마트, 품질, 메타데이터까지 전 과정을 책임지고 운영합니다. 운영 중 발견한 문제 한 가지를 스스로 정의하고 개선합니다.



| 주요 업무

"미리디에서 이런 일들을 함께 하고 싶어요"

• 데이터 수집 파이프라인: CDC 스트리밍·배치 수집 파이프라인을 구축·운영하고, 신규 소스 연동과 수집 장애에 대응합니다.

• 데이터 레이크하우스 및 마트 모델링: Bronze·Silver·Gold 계층을 운영하고, 모델링 표준에 따라 마트를 설계·이관하며 변환·배포 CI/CD를 개선합니다.

• 데이터 품질 관리: 정합성·freshness·schema drift 지표를 모니터링해 데이터 문제를 소비 단계 이전에 탐지합니다.

• 데이터 거버넌스: Unity Catalog 기반 접근 제어와 개인정보 마스킹, 메타데이터·리니지를 관리하고 ISMS-P 요건에 맞는 데이터 환경을 운영합니다.

• 실시간 수집·분석 및 비정형 데이터 레이크: 사용자 행동 로그의 실시간 수집·분석 시스템과 디자인 에셋용 비정형 데이터 레이크를 구축합니다.

• Agent 기반 분석 환경 및 플랫폼 운영: 구성원이 Agent로 데이터를 분석하는 환경과 마트 생성 자동화를 개발하고, EKS 기반 데이터 플랫폼을 운영합니다.

자격요건

| 자격요건

"이런 분이라면 목표 달성에 확신을 얻을 것 같아요"

• 데이터 엔지니어링 또는 관련 분야에서 3년 이상의 경력 혹은 이에 준하는 역량을 갖추신 분

• 배치 또는 스트리밍 데이터 파이프라인을 직접 구축하고 운영해 보신 분

• Spark 등 분산 처리 프레임워크와 Airflow 등 워크플로 오케스트레이션 도구를 다뤄 보신 분

• 차원 모델링(grain, fact/dimension, SCD 등)을 바탕으로 데이터 웨어하우스/마트를 설계해 보신 분

• 파이프라인 장애나 데이터 이상을 원인까지 추적해 해결해 보신 분

• 현업의 데이터 요청을 요구사항으로 정리해 테이블·마트로 구현해 보신 분

우대사항

| 우대 사항

"이런 분이라면 장기적으로 서로에게 더 긍정적일 것 같아요!"

• Kafka, Debezium 등으로 CDC 기반 실시간 수집 파이프라인을 구축·운영해 보신 분

• Databricks·Delta Lake 또는 Iceberg 등 Open Table Format 기반 레이크하우스를 설계·운영해 보신 분

• ClickHouse, StarRocks 등 OLAP 엔진으로 대규모 로그 데이터의 실시간 분석 환경을 구축해 보신 분

• 이미지 등 대용량 비정형 데이터를 AI/ML 학습과 분석에 활용할 수 있도록 데이터 레이크를 구축해 보신 분

• 데이터 품질 검증 도구를 도입해 정합성·freshness·schema drift를 지표화하고 모니터링해 보신 분

• Unity Catalog, DataHub 등으로 데이터 거버넌스를 구성하거나 ISMS-P 요건에 맞춘 데이터 환경을 운영해 보신 분

• Kubernetes 환경에서 데이터 파이프라인과 관련 워크로드를 운영해 보신 분

• 팀과 적극적으로 소통하며 어려운 문제를 함께 풀어가시는 분

• 새로운 기술을 빠르게 익히고, 문제에 맞는 방법을 찾아 적용하시는 분

채용절차

| 기타 사항

  1. [서류 전형] - [기술 스크리닝] - [기술 및 역량 인터뷰] - [처우 협의] - [입사] 의 프로세스로 진행됩니다.
  2. 기술 스크리닝 : 1차 인터뷰 전, 직무와 관련된 실무 경험과 지식을 간단히 확인합니다. (온라인, 30분 내외)
  3. 서류는 원활한 검토를 위해 PDF 형식으로 제출 부탁 드립니다.
  4. 직급에 따라 인터뷰 후 레퍼런스 체크 전형이 추가될 수 있습니다.
  5. 입사 후 3개월의 수습 기간 및 수습 평가가 진행됩니다. (급여 100%)
  6. 서류 전형 결과 안내까지는 최대 2주, 인터뷰 결과 안내까지는 최대 3주가 소요됩니다.
  7. 여러 포지션에 동시에 지원해주시는 것은 가능하지만 동일한 포지션의 경우 최종 결과 안내를 받은 시점으로부터 6개월 후에 재지원이 가능합니다.

합류하면 얻을 수 있는 것

#성장_지원_복지#새로운_일에_도전#트렌디한_기술#스택_일치#직무_몰입도#사내_세미나#코드_리뷰#활발한_기술_논의#숙련된_시니어#리더로_성장

근무지

서울 구로구 디지털로31길 12, 태평양물산 8층, 13층, 14층, 17층, 1004호 (서울, 구로구)
이 채용 공고, 나랑 맞을까요?프로필을 등록하면, 이 공고와의 FIT을 진단해 드려요
내 구직 조건 만족도
83%
일치
프론트엔드React, TypeScript 외 2경력 4년서울 강남구전체 20명 이하CTO 있음
x
그룹바이에서 합격하면 취업축하금 30만원을 드려요!
✨ 그룹바이로 만난 기업에 합격하면 취업축하금 30만원을 드려요!
취업축하금 신청하기

관련 채용 공고

FDE (Forward Deployed Engineer) · 경력 3~10년
빠른 응답
Python
Git
SQL
LLM
아이지에이웍스(IGAWorks) 로고
아이지에이웍스(IGAWorks)
48.0도
서울 용산구75인 ‧ Series D 이상AI ‧ SaaS ‧ 빅데이터 ‧ B2B
아이지에이웍스는 AI · 머신러닝 기술을 활용해 마케팅과 비즈니스 혁신을 가능하게 하는 데이터 기업입니다.
아이지에이웍스는 AI · 머신러닝 기술을 활용해 마케팅과 비즈니스 혁신을 가능하게 하는 데이터 기업입니다.
시차 출퇴근제
리프레시 휴가
해피 런치
사내 카페테리아
힐링룸
리프레시 룸
도서 구매 지원
자녀 특별 휴가
피지컬 AI / 디지털 트윈 엔지니어 경력자 · 경력 5년 이상
Python
Unity
Pytorch
페블러스(Pebblous) 로고
페블러스(Pebblous)
49.5도
세종 반곡동22인 ‧ Pre-AAI ‧ SaaS ‧ 빅데이터 ‧ B2B
데이터셋 품질 평가와 개선을 위한 B2B SaaS 'Data Clinic'
데이터셋 품질 평가와 개선을 위한 B2B SaaS 'Data Clinic'
스톡옵션
유연근무제
창립일휴무
데이터 사이언티스트 (Data Scientist) · 경력 3~10년
Python
R
SQL
Machine Learning
아이지에이웍스(IGAWorks) 로고
아이지에이웍스(IGAWorks)
48.0도
서울 용산구75인 ‧ Series D 이상AI ‧ SaaS ‧ 빅데이터 ‧ B2B
아이지에이웍스는 AI · 머신러닝 기술을 활용해 마케팅과 비즈니스 혁신을 가능하게 하는 데이터 기업입니다.
아이지에이웍스는 AI · 머신러닝 기술을 활용해 마케팅과 비즈니스 혁신을 가능하게 하는 데이터 기업입니다.
시차 출퇴근제
리프레시 휴가
해피 런치
사내 카페테리아
힐링룸
리프레시 룸
도서 구매 지원
자녀 특별 휴가
AI 엔지니어 · 경력 전체
Python
Computer Vision
Deep Research
라스커 로고
라스커
74.0도
서울 강남구5인AI ‧ SaaS ‧ SW/App ‧ 영상제작 외 3
유튜브 크리에이터의 영상 편집 시간을 1/3로 줄여주는 AI 영상 편집 에이전트 PREPIX를 개발하고 있습니다.
유튜브 크리에이터의 영상 편집 시간을 1/3로 줄여주는 AI 영상 편집 에이전트 PREPIX를 개발하고 있습니다.
선택적 근로시간제
직무능력향상 지원
고사양 장비 지원
무제한 스낵바
생일 유급 반차
스톡옵션 제도
[(주)오믈렛] Forward Deployed Engineer (FDE) · 경력 3년 이상
Java
JavaScript
TypeScript
Python
Kubernetes
AWS
LLM
Cursor
RAG
오믈렛 로고
오믈렛
서울 강남구30인 ‧ Pre-AAI ‧ 빅데이터 ‧ SW/App ‧ B2B 외 1
AI-powered Innovative Decisions across Industries
AI-powered Innovative Decisions across Industries
재택근무
생일 축하금
자기계발비
체력단련비
[울산지사] Forward Deployed Robotics Engineer · 경력 3년 이상
C++
Python
플라잎 로고
플라잎
45.3도
경기 성남시40인 ‧ Series A로봇 ‧ B2B
Planning AI for the Better Future! Physical AI 기술로 완전 자율형 로봇의 미래를 설계합니다.
Planning AI for the Better Future! Physical AI 기술로 완전 자율형 로봇의 미래를 설계합니다.
선택적 근로시간제
점심시간 70분
리프레시 휴가
생일 조기 퇴근
인재 추천 인센티브
특허 보상금
(주)그룹바이HR | 서울특별시 영등포구 영등포로 150 C동 907, 908호대표 : 임진하 / 박상민사업자등록 : 333-88-02226유료직업소개업 등록번호 : 제 2005-3180270-14-5-00019호직업정보제공사업 신고번호 : J1200020230023문의 : hello_world@groupby.biz
instagramkakaotalkyoutube