Medallion Architecture란?

메달리온 아키텍처는 레이크하우스나 데이터 레이크를 계층으로 나누는 설계 패턴입니다. 브론즈 계층에는 원천 시스템에서 들어온 데이터를 그대로 둡니다. 실버 계층에서는 데이터를 정리하고 중복을 없애 일관된 테이블로 맞춥니다. 골드 계층에서는 보고서, 분석, 머신러닝 특성처럼 특정 용도에 맞게 테이블을 다시 구성합니다. 각 계층은 바로 앞 계층의 데이터로 만들어지므로, 골드 테이블에서 그 바탕이 된 원천 레코드까지 거슬러 올라갈 수 있습니다.

예를 들어 한 유통사는 원본 판매 시점(POS) 파일을 브론즈에, 대조를 마친 거래 내역을 실버에, 매장별 일일 매출 테이블을 골드에 둘 수 있습니다. 이 패턴은 데이터를 다듬는 순서를 정리할 뿐, 특정 AI 업무에 맞는 데이터를 보장하지는 않습니다. 대시보드에 맞춘 처리 단계에서 모델에 필요한 드문 사건, 자유 서술 텍스트, 레코드 단위 세부 정보가 빠질 수 있습니다. 그래서 AI용으로 데이터를 준비하는 팀은 해당 용도 기준으로 각 계층에서 무엇이 남고 무엇이 빠지는지 확인합니다.

자주 묻는 질문

메달리온 아키텍처는 ETL입니까, ELT입니까?

둘 다 쓸 수 있습니다. 대부분은 원천 데이터를 먼저 브론즈 계층에 적재한 뒤 플랫폼 안에서 변환하므로 ELT 방식에 가깝습니다. 계층은 특정 도구가 아니라 데이터를 다듬는 단계를 뜻합니다.

메달리온 아키텍처를 쓰는 이유는 무엇입니까?

원천·정리·업무용 데이터를 분리할 수 있습니다. 파이프라인 문제를 찾기 쉬워지고, 로직이 바뀌면 원천 데이터부터 다시 처리할 수 있으며, 데이터를 쓰는 쪽마다 읽을 계층이 분명해집니다.

골드 계층 데이터는 AI에 바로 쓸 수 있습니까?

반드시 그렇지는 않습니다. 골드 테이블은 보통 보고서용으로 만들어집니다. AI 업무에는 앞 단계에서 걸러진 세부 정보나 드문 사례가 필요할 수 있으므로, 쓸 수 있는지는 데이터가 맡을 업무에 따라 달라집니다.