Aurora PostgreSQL, DuckDB 내장으로 Iceberg·Parquet 직접 조회 지원
AWS가 10월 1일 Aurora PostgreSQL에서 Iceberg·Parquet 데이터를 직접 조회하는 기능을 발표했다. DuckDB를 내장해 운영 데이터와 데이터 레이크를 한 SQL로 결합한다. 17.11·18.6 이상에서 지원하며 모든 상용·미국 GovCloud 리전에 제공된다. 별도 기능 요금 없이 추가 연산·S3 요청 비용이 발생한다.
AuroraAnalytics 기능의 IAM 역할을 연결하고 aurora_analytics 확장을 활성화한 뒤 외부 테이블을 만든다.
AWS Glue Data Catalog·S3·S3 Tables를 지원하며 외부 Iceberg REST 호환 카탈로그는 Glue 연동을 통해 조회한다.
커밋되지 않은 Aurora 쓰기 데이터도 데이터 레이크와 함께 조회할 수 있다.
조건 푸시다운·열 가지치기·캐시를 적용하며 쿼리별 S3 읽기량과 캐시 적중을 확인할 수 있다.
한 자릿수 밀리초 지연이 필요한 데이터는 Aurora 기본 테이블로 구체화할 수 있으며, 이 쓰기 작업은 writer에서 실행한다.
분석 쿼리를 읽기 복제본에서 실행할 수 있어, 데이터 복제 파이프라인을 없애면서 운영 DB의 분석 부하도 분리할 수 있다.