요약
- 게시일 2025-08-12 · slug
boostcourse-sql · 카테고리 "컴퓨터공학 공부 / 데이터 · SQL · 시스템" · 한국어·영어 병기 - Pandas groupby가 느려지는 시점에 "그 연산은 DB에서 끝내야 한다"는 문제의식으로 SQL을 AI 엔지니어 관점에서 다시 정리한 글.
- JOIN/GROUP BY(학습 데이터셋 뷰 만들기), 윈도우 함수 LAG/LEAD/RANK(DB 단 시계열·순위 피처 — 예: 직전 주문 이후 경과 시간), 서브쿼리/CTE(복잡도 단계화)를 다룬다.
- 워크플로우 변화: 피처 엔지니어링의 중심이 DB로 이동, GROUP BY/COUNT로 EDA가 빨라짐, 스키마·파티션 단위로 문제를 짚는 커뮤니케이션.
- 결론: ML 엔지니어에게 SQL은 선택이 아니라 기본기.
등장하는 것
- (조직·프로젝트 링크 없음. slug는 부스트코스 계열이나 본문에 강의명 명시 없음 — 확인 필요)
연결
- Writing
- 원자 노트: Q — Coursera 수료증 2건의 정체와 등재 여부는 (Deep Learning 시작월·Machine Learning Specialization)
- 개념: SQL · i18n 다국어 · 기술 블로그 운영 · 데이터 파이프라인 · 시계열 · 피처 엔지니어링