Хранилища данных и бизнес-аналитика
Узнайте, как компании SaaS переносят операционные данные в хранилища и создают аналитические панели с помощью ETL/ELT, звёздных схем и агрегации.
«Хранилища данных и бизнес-аналитика» — бесплатный урок SaaS Architecture & Startup Engineering на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения SaaS Architecture & Startup Engineering, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс SaaS Architecture & Startup Engineering содержит 4 уроков всего.
Части этого урока еще не переведены и отображаются на английском.
OLTP vs OLAP
Your live app database is OLTP (transaction processing): fast small reads and writes. Analytics needs OLAP: large scans over historical data.
Running heavy analytics on the production database harms app performance, so we separate them.
The Data Warehouse
A data warehouse (Snowflake, BigQuery, Redshift) stores large volumes of historical data optimized for analytical queries.
It is the single source of truth for reporting across the whole SaaS business.
ETL vs ELT
Two patterns move data into the warehouse:
- ETL — Extract, Transform, then Load (transform before storing)
- ELT — Extract, Load, then Transform (load raw, transform inside the warehouse)
Modern cloud warehouses favor ELT because they have cheap, powerful compute.
Extracting Data
Extraction pulls data from sources: the app database, event streams, and third-party APIs. It can be a full reload or an incremental pull of only changed rows.
Incremental extraction scales far better as data grows.
The Star Schema
Warehouses model data as a star schema: a central fact table (measurable events) surrounded by dimension tables (descriptive context like date, user, product).
Facts and Dimensions
A fact row records a measurable event with numeric measures and foreign keys to dimensions.
-- fact_sales
-- sale_id, date_key, product_key, customer_key, amount
SELECT SUM(amount)
FROM fact_sales
JOIN dim_date USING (date_key)
WHERE dim_date.year = 2026;Aggregation and Roll-Ups
BI queries aggregate facts: sum revenue by month, count signups by plan, average usage by region.
Pre-computed roll-up tables or materialized views speed up frequently used aggregations.
SELECT plan, COUNT(*) AS signups
FROM fact_signups
GROUP BY plan;Business Intelligence Dashboards
BI tools (Looker, Metabase, Tableau) sit on top of the warehouse and let non-engineers explore data through charts and dashboards.
This democratizes data access across the company.
Tenant Isolation in Analytics
In multi-tenant SaaS, analytics must respect tenant boundaries. Internal dashboards may span all tenants, but customer-facing analytics must filter strictly by tenant ID.
A leak here exposes one customer's business data to another.
Data Freshness vs Cost
Warehouses can update in batches (hourly, nightly) or near real-time via streaming. More freshness costs more compute.
Match the refresh rate to the decision: executive reports rarely need second-by-second data.
Data Quality and Governance
Bad data leads to bad decisions. Apply data quality checks (no nulls in keys, totals reconcile) and governance (access control, documentation) so the warehouse stays trustworthy.
Trust in the numbers is the whole point of BI.
Quick Check
Test your data warehousing knowledge.
Recap
You learned data warehousing and BI:
- OLTP vs OLAP and why to separate them
- ETL vs ELT pipelines with incremental extraction
- Star schemas (facts and dimensions), aggregation, and BI dashboards
- Tenant isolation, freshness/cost trade-offs, and data quality
Изучай SaaS Architecture & Startup Engineering с ИИ-репетитором — бесплатно
Пиши и запускай код прямо в браузере, получай мгновенную помощь от ИИ-репетитора 24/7 и продолжи учиться на сайте или в приложении.
- Курсы
- 12
- Уроки
- 48
Часто задаваемые вопросы
Урок «Хранилища данных и бизнес-аналитика» бесплатный?
Да — полный текст урока «Хранилища данных и бизнес-аналитика» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс SaaS Architecture & Startup Engineering, подпишись на CoddyKit PRO. Курс SaaS Architecture & Startup Engineering содержит 4 уроков всего.
Чему я научусь в уроке «Хранилища данных и бизнес-аналитика»?
Узнайте, как компании SaaS переносят операционные данные в хранилища и создают аналитические панели с помощью ETL/ELT, звёздных схем и агрегации. Ты практикуешь SaaS Architecture & Startup Engineering с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.
Нужен ли мне опыт, чтобы начать SaaS Architecture & Startup Engineering?
Предыдущий опыт не требуется. SaaS Architecture & Startup Engineering на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.
Сколько времени занимает урок «Хранилища данных и бизнес-аналитика»?
Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.
Можно ли писать и запускать код в этом уроке SaaS Architecture & Startup Engineering?
Да. Каждый урок SaaS Architecture & Startup Engineering включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.
Все уроки этого курса
- Конвейеры данных для аналитики
- Интеграция сервисов искусственного интеллекта и машинного обучения
- Переключатели функций и A/B-тестирование
- Хранилища данных и бизнес-аналитика