Pepelen
Аналитика данных с нуля: SQL, таблицы и метрики

Lesson

Урок 3: Сортировка, фильтры и сводные таблицы

Выбирать между сортировкой, фильтром и сводной таблицей для агрегации и описывать корректный порядок построения сводной.

1 / 6

Три инструмента анализа данных в таблицах

Три инструмента анализа данных в таблицах

Когда данные уже собраны в таблицу, для их анализа чаще всего используют три инструмента: сортировку, фильтр и сводную таблицу (pivot table). Сортировка упорядочивает строки по значению выбранного столбца — по возрастанию или убыванию. Это удобно, чтобы быстро найти топ-N записей: отсортировал по выручке убыванием — и первые строки это самые крупные клиенты. Фильтр скрывает строки, не соответствующие условию, но не удаляет их из таблицы — данные остаются, просто не видны. Именно здесь прячется типичная ошибка: если поверх отфильтрованных данных применить =СУММ(), она может посчитать только видимые строки или все — зависит от функции. Всегда проверяйте, что итоги не расходятся из-за скрытых строк. Сводная таблица (pivot table) — самый мощный инструмент: она автоматически группирует строки по выбранному полю и вычисляет агрегат (сумму, среднее, количество и т.д.) для каждой группы. Это табличный аналог SQL-запроса GROUP BY из юнита 4: вместо написания формул вы просто перетаскиваете поля в нужные зоны. Типичная ошибка — выбрать не ту метрику (например, Count вместо Sum) и получить количество строк вместо суммы выручки. Правило выбора инструмента: нужно сравнить показатели по категориям — сводная таблица; нужно найти топ или минимум — сортировка; нужно временно посмотреть на срез данных (например, только один регион) — фильтр. Порядок построения сводной: выделить данные → вставить сводную таблицу → выбрать строки (категории) → выбрать значения (метрика и агрегат) → проверить результат.
Lesson notes
Три инструмента анализа данных в таблицах
Когда данные уже собраны в таблицу, для их анализа чаще всего используют три инструмента: сортировку, фильтр и сводную таблицу (pivot table). Сортировка упорядочивает строки по значению выбранного столбца — по возрастанию или убыванию. Это удобно, чтобы быстро найти топ-N записей: отсортировал по выручке убыванием — и первые строки это самые крупные клиенты. Фильтр скрывает строки, не соответствующие условию, но не удаляет их из таблицы — данные остаются, просто не видны. Именно здесь прячется типичная ошибка: если поверх отфильтрованных данных применить =СУММ(), она может посчитать только видимые строки или все — зависит от функции. Всегда проверяйте, что итоги не расходятся из-за скрытых строк. Сводная таблица (pivot table) — самый мощный инструмент: она автоматически группирует строки по выбранному полю и вычисляет агрегат (сумму, среднее, количество и т.д.) для каждой группы. Это табличный аналог SQL-запроса GROUP BY из юнита 4: вместо написания формул вы просто перетаскиваете поля в нужные зоны. Типичная ошибка — выбрать не ту метрику (например, Count вместо Sum) и получить количество строк вместо суммы выручки. Правило выбора инструмента: нужно сравнить показатели по категориям — сводная таблица; нужно найти топ или минимум — сортировка; нужно временно посмотреть на срез данных (например, только один регион) — фильтр. Порядок построения сводной: выделить данные → вставить сводную таблицу → выбрать строки (категории) → выбрать значения (метрика и агрегат) → проверить результат.
Урок 3: Сортировка, фильтры и сводные таблицы — Аналитика данных с нуля: SQL, таблицы и метрики