Исходный размер 1140x1600

Что ищет мир?

PROTECT STATUS: not protected

Идея и концепция

Исходный размер 1536x1024

Предмет исследования

Проект анализирует данные Google Trending Now как индикатор краткосрочного информационного интереса. Авторы GoogleTrendArchive описывают Trending Now как источник запросов, переживающих рост поисковой активности в реальном времени. Архив содержит идентификатор тренда, географию, временные метки, длительность, диапазон поискового объёма и связанные запросы.

Термин «коллективное внимание» используется в проекте как аналитическая рамка. Он не является отдельной переменной датасета. В проекте внимание операционализировано через четыре измеряемых показателя:

  1. количество эпизодов Trending Now;
  2. продолжительность эпизода в часах;
  3. число стран, в которых встречается тематическая группа;
  4. сумму нижних границ поискового объёма.

С какой целью выбрана тема?

Google Trending Now позволяет исследовать не только содержание запросов, но и временную и географическую структуру их распространения. Данные содержат время начала и окончания тренда, географический код и диапазон поискового объёма. Поэтому на их основе можно сравнивать скорость появления, продолжительность и географический охват поисковых всплесков.

Цель проекта — описать временную и географическую структуру поисковых всплесков:

  • сколько эпизодов фиксируется в разные даты;
  • как долго запросы остаются в Trending Now;
  • какие страны и месяцы дают наибольшие агрегированные значения;
  • насколько широко распространяются выбранные тематические группы.

Исследовательские вопросы

Как распределена длительность поисковых эпизодов? Насколько неравномерно количество эпизодов изменяется по дням? Какие страны имеют наибольшую сумму нижних границ поискового объёма? Какие выбранные тематические группы встречаются в наибольшем числе стран? Какие ограничения необходимо учитывать при интерпретации этих показателей?

Польза инфографики

Инфографика объясняет, что разные показатели поискового интереса нельзя считать взаимозаменяемыми. Большой поисковый объём не обязательно означает длительное присутствие темы, а широкий географический охват не означает одинаковую популярность во всех странах.

Проект также показывает ограничения Google Trends. Поисковый всплеск отражает информационный интерес, но не является показателем общественного мнения, поддержки или объективной важности события.

Исходные данные и их источник

Основной источник — открытый датасет Google Trend Archive: Global Real-Time Search Trends, подготовленный Aleksandra Urman, Anikó Hannák и Joachim Baumann. Датасет опубликован по лицензии CC BY 4.0 и разрешает переработку и визуализацию данных при указании авторства.

Данные собраны автоматизированным мониторингом страниц Google Trends Trending Now по доступным географическим локациям. Научная публикация об архиве описывает его как историческую коллекцию данных Trending Now, которые в интерфейсе Google доступны ретроспективно только за ограниченный период. Первая опубликованная версия содержала более 7,6 млн эпизодов, 125 стран и 1 358 локаций за период с 28 ноября 2024 года по 3 января 2026 года.

В проекте использован более поздний файл googletrendarchive_preprocessed_170526.csv. В нём:

  • 10 204 597 строк;
  • 341 фактически встречающаяся географическая локация;
  • 125 стран после выделения двухбуквенного кода страны;

Это версия архива, содержащая данные за период с 28.11.2024 по 17.05.2026.

Инфографика и процесс её создания

Исходный размер 3508x4961

Способ обработки данных

Исходный CSV файл объёмом около 1,8 ГБ обрабатывался в Python блоками по 350 000 строк. Такой способ позволил последовательно проанализировать 10 204 597 записей без загрузки всего файла в оперативную память.

В процессе обработки:

  • даты и числовые поля приведены к единым форматам;
  • региональные географические коды сведены к кодам стран;
  • технические значения исключены из страновых агрегатов;
  • рассчитаны дневные, месячные и страновые показатели;
  • длительности распределены по временным интервалам;
  • для выбранных тем выполнен поиск по словарям ключевых слов;
  • результаты сохранены в отдельных CSV-таблицах для последующей визуализации.

Средняя длительность рассчитывалась как отношение суммы длительностей к числу наблюдений. Географический охват тематической группы определялся по количеству уникальных стран.

Исходный размер 1536x1024

Пайплайн производства

  1. Исследование и подготовка данных. Выбран GoogleTrendArchive, изучена документация, загружены исходные файлы, выполнены очистка и расчёт показателей.
  2. Прототипирование. На основе итоговых таблиц построены аналитические графики, проверены значения, шкалы, сортировка и подписи.
  3. Проверка и экспорт. Проверка числовых значений, русского языка для подписей, читаемости и отсутствия пересечений. Создание и экспорт редактируемых графиков в формате SVG в Adobe Illustrator.
  4. Дизайн и сборка. Разработка визуальной концепции с метафорой интерфейса поисковой страницы, картой мира и сине-голубо-зелёной палитрой. Графики композиционно объединены в вертикальный постер А1.
Исходный размер 3500x2480
Исходный размер 3500x2480

Использованные инструменты

Python и pandas — чтение, очистка, группировка и расчёт показателей; Matplotlib — построение аналитических прототипов графиков; SVG — сохранение графиков и постера в редактируемом векторном формате; Adobe Illustrator — композиция, типографика и подготовка макета.

Использование искусственного интеллекта

Как вспомогательный инструмент для формулировки темы проекта, а также поиска и сравнения открытых источников использовался ChatGPT.

ИИ не являлся источником статистических данных. Все числовые показатели рассчитаны мной из локального CSV и проверены по производным таблицам.

Исходный размер 1355x352
Что ищет мир?
Проект создан 22.06.2026