Как хранить данные так, чтобы их можно было успешно анализировать
Что бы мы ни делали, в результате генерируются данные. А когда ничего не делаем, тоже генерируются – только другие. Все, что сгенерировали, потом анализируют, проверяют, изменяют, продают и используют для генерации новых данных. В 2026 году глобальный объем данных достиг 200 зеттабайт, около половины из них сгенерировал частный сектор. При этом данные становятся разнообразнее и сложнее. Двадцать лет назад пользовательский клик фиксировался тремя полями: идентификатором пользователя, временем и самой операцией. Сегодня за тем же действием могут стоять запрос к нескольким сервисам, bounce rate, информация об авторизации, реакция на рекламу, пользовательские сценарии и куча чего еще. И чем больше появляется сценариев, тем больше данных нужно собирать и обрабатывать. Привет, меня зовут Дмитрий Кузняков, я отвечаю за развитие платформы данных для BI-аналитики в Goodt (ИТ-холдинг LANSOFT), и в этой статье я расскажу, почему мы выбрали подход федерации данных для своего продукта Insight. Читать далее
