Цель этой лекции - сформировать рабочее представление о больших данных и распределённых вычислениях с упором на прикладную составляющую, то есть, ответить на вопрос, зачем это всё нужно знать аналитику.
Мы поговорим о том, что делать, когда данных очень много и они разнообразны; вместе пройдём путь от момента возникновения события в жизни пользователя до чанка, в котором лежит информация о нем, а также разберемся, что происходит на вычислительном кластере, когда мы запускаем операцию обработки данных.
Иными словами, будем разбираться, как устроена наша инфраструктура обработки больших данных.
Спикер:
Юля Черткова - руководитель службы подготовки и анализа больших данных