## R version of most popular local hotels
library(data.table)
train <- fread('../input/train.csv', header=TRUE, select = c("user_id", "hotel_cluster"))

# Posibles fuentes de influencia:
# 1. Preferencias del usuario (clicks + bookings)
# 2. Hoteles más populares en cada destino

# 1. Preferencias del usuario
users <- train[, paste(hotel_cluster, collapse = ","), by = .(user_id)]
str(users)
users

