
La presente investigación surge del interés de una empresa del sector cervecero por comprender las preferencias expresadas por los consumidores y reconocer qué características de las cervezas se relacionan con mejores valoraciones. Conocer las diferencias según el tipo, el origen, la composición nutricional, el precio y los atributos sensoriales puede aportar evidencia para orientar la selección del portafolio, la comunicación de los productos y futuras decisiones comerciales. En esta primera aproximación se realizará un análisis descriptivo; por tanto, los resultados permitirán identificar patrones y formular nuevas hipótesis, pero no establecer relaciones causales.
Para desarrollar el estudio se dispone de la base de datos
beer2.csv, que contiene 1.586.614 reseñas de
cerveza y 15 variables. Cada fila corresponde
a una reseña; por esta razón, una misma cerveza puede aparecer en varios
registros. La base no presenta datos faltantes y reúne información de
identificación, características nutricionales, procedencia y
valoraciones de los productos. La variable precio es
simulada.
La composición de la base de datos es la siguiente:
id: identificador numérico de la cerveza reseñada. Sirve para reconocer el producto y no constituye una variable estadística de interés.
marca: variable cualitativa nominal que identifica la cervecería o marca productora.
precio: variable cuantitativa continua, simulada, que registra el precio de referencia de una caja de seis botellas de 355 ml.
alcohol: variable cuantitativa continua que indica los gramos de alcohol puro contenidos en 355 ml de cerveza.
carbohidratos: variable cuantitativa continua que estima los gramos de carbohidratos contenidos en 355 ml.
calorias: variable cuantitativa discreta que estima las calorías totales contenidas en 355 ml.
nacionalidad: variable cualitativa nominal que indica el país asignado a la cervecería.
calificacion: variable cualitativa ordinal que valora la experiencia general con la cerveza mediante una puntuación numérica.
aroma: variable cualitativa ordinal que valora el aroma de la cerveza.
apariencia: variable cualitativa ordinal que valora la apariencia de la cerveza.
paladar: variable cualitativa ordinal que valora la sensación de la cerveza en el paladar.
sabor: variable cualitativa ordinal que valora el sabor de la cerveza.
nombre_cerveza: variable cualitativa nominal que registra el nombre comercial de la cerveza reseñada.
tipo: variable cualitativa nominal que clasifica el producto como cerveza normal y helada, baja en calorías o sin alcohol, lager importada, clara artesanal o lager artesanal.
origen: variable cualitativa nominal dicotómica que clasifica la cerveza como nacional o importada.
El director de investigación le encarga, en calidad de analista de datos, elaborar un informe descriptivo que sirva como diagnóstico inicial. Para las variables cualitativas y ordinales deberá construir tablas de frecuencias absolutas y relativas e identificar la moda; para las variables cuantitativas deberá calcular indicadores de tendencia central, posición y dispersión, seleccionando aquellos que resulten apropiados según la distribución observada. También deberá comparar los indicadores entre tipos y orígenes de cerveza e interpretar los resultados en relación con el propósito de la investigación. El informe debe señalar los principales patrones encontrados, advertir que las variables simuladas describen únicamente esta base académica y evitar conclusiones causales.
library(DT)
# Cargar los datos
library(readr)
beer2 <- read_csv("data/beer2.csv")
# Mostrar la tabla con DataTable
DT::datatable(
head(beer2),
fillContainer = FALSE,
options = list(pageLength = 8)
)