Relación entre joins y where
SELECT valorA, valorB FROM tablaA LEFT OUTER JOIN tablaB
ON (claveA = claveB)
WHERE fechaA='2009-07-07' AND fechaB='2009-07-07'
Este ejemplo realiza una unión a la izquierda entre tablaA y tablaB, generando listas de valorA y valorB. Sin embargo, la cláusula WHERE puede referirse a columnas adicionales de ambas tablas para filtrar resul ...
Publicado el 8-2 16:50
Implementación de un Clúster de Big Data de Alta Disponibilidad con Hadoop y su Ecosistema
Administración y Comandos Esenciales del Clúster
Para operar un entorno de alta disponibilidad (HA) basado en Hadoop, es fundamental dominar los comandos de gestión de servicios y conmutación por error.
# Inicialización general del ecosistema
start-all.sh
# Gestión de ZooKeeper
zkServer.sh start
# Gestión de nodos HDFS (JournalNode, NameNode, ...
Publicado el 7-4 23:47
Guía Arquitectónica y de Optimización para Ecosistemas Hadoop y Hive
Gestión de Metadatos y Resolución de Conflictos en HDFS
El mecanismo de checkpointing es vital para la persistencia del sistema de archivos distribuido. Durante este proceso, el NameNode y el Secondary NameNode interactúan utilizando dos componentes principales: fsimage y los logs de edición (edits). El archivo fsimage actúa como una instantáne ...
Publicado el 7-2 22:18
Consultas analíticas con funciones de ventana en Hive
row_number: numeración ordenada por grupo
Supongamos que necesitamos obtener los dos registros con mayor edad dentro de cada género en una tabla de personas. Una función de ventana asigna un número secuencial dentro de cada partición, lo que permite conservar más de un valor por grupo.
CREATE TABLE personas (
id INT,
edad INT,
nombre STR ...
Publicado el 6-30 23:06
Configuración de compresión LZO en Hadoop y caso práctico de recolección con Flume
Para habilitar la compresión LZO en Hadoop, es necesario utilizar el componente open-source hadoop-lzo desarrollado por Twitter, ya que Hadoop no lo incluye de manera nativa. El proceso implica compilar hadoop-lzo con dependencias en Hadoop y LZO, seguido de configuraciones específicas en el clúster y herramientas asociadas como Hive y Flume.
C ...
Publicado el 6-30 01:58
Guía de Uso del Registro de Imágenes de Contenedores de Alibaba Cloud
Descripción de Versiones
Versión
Descripción
hadoop-1.3
Imagen monocapa de Hadoop para despliegue rápido de un entorno standalone. También permite crear múltiples contenedores con confgiuraciones mínimas para formar un cluster de alta disponibilidad.
hadoop-1.4
Construida sobre la imagen base de Hadoop standalone. Incluye Hive data war ...
Publicado el 6-27 05:40