Crear
Descargar
Obtener Plan Académico
Compartir juego
Intégralo en tu plataforma

Puedes integrar el juego en un LMS compatible con LTI 1.1 o LTI 1.3 como Canvas, Moodle, o Blackboard. De esta manera podrás guardar las puntuaciones automáticamente en el libro de calificaciones de esa plataforma.
Descargar
Has superado el número máximo de juegos que puedes integrar en Google Classroom con tu Plan actual.

Para integrar tantos juegos como quieras en Google Classroom, necesitas un Plan Académico o un Plan Comercial.

Has superado el número máximo de juegos que puedes integrar en Microsoft Teams con tu Plan actual.

Para integrar tantos juegos como quieras en Microsoft Teams, necesitas un Plan Académico o un Plan Comercial.

La descarga de juegos es una característica exclusiva para usuarios con un Plan Académico o un Plan Comercial.

Obtén ahora tu Plan Académico o Comercial y comienza a integrar tus juegos en tu LMS, web o blog.

Si lo deseas, puedes descargar un juego de prueba aquí y probar su integración:

SPARK - LRBA 3

Test

(3)
Jugadas 34 %Acierto 80 Tiempo medio 08:09

Sobre esta actividad

Spark SQL - Manejo y Consulta de Datos Estructurados

Creada por

México

Descarga la versión para jugar en papel

Crea tu propio juego gratis desde nuestro creador de juegos
Compite contra tus amigos para ver quien consigue la mejor puntuación en esta actividad

Top juegos

%
Anónimo
Anónimo
%
%
%
Has superado el número máximo de juegos que puedes imprimir con tu Plan actual.

Para imprimir tantos juegos como quieras, necesitas un Plan Académico o un Plan Comercial.

Imprime tu juego
SPARK - LRBA 3
 

SPARK - LRBA 3Versión en línea

Spark SQL - Manejo y Consulta de Datos Estructurados

por HR Mexico
1

¿Cuál es el rol principal de Catalyst Optimizer en Spark SQL?

2

En lectura de Parquet, ¿qué opción habilita predicate pushdown?

3

¿Cuál es la sintaxis para particionar al escribir un DataFrame?

4

¿Qué tipo de datos representa arrays anidados en esquemas?

5

En joins, ¿cuándo usar broadcast hint?

6

¿Qué función window computa ranking?

7

¿Qué habilita ACID en Spark SQL?

8

En streaming, ¿qué maneja datos tardíos?

9

¿Configuración activa AQE?

10

¿Buena práctica para UDFs de alto rendimiento?

11

¿Qué comando muestra plan de ejecución detallado?

12

En bucketing, ¿beneficia principalmente?

13

¿Ventaja de Datasets sobre DataFrames?

14

¿Qué evita múltiples filtros en cadena?

15

En Hive tables, ¿qué crea particiones dinámicas?

16

¿Métrica clave en Spark UI para skew?

17

¿Función para flatten arrays?

18

¿Configuración para partitions output?

19

En retail analytics, ¿particionamiento óptimo?

20

¿Extensión para metadatos persistentes?

Explicación

Catalyst aplica reglas como constant folding y join reordering para optimizar planes de ejecución.

Parquet soporta filtros en metadata, empujados antes de lectura completa

partitionBy crea directorios jerárquicos por valores de columna.

ArrayType(StructType()) para listas de objetos complejos.

Evita shuffle enviando tabla a todos ejecutores.

rank() asigna rangos dentro de particiones ordenadas.

Delta proporciona transacciones atómicas sobre Parquet.

withWatermark descarta datos fuera de ventana temporal.

AQE optimiza dinámicamente basado en estadísticas runtime.

Pandas UDFs aplican funciones a batches Pandas, acelerando 100x.

explain(extended) revela DAG con optimizaciones.

BucketBy hash-particiona para joins directos.

Datasets ofrecen chequeo estático de tipos.

Optimizador fusiona condiciones en where().

PARTITIONED BY habilita inserts dinámicos.

Desbalance en shuffle indica skew en keys.

explode() expande arrays a rows.

Controla tamaño y coalescing dinámico.

Prune por tiempo/localidad acelera queries comunes.

Hive Metastore persiste esquemas cross-sesiones.

¿Estás seguro que quieres abandonar la página?

Al abandonar la página perderás el progreso del juego.