Crear
Descargar
Obtener Plan Académico
Compartir juego
Intégralo en tu plataforma

Puedes integrar el juego en un LMS compatible con LTI 1.1 o LTI 1.3 como Canvas, Moodle, o Blackboard. De esta manera podrás guardar las puntuaciones automáticamente en el libro de calificaciones de esa plataforma.
Descargar
Has superado el número máximo de juegos que puedes integrar en Google Classroom con tu Plan actual.

Para integrar tantos juegos como quieras en Google Classroom, necesitas un Plan Académico o un Plan Comercial.

Has superado el número máximo de juegos que puedes integrar en Microsoft Teams con tu Plan actual.

Para integrar tantos juegos como quieras en Microsoft Teams, necesitas un Plan Académico o un Plan Comercial.

La descarga de juegos es una característica exclusiva para usuarios con un Plan Académico o un Plan Comercial.

Obtén ahora tu Plan Académico o Comercial y comienza a integrar tus juegos en tu LMS, web o blog.

Si lo deseas, puedes descargar un juego de prueba aquí y probar su integración:

SPARK - LRBA 5

Test

(2)
Jugadas 33 %Acierto 86 Tiempo medio 07:16

Sobre esta actividad

DataFrames y Datasets - Uso y Diferencias

Creada por

México

Descarga la versión para jugar en papel

Crea tu propio juego gratis desde nuestro creador de juegos
Compite contra tus amigos para ver quien consigue la mejor puntuación en esta actividad

Top juegos

%
Anónimo
Anónimo
%
%
%
Has superado el número máximo de juegos que puedes imprimir con tu Plan actual.

Para imprimir tantos juegos como quieras, necesitas un Plan Académico o un Plan Comercial.

Imprime tu juego
SPARK - LRBA 5
 

SPARK - LRBA 5Versión en línea

DataFrames y Datasets - Uso y Diferencias

por HR Mexico
1

¿Cuál es la diferencia principal entre DataFrame y Dataset en Scala?

2

¿Qué engine optimiza ambos?

3

En PySpark, ¿qué API usar para type-safety?

4

Overhead performance Datasets vs DataFrames?

5

Creación Dataset tipado requiere:

6

Mejor para MLlib pipelines:

7

AQE optimiza dinámicamente:

8

SaveMode por default:

9

Tungsten beneficio clave:

10

¿Cuándo usar Dataset sobre DataFrame?

11

Broadcast join condición:

12

Encoder rol en Dataset:

13

Caso fraude: mejor inicial:

14

PartitionBy aplica a:

15

Whole-stage codegen:

16

InferSchema=true overhead:

17

Java Dataset requiere:

18

Benchmark TPC-DS:

19

Buena práctica cache:

20

BucketBy beneficio:

Explicación

En Scala, DataFrame = Dataset[Row] untyped; Dataset[T] compile-time safe

Comparten Catalyst para plans, Tungsten para exec off-heap.

PySpark no soporta Dataset API typed

Datasets deserializan a JVM objects en map/filter.

df.as[Person] usa implicits encoder.

Spark MLlib usa DataFrame API.

Adaptive Query Execution post-shuffle

Lanza excepción si tabla existe.

Vectorized exec minimiza JVM overhead.

Compile-time safety nested cases.

Evita shuffle broadcast memoria nodos.

Permite Catalyst en typed ops.

Optimizado Catalyst para ETL joins.

Crea dirs por columna.

Tungsten genera código optimizado.

Explicación: Analiza sample datos; usa schema explícito.

POJO con getters para bean encoder.

Optimizaciones Catalyst/Tungsten.

MEMORY_AND_DISK por default spill.

Explicación: Hash-based distribución buckets.

¿Estás seguro que quieres abandonar la página?

Al abandonar la página perderás el progreso del juego.