Créer jeu
Télécharger
Obtenir Plan Académique
Partager le jeu
Intégrez-le à votre plateforme

Vous pouvez intégrer le jeu dans un LMS compatible avec LTI 1.1 ou LTI 1.3 comme Canvas, Moodle ou Blackboard. Les scores seront ainsi automatiquement enregistrés dans le carnet de notes de la plateforme.
Télécharger
Vous avez dépassé le nombre maximum de jeux que vous pouvez intégrer à Google Classroom avec votre Plan actuel.

Pour intégrer autant de jeux que vous le souhaitez dans Google Classroom, vous avez besoin d’un Plan Académique ou un Plan Commerciel.

Vous avez dépassé le nombre maximum de jeux que vous pouvez intégrer à Microsoft Teams avec votre Plan actuel.

Pour intégrer autant de jeux que vous le souhaitez dans Microsoft Teams, vous avez besoin d’un Plan Académique ou un Plan Commerciel.

Le téléchargement du jeu est une fonctionnalité exclusive pour les utilisateurs avec un Plan Académique ou un Plan Commercial.

Obtenez votre Plan Académique ou Plan Commercial dès maintenant et commencez à intégrer vos jeux dans votre LMS, votre site Web ou votre blog.

Si vous le souhaitez, vous pouvez télécharger une jeu de test ici et tester son intégration:

SPARK - LRBA 5

Test

(2)
Parties jouées 33 %Précision 86 Temps moyen 07:16

À propos de cette activité

DataFrames y Datasets - Uso y Diferencias

Créé par

Mexico

Téléchargez la version pour jouer sur papier

Créez votre propre jeu gratuite à partir de notre créateur de jeu
Affrontez vos amis pour voir qui obtient le meilleur score dans ce jeu

Top Jeux

%
Anonyme
Anonyme
%
%
%
Vous avez dépassé le nombre maximum de jeux que vous pouvez imprimer avec votre Plan actuel.

Pour imprimer autant de jeux que vous le souhaitez, vous avez besoin d’un Plan Académique ou un Plan Commerciel.

Imprimez votre jeu
SPARK - LRBA 5
 

SPARK - LRBA 5Version en ligne

DataFrames y Datasets - Uso y Diferencias

par HR Mexico
1

¿Cuál es la diferencia principal entre DataFrame y Dataset en Scala?

2

¿Qué engine optimiza ambos?

3

En PySpark, ¿qué API usar para type-safety?

4

Overhead performance Datasets vs DataFrames?

5

Creación Dataset tipado requiere:

6

Mejor para MLlib pipelines:

7

AQE optimiza dinámicamente:

8

SaveMode por default:

9

Tungsten beneficio clave:

10

¿Cuándo usar Dataset sobre DataFrame?

11

Broadcast join condición:

12

Encoder rol en Dataset:

13

Caso fraude: mejor inicial:

14

PartitionBy aplica a:

15

Whole-stage codegen:

16

InferSchema=true overhead:

17

Java Dataset requiere:

18

Benchmark TPC-DS:

19

Buena práctica cache:

20

BucketBy beneficio:

Explicación

En Scala, DataFrame = Dataset[Row] untyped; Dataset[T] compile-time safe

Comparten Catalyst para plans, Tungsten para exec off-heap.

PySpark no soporta Dataset API typed

Datasets deserializan a JVM objects en map/filter.

df.as[Person] usa implicits encoder.

Spark MLlib usa DataFrame API.

Adaptive Query Execution post-shuffle

Lanza excepción si tabla existe.

Vectorized exec minimiza JVM overhead.

Compile-time safety nested cases.

Evita shuffle broadcast memoria nodos.

Permite Catalyst en typed ops.

Optimizado Catalyst para ETL joins.

Crea dirs por columna.

Tungsten genera código optimizado.

Explicación: Analiza sample datos; usa schema explícito.

POJO con getters para bean encoder.

Optimizaciones Catalyst/Tungsten.

MEMORY_AND_DISK por default spill.

Explicación: Hash-based distribución buckets.

Voulez-vous vraiment quitter la page ?

En quittant la page, vous perdrez la progression du jeu.