Flashcards : Introduction à Spark et Big Data — 20 cartes

Toutes les cartes

1Question

Big Data — caractéristiques principales ?

Réponse

Volume, Vélocité, Variété, Véracité, Valeur

2Question

Écosystème Spark — composantes clés ?

Réponse

Spark SQL, Spark Streaming, MLlib, GraphX

3Question

Architecture Spark — modèle ?

Réponse

Master/Slave avec Driver, Cluster Manager, Executors

4Question

Lazy Evaluation — mécanisme ?

Réponse

Transformations enregistrées, actions déclenchent l’exécution

5Question

RDD — définition ?

Réponse

Resilient Distributed Dataset, immuable et distribué

6Question

Transformations — rôle ?

Réponse

Créer un nouveau RDD sans exécution immédiate

7Question

Actions — rôle ?

Réponse

Lancer le calcul et renvoyer un résultat

8Question

DataFrame — structure ?

Réponse

Table distribuée avec schéma, colonnes et lignes

9Question

Spark SQL — utilité ?

Réponse

Manipuler données structurées avec requêtes SQL

10Question

Spark Streaming — principe ?

Réponse

Traiter flux de données en temps réel

11Question

Fenêtrage — objectif ?

Réponse

Regrouper événements par fenêtres temporelles

12Question

Watermark — fonction ?

Réponse

Tolère événements tardifs avant fermeture de fenêtre

13Question

Checkpointing — but ?

Réponse

Sauvegarder l’état pour reprise après crash

14Question

MLlib — étape préparatoire ?

Réponse

Feature Engineering, encodage, assemblage de features

15Question

Feature Engineering — opérations clés ?

Réponse

StringIndexer, OneHotEncoder, VectorAssembler

16Question

Algorithmes ML — exemples ?

Réponse

Régression, Random Forest, KMeans, Logistic Regression

17Question

Pipeline ML — rôle ?

Réponse

Chaîner étapes de préparation et entraînement

18Question

Model deployment — étape ?

Réponse

Charger PipelineModel, transformer flux, écrire résultats

19Question

Deep Learning Spark — principe ?

Réponse

Diffusion du modèle via broadcast, pandas_udf

20Question

Modes de sortie streaming — principaux ?

Réponse

Append, Complete, Update

Teste-toi avec le QCM

Teste tes connaissances avec un QCM de 20 questions sur Introduction à Spark et Big Data.

1. Quel est le rôle principal du Driver Program dans l’architecture distribuée de Spark ?

2. Quel composant convertit une colonne catégorielle en indices numériques appris lors du fit ?

Faire le QCM →

Consultez la fiche

Révisez le cours complet dans la fiche de révision de Introduction à Spark et Big Data.

Voir la fiche →

Cours similaires

Crée tes propres flashcards

Importe ton cours et l'IA génère des flashcards en 30 secondes.

Générateur de flashcards