1. Quel est le rôle principal du Driver Program dans l’architecture distribuée de Spark ?
2. Quel composant convertit une colonne catégorielle en indices numériques appris lors du fit ?
3. Quel est le schéma de déploiement décrit pour l’inférence en deep learning avec Spark et Keras ?
Big Data — caractéristiques principales ?
Volume, Vélocité, Variété, Véracité, Valeur
Écosystème Spark — composantes clés ?
Spark SQL, Spark Streaming, MLlib, GraphX
Architecture Spark — modèle ?
Master/Slave avec Driver, Cluster Manager, Executors
Lazy Evaluation — mécanisme ?
Transformations enregistrées, actions déclenchent l’exécution
RDD — définition ?
Resilient Distributed Dataset, immuable et distribué
Transformations — rôle ?
Créer un nouveau RDD sans exécution immédiate
La hoja de repaso cubre los conceptos esenciales de Introduction à Spark et Big Data. Está organizada por temas para facilitar el aprendizaje y la memorización, con definiciones clave, explicaciones y resúmenes.
Lee la hoja completa →El cuestionario contiene 20 preguntas de opción múltiple con correcciones y explicaciones detalladas para cada respuesta. Ideal para poner a prueba tus conocimientos e identificar lagunas.
Realiza el cuestionario (20 preguntas) →Revizly ofrece 20 tarjetas de memoria interactivas sobre Introduction à Spark et Big Data. Cada tarjeta presenta una pregunta en el anverso y la respuesta en el reverso, permitiendo una revisión activa y efectiva basada en la repetición espaciada.
Ver las 20 tarjetas de memoria →Import your PDF or paste your course, AI generates sheets, quizzes and flashcards in 30 seconds.