1. Quel est le rôle principal du Driver Program dans l’architecture distribuée de Spark ?
2. Quel composant convertit une colonne catégorielle en indices numériques appris lors du fit ?
3. Quel est le schéma de déploiement décrit pour l’inférence en deep learning avec Spark et Keras ?
Big Data — caractéristiques principales ?
Volume, Vélocité, Variété, Véracité, Valeur
Écosystème Spark — composantes clés ?
Spark SQL, Spark Streaming, MLlib, GraphX
Architecture Spark — modèle ?
Master/Slave avec Driver, Cluster Manager, Executors
Lazy Evaluation — mécanisme ?
Transformations enregistrées, actions déclenchent l’exécution
RDD — définition ?
Resilient Distributed Dataset, immuable et distribué
Transformations — rôle ?
Créer un nouveau RDD sans exécution immédiate
A ficha de revisão cobre os conceitos essenciais de Introduction à Spark et Big Data. Está organizada por tópicos para facilitar o aprendizado e a memorização, com definições chave, explicações e resumos.
Leia a ficha completa →O quiz contém 20 perguntas de múltipla escolha com correções e explicações detalhadas para cada resposta. Ideal para testar seu conhecimento e identificar lacunas.
Faça o quiz (20 perguntas) →Revizly oferece 20 flashcards interativos sobre Introduction à Spark et Big Data. Cada cartão apresenta uma pergunta na frente e a resposta no verso, permitindo uma revisão ativa e eficaz baseada na repetição espaçada.
Veja todos os 20 flashcards →Import your PDF or paste your course, AI generates sheets, quizzes and flashcards in 30 seconds.