Mediaspace scheduled maintenance: Aug 25, 2026 07:00 - 12:00 AM. During this time, videos will be temporarily unavailable. Check status updates.
Cette séance de cours couvre le modèle de flux de données, axé sur l'amélioration de l'expressivité, de l'extensibilité et des performances dans le calcul distribué. Il explique Résilient Distributed Datasets (RDDs) dans Spark, leurs propriétés, opérations, et des exemples comme la recherche d'erreurs et le nombre de mots. La séance de cours traite également des limites de la vanille Spark et des avantages de l'évaluation paresseuse.
Cette vidéo est disponible exclusivement sur Mediaspace pour un public restreint. Veuillez vous connecter à Mediaspace pour y accéder si vous disposez des autorisations nécessaires.
Regarder sur Mediaspace