Notice bibliographique
- Notice
Type(s) de contenu et mode(s) de consultation : Texte noté : sans médiation
Auteur(s) : Jouin, Romain. Auteur du texte
Titre(s) : Spark [Texte imprimé] : valorisez vos données en temps réel avec Spark ML et Hadoop / Romain Jouin
Publication : Malakoff : Dunod, DL 2020
Impression : 42-Saint-Just-la-Pendue : Impr. Chirat
Description matérielle : 1 vol. (XIV-287 p.) : ill. ; 25 cm
Collection : Infopro. Études, développement & intégration
Lien à la collection : InfoPro. Études, développement, intégration InfoPro (Paris)
Note(s) : Index
Sujet(s) : Apache Spark (langage de programmation) Hadoop (plate-forme informatique)
Indice(s) Dewey : 006.312 (23e éd.) = Exploration des données (informatique)
Identifiants, prix et caractéristiques : ISBN 978-2-10-079432-4 (br.) : 29,90 EUREAN 9782100794324
Identifiant de la notice : ark:/12148/cb46502829k
Notice n° : FRBNF46502829
Résumé : Spark est un moteur de traitement de données rapide dédié au big data. Très en vogue depuis quelques années il permet de traiter de gros volumes de données de manière distribuée. Grâce à sa vitesse, à sa simplicité d'usage et à la variété de ses bibliothèques d'algorithmes, il est de plus en plus utilisé pour les applications de machine learning.Ce manuel de prise en main présente quatre des cinq modules de Spark. L'auteur a fait le choix du langage Python qui convient mieux aux débutants.Son objectif est de permettre au lecteur d'installer et d'utiliser Spark de manière autonome, de comprendre les concepts du machine learning et d'en maîtriser les bonnes pratiques.L'ouvrage est complété par de nombreux compléments en ligne accessibles sur GitHub. [source éditeur]