Recherche avancée
Par formation
Par date
Par ville
logo HUB Formation
Organisme de Formation
aux Technologies et métiers de L'informatique
La pédagogie au service de la technologie
> > > Formation Hadoop - Présentation de l'écosystème

Formation Hadoop - Présentation de l'écosystème

Comprendre le rôle de chaque brique logicielle

hadoop

Si Internet a révolutionné l’accès à l’information, son utilisation génère une quantité incalculable de nouvelles informations chaque jour... En enrichissant nos profils sur les réseaux sociaux, en rédigeant des billets sur des blogs, en participant à des forums ou en publiant des annonces sur des sites spécialisés, nous contribuons nous-même à créer de l’information. Afin d’exploiter au mieux des volumes sans cesse croissants de données, les moteurs de recherche et autres réseaux sociaux ont dû s’affranchir des outils traditionnels et développer leurs propres solutions. Les travaux de Google ont ainsi été à l’origine de la création du projet Open Source Hadoop, un Framework Java libre destiné à faciliter le stockage, l’exploitation et l’analyse de très grands volumes d’information (on parle ici de péta-octets) hébergés sur des milliers de machines différentes. Ce séminaire a pour objectif de présenter les différents éléments de l'écosystème Hadoop et leur rôle respectif dans un projet Big Data.

Objectifs

  • Se repérer dans l’écosystème Hadoop
  • Connaître les principaux composants de Hadoop
  • Être à l’aise avec les concepts et termes propres à Hadoop
  • Comprendre comment les différents composants d’Hadoop interagissent ensemble
  • Disposer d’une première vision de la mise en oeuvre d’Hadoop au travers d’exemples

Public

  • Chefs de projets
  • Développeurs
  • Toute personne souhaitant comprendre les mécanismes Hadoop et le rôle de chaque composant

Prérequis

  • Connaissances générales des systèmes d'information

Programme de la formation

Introduction

  • Les fonctionnalités apportées par Hadoop
  • Les principaux composants : HDFS, Hbase, Hive, Pig, MapReduce, Zookeeper, flume, sqoop, gis-tools, mahout

L'architecture

  • Terminologie : NameNode, DataNode, ResourceManager
  • Rôle et interactions des différents composants

Exemples interactifs

  • Démonstrations sur une architecture Hadoop multi-noeuds
  • Mise à disposition d'un environnement pour des exemples de calcul
  • Recherches dans des données complexes

Les plus de cette formation

  • Un séminaire rythmé basé sur l'alternance de phases théoriques, de démonstrations et de travaux pratiques qui permet aux participants d'avoir une vue d'ensemble d'Hadoop et de son écosystème.
  • Un séminaire animé par un spécialiste du Big Data.