Aller au contenu principal

Spark, Hadoop, traitement des flux de données, solutions d'ingénierie des données pour l'IA

Solutions Supermicro Cloudera

Le défi

Les applications en constante évolution génèrent une quantité colossale d’informations, qu’il s’agisse de données structurées, non structurées ou semi-structurées. Les infrastructures informatiques traditionnelles ne sont pas conçues pour gérer la diversité, la vitesse et le volume des données produites par les réseaux sociaux, les applications mobiles, les capteurs des machines et la recherche scientifique, etc. Pour les entreprises, l’utilisation de l’analyse du big data n’est plus une question de « quand », mais de « comment ». Spark, Hadoop et d’autres logiciels open source, conçus pour le stockage et le traitement à moindre coût de grands volumes de données, ont été créés à cette fin. Ils peuvent évoluer de manière linéaire jusqu’à des milliers de serveurs et des pétaoctets de stockage.

Cloudera intègre ces technologies open source et fournit un support de niveau entreprise afin d'aider ses clients à tirer parti de leur volume important de données pour acquérir un avantage concurrentiel. Pour ce faire, Cloudera est déployé au sein de clusters de serveurs évolutifs. Supermicro le déploiement des clusters Cloudera grâce à des systèmes fiables dotés de fonctionnalités de gestion en bande et hors bande, et en proposant un large choix de plates-formes adaptées aux centres de données des clients.

La solution et Supermicro

Les clusters Supermicro prennent en charge Cloudera Cloud Data Platform (CDP) et permettent un déploiement simplifié.

  • CHOIX DU SYSTÈME: Les clients peuvent choisir la plateforme matérielle la mieux adaptée pour mettre en place des clusters
    • Hyper montés en rack, serveurs Twin à plusieurs nœuds ou serveurs lames
    • Choix entre les architectures de processeurs Intel ou AMD
    • Choix des accélérateurs GPU pour des applications telles que l'accélération de Spark
    • Choix de disques : disques durs ( HDD ) HDD SSD NVMe
    • Choix d'architectures réseau, options allant de 10 GbE à 400 GbE
    • Tous sont gérés via Redfish mêmes Redfish IPMI / Redfish et peuvent être regroupés via l'interface unique Supermicro Composer
    • Une grande partie du déploiement peut être automatisée à l'aide de Supermicro Cloud Orchestrator
  • CHOIX DE DÉPLOIEMENT: Les clients peuvent choisir entre un déploiement sur serveur physique, Red Hat OpenShift, Kubernetes ou sur machine virtuelle.
  • ÉVOLUTIVITÉ: Les clients peuvent commencer avec le plus petit cluster et faire évoluer leur infrastructure en ajoutant des serveurs.
  • AUTOMATISATION: Supermicro assembler le cluster, entièrement testé, avec une qualité d'assemblage garantie et un délai de livraison assuré. La mise en œuvre logicielle peut être déployée à l'aide des fonctionnalités d'automatisation de Supermicro Orchestrator.

Exemple de cluster Cloudera CDP entièrement intégré

Principales caractéristiques et avantages :

  • Configurations de clusters spécialement conçues et optimisées pour la capacité, la puissance de calcul ou les performances d'E/S
  • Choix entreEPYC Intel Xeon et AMD EPYC — il est recommandé d'utiliser la même architecture de processeur pour l'ensemble du cluster
  • Conception d'un Name Node à haute disponibilité sans point de défaillance unique
  • Options de mémoire de grande capacité spécialement conçues pour Spark et d'autres calculs en mémoire à faible latence
  • Plateformes de serveurs Hyper » conçues pour des déploiements de très grande envergure
  • Conception à haute densité en matière de calcul, de stockage et de mémoire, visant à offrir le meilleur rendement et TCO le plus bas
  • Options de commutateurs réseau flexibles, avec 1 ou 2 commutateurs 10G / 25G / 100G ou plus rapides par rack.
  • Conception de rack 14U économique, idéale pour un environnement de test de validation de concept
  • Conception standard en rack 42U et options de PDU flexibles adaptées à tous les environnements de centre de données
  • Rendement pouvant atteindre le niveau « Titanium » (96 %+) – Alimentations redondantes avec PMBus
  • Intègre la suite IPMI et SMC OOB (gestion hors bande) pour la gestion automatisée des clusters
  • Entièrement intégré, entièrement configuré et testé de bout en bout avec les distributions Hadoop de votre choix
  • Cluster de test de validation de concept disponible pour une expérience d'achat sans risque
  • Assistance Cloudera Enterprise, sous licence de Cloudera
Rack Supermicro pour solution de cluster Hadoop Supermicro intégrée
  • 1 ou 2 modules à 48 ports 10G SFP+ / 10GBase-T / 25GbE
    1 ou 2 commutateurs à 32 ports 100 GbE, 1 commutateur à 48 ports, GbE
  • 1 nœud de gestion 1U équipé deEPYC Intel Xeon ou AMD EPYC
  • 3 nœuds de nom équipés deEPYC Intel Xeon ou AMD EPYC en format 1U DP
  • Nœuds de données optimisés : SSG 2U, BigTwin 2U ou FatTwin® 4U équipés deEPYC Intel Xeon ou AMD EPYC
  • Rack standard 42U avec PDU à comptage, options de personnalisation du rack disponibles
  • Le service d'intégration comprend le rodage et les tests complets du cluster, la mise à jour du BIOS et du micrologiciel, la configuration réseau, la préinstallation de la distribution Cloudera CDP de votre choix, ainsi que la mise en place complète du cluster
Supermicro

Supermicro pour les déploiements « bare metal » ou Kubernetes

CloudDC 1U ou

Serveurs GrandTwin® à plusieurs nœuds

OU

Supermicro destinés au déploiement de VMware ou à l'utilisation de GPU

Hyper 2U