Aller au contenu principal

Spark open source, traitement des flux de données, solutions d'ingénierie des données pour l'IA

Supermicro basées sur l'open source

Le défi

Les applications en constante évolution génèrent une quantité colossale d’informations, qu’il s’agisse de données structurées, non structurées ou semi-structurées. Les infrastructures informatiques traditionnelles ne sont pas conçues pour gérer la diversité, la vitesse et le volume des données produites par les réseaux sociaux, les applications mobiles, les capteurs des machines, la recherche scientifique, etc. Pour les entreprises, l’utilisation de l’analyse du big data n’est plus une question de « quand », mais de « comment ». Spark et d’autres logiciels open source, conçus pour le stockage et le traitement rentables de grands volumes de données, ont été créés à cette fin. Ils peuvent évoluer de manière linéaire jusqu’à des milliers de serveurs et des pétaoctets de stockage.

Pour les prestataires de services et les clients maîtrisant les technologies open source, capables de gérer et d'assurer la maintenance d'une implémentation open source de Spark ainsi que des logiciels associés de traitement des flux de données et d'ingénierie des données, Supermicro le déploiement de clusters Kubernetes grâce à des systèmes fiables dotés de fonctionnalités de gestion « in-band » et « out-of-band », et en proposant un large choix de plates-formes système adaptées aux centres de données des clients.

La solution et Supermicro

Les clusters Supermicro prennent en charge les solutions open source grâce à un déploiement simplifié de Kubernetes.

  • CHOIX DU SYSTÈME: Les clients peuvent choisir la plateforme matérielle la mieux adaptée pour mettre en place des clusters
    • Hyper montés en rack, serveurs Twin à plusieurs nœuds ou serveurs lames
    • Choix entre les architectures de processeurs Intel ou AMD
    • Choix des accélérateurs GPU pour des applications telles que l'accélération de Spark
    • Choix de disques : disques durs ( HDD ) HDD SSD NVMe
    • Choix d'architectures réseau, options allant de 10 GbE à 400 GbE
    • Tous sont gérés via Redfish mêmes Redfish IPMI / Redfish et peuvent être regroupés via l'interface unique Supermicro Composer
    • Une grande partie du déploiement peut être automatisée à l'aide de Supermicro Cloud Orchestrator
  • CHOIX DE DÉPLOIEMENT: Les clients peuvent choisir entre un déploiement sur serveur physique, Red Hat OpenShift, Kubernetes ou sur machine virtuelle.
  • ÉVOLUTIVITÉ: Les clients peuvent commencer avec le plus petit cluster et faire évoluer leur infrastructure en ajoutant des serveurs.
  • AUTOMATISATION: Supermicro assembler le cluster, entièrement testé, avec une qualité d'assemblage garantie et un délai de livraison assuré. La mise en œuvre logicielle peut être déployée à l'aide des fonctionnalités d'automatisation de Supermicro Orchestrator.

Exemple de cluster open source entièrement intégré avec Kubernetes

Principales caractéristiques et avantages :

  • Configurations de clusters spécialement conçues et optimisées pour la capacité, la puissance de calcul ou les performances d'E/S
  • Prise en charge de Kubernetes, d'OpenShift et d'autres implémentations de Kubernetes
  • Choix entreEPYC Intel Xeon et AMD EPYC — il est recommandé d'utiliser la même architecture de processeur pour l'ensemble du cluster
  • Conception d'un Name Node à haute disponibilité sans point de défaillance unique
  • Options de mémoire de grande capacité spécialement conçues pour Spark et d'autres calculs en mémoire à faible latence
  • Plateformes de serveurs Hyper » conçues pour des déploiements de très grande envergure
  • Conception à haute densité en matière de calcul, de stockage et de mémoire, visant à offrir le meilleur rendement et TCO le plus bas
  • Options de commutateurs réseau flexibles, avec 1 ou 2 commutateurs 10G / 25G / 100G ou plus rapides par rack.
  • Conception de rack 14U économique, idéale pour un environnement de test de validation de concept
  • Conception standard en rack 42U et options de PDU flexibles adaptées à tous les environnements de centre de données
  • Rendement pouvant atteindre le niveau « Titanium » (96 %+) – Alimentations redondantes avec PMBus
  • Intègre la suite IPMI et SMC OOB (gestion hors bande) pour la gestion automatisée des clusters
  • Entièrement intégré, entièrement configuré et testé de bout en bout avec les distributions Hadoop de votre choix
  • Cluster de test de validation de concept disponible pour une expérience d'achat sans risque
  • Le client fournit une image système d'un logiciel libre ; assistance autonome par le client
Rack Supermicro pour solution de cluster Hadoop Supermicro intégrée
  • 1 ou 2 modules à 48 ports 10G SFP+ / 10GBase-T / 25GbE
    1 ou 2 commutateurs à 32 ports 100 GbE, 1 commutateur à 48 ports, GbE
  • 1 nœud de gestion 1U équipé deEPYC Intel Xeon ou AMD EPYC
  • 3 nœuds de nom équipés deEPYC Intel Xeon ou AMD EPYC en format 1U DP
  • Nœuds de données optimisés : SSG 2U, BigTwin 2U ou FatTwin® 4U équipés deEPYC Intel Xeon ou AMD EPYC
  • Rack standard 42U avec PDU à comptage, options de personnalisation du rack disponibles
  • Le service d'intégration comprend le rodage et les tests complets du cluster, la mise à jour du BIOS et du micrologiciel, la configuration réseau, ainsi que l'image open source fournie par le client.
Supermicro

Supermicro pour les déploiements « bare metal » ou Kubernetes

CloudDC 1U ou

Serveurs GrandTwin® à plusieurs nœuds

OU

Supermicro destinés au déploiement de VMware ou à l'utilisation de GPU

Hyper 2U