Aller au contenu principal

Solutions d'ingénierie Supermicro

Mettre à profit l'intelligence artificielle et tirer des enseignements des données

Supermicro pour développer l'intelligence artificielle à partir des données

Relever le défi des données pour l'IA

L'entraînement des IA et l'inférence sur de nouvelles données sont essentiels pour créer de nouveaux services destinés aux clients et optimiser les opérations commerciales. Grâce à des capteurs peu coûteux et à l'intensification des interactions sociales avec les clients via Internet, les entreprises peuvent tirer pleinement parti de l'augmentation quotidienne du volume de données pour améliorer leurs systèmes d'IA. La mise en œuvre de systèmes de flux de données respectant la confidentialité des données des clients, les fonctions clés suivantes soutiennent l'entraînement et l'inférence des IA :

  • Flux de données pour gérer la collecte de données provenant des terminaux périphériques et d'Internet
    • Flux de données vers des systèmes exécutant Apache Kafka, NiFi et Flink
  • Ingénierie des données issues d'un lac de données, mise en place de pipelines de données pour les flux de travail d'IA
    • Des pipelines de données permettant d'acheminer les données vers différents flux de travail d'IA
    • Extraction et transformation des données à l'aide d'Apache Spark
    • Entreposage de données à l'aide du système de fichiers Apache Hadoop (HDFS), d'Impala, de Hive Iceberg et d'autres outils
  • Le DevOps et le MLOps pour optimiser les flux de travail dans les systèmes d'entraînement et d'inférence en IA
    • Kubernetes pour la gestion des conteneurs
    • Traitement de graphes avec Apache Spark

Ces composants sont disponibles auprès de la communauté open source.

Supermicro à Cloudera, à la communauté open source et à d'autres partenaires logiciels afin de proposer ces solutions à ses clients professionnels. Cloudera intègre les composants logiciels pour qu'ils fonctionnent sur Supermicro et fournit une assistance logicielle de niveau entreprise aux développeurs et aux clients. Cloudera a regroupé ces composants logiciels en plateformes et modules faciles à gérer pour le déploiement, tout en y ajoutant des fonctionnalités de traçabilité et de sécurité des données.

Centre de données Supermicro

Cloudera intègre un vaste ensemble de logiciels open source, les organise au sein d'une plateforme fonctionnant aussi bien sur site que dans le cloud, et fournit un support de niveau entreprise pour aider ses clients à mettre en place des systèmes de collecte et d'analyse de données, d'ETL et de « data lake house » qui soient évolutifs et fiables. De plus, Cloudera a intégré la traçabilité des données afin de garantir leur fiabilité.

Les logiciels open source tels qu’Apache® Spark™, Kafka, Flink, NiFi, Iceberg, Hadoop et bien d’autres encore permettent de mettre en place les systèmes et architectures logicielles les plus récents pour la collecte, l’analyse, le traitement et le stockage des données. Ces technologies simplifient et accélèrent l’intelligence artificielle en fournissant des cadres permettant d’organiser et de gérer les données afin de s’adapter aux évolutions au fil du temps. Les logiciels open source offrent les technologies les plus récentes, mais les utilisateurs doivent assurer la maintenance et le support de leur infrastructure logicielle, à moins qu'ils n'utilisent des solutions proposées par des entreprises telles que Cloudera.