メインコンテンツへスキップ

Supermicro データエンジニアリングソリューション

人工知能を実現し、データからインサイトを生成

データで人工知能を構築するSupermicroソリューション

AIにおけるデータ課題への対応

AIのトレーニングと推論に新しいデータを活用することは、新たな顧客サービス創出と業務最適化に不可欠です。低コストセンサーやインターネットを通じた顧客との交流増加により、企業は日々増加する膨大なデータをAIシステムの改善に活かす大きな機会を得ています。顧客データのプライバシーを尊重したデータフローシステムの実装により、以下の主要機能がAIトレーニングと推論を支えます:

  • データストリーミング:エッジデバイスやインターネットからのデータ収集を管理
    • Apache Kafka、NiFi、Flinkなど
  • データレイクから抽出されたデータに対するデータエンジニアリング、AIワークフローのためのデータパイプラインの構築
    • さまざまなAIワークフローにデータを誘導するデータパイプライン
    • Apache Sparkを使用したデータ抽出と変換
    • Apache Hadoop File System (HDFS)、Impala、Hive Icebergなどを使用したデータウェアハウジング
  • DevOpsおよびMLOps:AIトレーニングと推論システムのワークフローを駆動
    • コンテナを管理するためのKubernetes
    • Apache Sparkグラフ処理

これらのコンポーネントはオープンソースコミュニティから入手可能です。

SupermicroはClouderaやオープンソース、その他のソフトウェアパートナーと連携し、企業のお客様向けにこれらのソリューションを提供しています。ClouderaはこれらのソフトウェアコンポーネントをSupermicroシステム上で動作するよう統合し、開発者およびお客様にエンタープライズレベルのサポートを提供します。また、Clouderaはソフトウェアを管理しやすいプラットフォームとモジュールに整理し、データ出所追跡(data provenance)やデータセキュリティ機能を追加しています。

Supermicro ハイブリッドデータセンター

Clouderaは、膨大なオープンソースソフトウェアを統合し、オンプレミスおよびクラウドの両方で動作するプラットフォームに整理しています。また、エンタープライズレベルのサポートを提供することで、お客様がスケーラブルで信頼性の高いデータ収集、データアナリティクス、ETL、データレイクハウスシステムを構築するのを支援します。さらに、データ出所追跡(data provenance)機能を追加することで、データの信頼性を確保しています。

Apache® Spark™、Kafka、Flink、NiFi、Iceberg、Hadoopをはじめとするオープンソースソフトウェアの進化により、データの収集、分析、エンジニアリング、保存を担う最新のソフトウェアシステムとアーキテクチャが生まれています。これらの技術は、時間とともに変化するデータを整理・管理するためのフレームワークを提供することで、人工知能の構築を簡素化・加速します。オープンソースソフトウェアは最新技術を提供しますが、Clouderaのような企業が整理したソフトウェアを利用しない限り、お客様自身でソフトウェアインフラの保守・サポートを行う必要があります。