メラノックス (NVIDIA メラノックス) MCX556A-ECAT サーバー NIC 動作中♪ RDMA/RoCE 低遅延輸送とサーバーのスループット増強
June 9, 2026
ハイパースケールデータセンターとエンタープライズクラウド環境は,共通の課題に直面しています.CPUコア数が増加するにつれて,伝統的なTCP/IPネットワークがボトルネックになります.重要なCPUリソースを消費します.このケーススタディでは,金融サービスインフラストラクチャのチームが,これらの痛みを解決するために,メラノックス (NVIDIA メラノックス) MCX556A-ECATサーバのNICは,レイテンシーを劇的に削減し,サーバーのスループットを測定できる改善を達成します.
背景 と 課題: 微秒 も 重要 な 時
インフラストラクチャチームは,リアルタイムリスク分析をサポートする分散型データベースクラスタを管理した. 25GbE経由で接続された何百ものコモディティサーバーで,ノード間の通信はTCPに依存した.取引量は増加したネットワークスタック処理により,データベースノードでのCPU利用率が75%を超えました.クロスノードメモリ操作の尾遅延は,ピーク時間に200マイクロ秒まで増加ネットワークオーバーヘッドを処理するだけで,コンピューティング需要ではなく,より多くのサーバーを追加することでした.MCX556A-ECAT イーサネット アダプタカードソリューションネットワークの負荷を減らしながら リモート・ダイレクト・メモリー アクセス (RDMA) を可能にします
ソリューション&デプロイメント:ConnectXアダプタでRoCEを実装する
選択肢を評価した後,チームはNVIDIA メラノックス MCX556A-ECATデュアルポートの100GbE容量とネイティブのRoCE (RDMA over Converged Ethernet) サポートに基づいています.標準として展開されています.MCX556A-ECAT ConnectX アダプター PCIe ネットワーク カード,各ホストは,PFC (優先流量制御) とECN (明示的な混雑通知) を有効にした RoCE対応のトップ・オブ・ラックスイッチに接続された単一のアダプタを受け取った.移住の道は直線だった: アダプターはMCX556A-ECATに対応する既存の PCIe 3.0 スロットと,サーバーのアップグレードを排除. 設定は,ドライバスタックでRoCEを有効にし,バッファスロージルを調整することを含む.MCX556A-ECATデータシート2週間以内に 120ノードのクラスタ全体が RDMA ベースの通信を実行し データベースの複製と内存キャッシングを可能にしました
についてMCX556A-ECAT イーサネット アダプター カードユーザスペースVerbs API経由でカーネルバイパス,RDMA書き/読みのためのハードウェアベースの輸送,ゼロコピーデータ移動.メラノックス (NVIDIA メラノックス) MCX556A-ECAT既存のアプリケーションロジックを変えることなくクラスタの低レイテンシーバックボーンに移動する. TCPソケットからlibfabricまたはUCXに切り替えるだけで,通常のメンテナンスウィンドウ中に管理される変更です.
結果と利益:遅延とスループットの測定可能な利益
導入後の指標は投資を検証しましたMCX556A-ECAT 仕様ベースラインとして (微秒未満のハードウェアレイテンシー) チームは以下の結果を達成しました.
| メトリック | 前 (TCP/25GbE) | (RoCE / MCX556A-ECAT) 後に | 改善 |
|---|---|---|---|
| 平均的なノード間の遅延 (小さなMsg) | 12−15 μs | 1.2・1.5 μs | 10倍削減 |
| CPU利用量 (ネットワークスタック) | 中核あたり35% | 1コアあたり < 5% | 86% 卸荷 |
| 総 DB 流量 | 1.8M オプス/秒 | 3.9M オプス/秒 | 117%増加 |
生数値を超えて リスク計算に必要な 99.9 パーセントで 4 マイクロ秒未満の 安定した尾行遅延を達成しました解放されたCPUコアは,既存のサーバーが40%以上のアプリケーションスレッドを処理できるようにしましたハードウェアの購入を延期する.MCX556A-ECAT 販売中1つのサーバー1台のアダプタが6ヶ月以内にROIを提供した.これはノード数の減少と低電力/冷却コストによるもの.MCX556A-ECAT価格ソフトウェア互換性やドライバ安定性を含む所有コストがMellanoxのソリューションを優遇した.
実験チームはMCX556A-ECATに対応する既存のNVMeストレージアレイとNVMe over Fabrics (NVMe-oF) をRDMAで可能にする.この統合ストレージネットワークは,ケーブルとスイッチポートを簡素化し,同じファブリックに統合された.報告書によると,MCX556A-ECATデータシートこのカードは,ポート1本あたり最大1600万 IOPSをサポートします. チームは来年のストレージアップグレードで利用する予定です.
概要&展望:次世代データセンターの基盤
この展開は,MCX556A-ECATRDMA/RoCEを有効にすることで,組織はTCPのボトルネックを壊し,価値追加作業負荷のためにCPUサイクルを再利用することができます.効率的に拡大します.NVIDIA メラノックス MCX556A-ECAT遅延感のある金融において価値が証明されていますが,その利点はAI訓練,HPCシミュレーション,分散型データベースに広がっています.MCX556A-ECAT ConnectX アダプター PCIe ネットワーク カード熟練した,十分に文書化された選択を表します.MCX556A-ECAT 仕様性能調整や検索のためにMCX556A-ECAT 販売中このアダプタは 損失のない低レイテンシーイーサネットを 実現します

