NVIDIA Mellanox 980-9I510-00NS00 実用化 信頼性の高い接続と運用最適化

June 5, 2026

最新の会社ニュース NVIDIA Mellanox 980-9I510-00NS00 実用化 信頼性の高い接続と運用最適化

地域のコロケーション プロバイダーが、繰り返し発生するパケット損失、リンク障害の収束の遅さ、トラフィック テレメトリの複雑さの増大を経験したとき、同社のネットワーク エンジニアリング チームは、従来のスタックベースの L2/L3 アーキテクチャが限界点に達していることに気づきました。このシナリオは特別なものではありません。ハイブリッド クラウド、分散データベース、リアルタイム AI 推論によって推進される IT 管理者とネットワーク アーキテクトは、日常業務を簡素化しながら物理層の高可用性を実現する専用ネットワーキング デバイスを緊急に必要としています。このような背景から、NVIDIA メラノックス 980-9I510-00NS00複数の企業ユーザーによって評価され、最終的にはコア データ交換レイヤーとストレージ フロントエンド ネットワークに導入されています。

背景と課題: 高信頼性の接続と運用の複雑さのトレードオフ

3 つのアベイラビリティ ゾーンを運用している中規模の金融インフラストラクチャ企業は、2 つの永続的な問題に直面していました。まず、リーフスパイン ファブリックのリンク障害により、回復時間が 800 ミリ秒を超え、トランザクションの再試行とアプリケーションのタイムアウトが発生しました。次に、運用チームは週に約 15 時間を費やして、ケーブル配線の整合性、バッファの健全性、および混合ベンダーの機器全体のフロー制御設定を手動で検証しました。彼らは、手動の労力を軽減しながら、決定論的なフェイルオーバーを強制できるソリューションを必要としていました。この要件により、彼らは980-9I510-00NS00 ネットワーク製品最も要求の厳しいポッド: NVMe/TCP ストレージとリアルタイムのリスク分析をサポートする 100G RoCE ファブリック。

ソリューションと展開のアプローチ

アーキテクチャ チームは、2 つの従来の ToR スイッチを980-9I510-00NS00 データセンター高速ネットワーキングハードウェアベースのリンクアグリゲーションと先行標準の STP 拡張機能を活用します。主な展開の選択肢には次のものが含まれます。

  • アクティブ-アクティブ MLAG ドメインNVIDIA メラノックス 980-9I510-00NS00ストレージ コントローラーとコンピューティング ノードに対してデュアルホーム モードで構成され、単一障害点が排除されました。
  • インバンドネットワークテレメトリ(INT)– リアルタイムのキュー深度とポーズ フレーム メトリックが中央コレクタにストリーミングされ、定期的な SNMP ポーリングが置き換えられました。
  • ケーブルと光の自動診断– プラットフォームの組み込み VCSEL ヘルス モニタリングは、リンク フラップが発生する前に、2 つの限界の 100G SR4 トランシーバーにフラグを立てました。
  • ゼロタッチ プロビジョニング (ZTP)– ファームウェアとアクセス ポリシーは中央のオーケストレーターからプッシュされ、デバイスごとのステージング時間が 45 分から 8 分未満に短縮されました。

によると、980-9I510-00NS00 データシート、ハードウェアはマイクロ秒未満のカットスルー遅延とポートあたり最大 200G をサポートするため、チームは複数のレガシー スイッチ層を統合できました。オープンなエコシステムは、ユニットが完全に機能することも意味しました。980-9I510-00NS00互換既存の光学系、ブレークアウト ケーブル、Cumulus Linux ベースの自動化スタックを使用します。

観察された利点と運用上の利益

90 日間の運用パイロットの後、同社は 3 つの異なるカテゴリの改善を測定しました。

メトリック 以前 (レガシー スイッチ) 980-9I510-00NS00付き
リンク障害の回復 ~820 ミリ秒 (STP 再コンバージェンス) 15 ミリ秒未満 (ハードウェア支援フェイルオーバー)
平均診断時間 (MTTD) 47分 12 分 (INT + 異常アラート)
ファブリックテール遅延 (P99.9) 280 µs @ 70% 負荷 49 μs @ 85% 負荷
手動運用チケット/月 22 8 (ほとんどが計画的なメンテナンス)

数字以外にも、ネットワーク チームは時間外の緊急通報が減少したと報告しました。の980-9I510-00NS00の仕様キューごとの包括的なバッファ統計やハードウェア タイムスタンプなどにより、輻輳がアプリケーションに影響を与える前にトラフィックをプロアクティブに再形成できるようになりました。調達に関しては、980-9I510-00NS00 価格付属のテレメトリと複数年のサポートを考慮すると、高速ポートあたりのコストは、同等の固定フォームファクタ スイッチよりも低いことが判明しました。製品はすでにリストされています980-9I510-00NS00 販売用NVIDIA のパートナー ネットワークを通じて、データセンター全体の展開にボリューム ディスカウントを利用できます。

概要と展望

パイロット展開により、980-9I510-00NS00 ネットワーク製品ソリューションコモディティスイッチングと非常に信頼性の高いデータセンターファブリックの間のギャップに直接対処します。予測できないリンク動作、高い運用オーバーヘッド、または遅い障害分離に悩まされている企業は、決定的なハードウェア フェイルオーバー、詳細なテレメトリ、および既存の光および自動スタックとの広範な互換性の恩恵を受けることができます。今後、同じ金融インフラ会社は、980-9I510-00NS00エッジ コロケーション サイトおよび災害復旧クラスターに接続し、都市圏の距離全体で 10 ミリ秒未満の RTO を目標とします。次世代データセンター ネットワーキングを評価するネットワーク アーキテクトと IT 管理者にとって、このプラットフォームは、信頼性と運用効率の両方に対する実用的で導入可能な答えを提供します。