logo
ホーム ニュース

会社のニュース MinIO は、Nvidia GPU 推論用にペタバイト規模の MemKV キャッシュを追加します

認証
中国 Beijing Qianxing Jietong Technology Co., Ltd. 認証
中国 Beijing Qianxing Jietong Technology Co., Ltd. 認証
顧客の検討
北京Qianxing Jietongの技術Co.、株式会社の販売スタッフは非常に専門および忍耐強い。それらは引用語句をすぐに提供してもいい。プロダクトの質そして包装はまた非常によい。私達の協同は非常に滑らかである。

—— 《のFestfing DVの》 LLC

私がIntel CPUおよび東芝SSDを緊急に捜していたときに、北京Qianxing Jietongの技術Co.、株式会社からのサンディは私に多くの助けを与え、私に私がすぐに必要としたプロダクトを得た。私は実際に彼女を認める。

—— キティ円

北京Qianxing Jietongの技術Co.、株式会社のサンディは私がサーバーを買う時間の構成間違いを私に思い出させることができる非常に注意深いセールスマンである。エンジニアはまた非常に専門で、すぐにテスト プロセスを完了できる。

—— Strelkin Mikhail Vladimirovich

北京千星捷通との仕事は大変満足しています。製品の品質は素晴らしく、納期も常に守られています。営業チームはプロフェッショナルで、忍耐強く、私たちの質問にすべて丁寧に対応してくれます。彼らのサポートに心から感謝しており、長期的なパートナーシップを期待しています。強くお勧めします!

—— アフマド・ナビド

品質: 提供者との素晴らしい経験. MikroTik RB3011は既に使用されていましたが,非常に良い状態で,すべてが完璧に動作しています. コミュニケーションは迅速でスムーズでした.そして私の懸念はすぐに解決されました信頼性の高いサプライヤーです 強くお勧めします

—— ゲラン・コレシオ

オンラインです
会社 ニュース
MinIO は、Nvidia GPU 推論用にペタバイト規模の MemKV キャッシュを追加します

MinIO は、Nvidia GPU 向けに調整されたペタバイト規模の MemKV キャッシュ システムを開発し、AIStor オブジェクト ストレージ プラットフォーム上に展開しました。

推論を実行する GPU クラスターには、コンテキスト、ベクトル化されたトークン、および中間キーと値 (KV) ペアを保存するために高帯域幅メモリ (HBM) が必要です。 GPU HBM が飽和すると、データは CPU DRAM と NVMe SSD にカスケードされ、Nvidia BlueField-4 (BF4) DPU によって管理されます。これらの層が容量に達すると、MinIO AIStor が最後のストレージ バックアップとして機能します。 Nvidia の STX アーキテクチャはこの多層キャッシュ階層を管理し、MemKV は標準に準拠して、優れた規模で GPU クラスター全体に永続的な共有コンテキストを提供します。

最新の会社ニュース MinIO は、Nvidia GPU 推論用にペタバイト規模の MemKV キャッシュを追加します  0


MinIO の共同創設者兼共同 CEO である AB Periasamy 氏は次のようにコメントしました: 「業界は何年もコンテキスト損失について問題を解決してきました。なぜなら、小規模では再計算税を吸収してしまう可能性があるからです。今日のハイパースケーラーとネオクラウドの GPU 密度が高い状況では、これはもはや実行可能ではありません。」

生成されたコンテキストを再計算すると電力が無駄になります。数千の GPU を備えたクラスターの場合、根本的な構造的非効率が生じます。大規模な推論には専用のインフラストラクチャが必要であり、MemKV はこのデータ パス専用に設計されています。」

MinIO は初めて、マイクロ秒レベルの遅延マッチング推論ワークフローで GPU クラスター全体の共有コンテキスト プールを有効にし、従来の外部ストレージによるミリ秒の遅延を回避します。十分なキャッシュ層がないと、GPU はコンテキストの再計算を繰り返すことでリソースを無駄にします。

128K トークンのコンテキスト長を持つ 128 GPU のデプロイメントでは、MemKV は実稼働負荷下での最初のトークンまでの時間を改善し、GPU 使用率を 50% から 90% 以上に向上させ、推定年間 200 万ドルのコンピューティング コストを節約しました。

Nvidia STX アーキテクチャ専用に構築された MemKV は、Nvidia Dynamo および NIXL キャッシュ ツールをサポートします。ペタバイト規模の共有コンテキスト メモリを SSD レベルのコストで提供し、GPU コンピューティング リソースからキャッシュ スケーリングを切り離します。その中心的な機能は以下のとおりです。
  • ネイティブ BF4 STX サポート: STX インフラストラクチャ内で ARM64 バイナリとして実行され、個別の x86 ストレージ サーバーではなくストレージに組み込まれます。
  • エンドツーエンドのRDMAトランスポート: 従来のファイルおよびオブジェクト ストレージ プロトコルをバイパスして、RDMA 経由で GPU メモリと NVMe の間で KV キャッシュを転送します。
  • GPUに最適化されたブロックサイズ: 従来の 4 KB ストレージ ブロックの代わりに、GPU スループット要求に応じて 2 ~ 16 MB ブロックを使用します。
  • ワイヤースピードのパフォーマンス: Nvidia Spectrum-X イーサネットおよび PCIe Gen6 用に最適化され、物理ファブリックのスループットを最大化します。


MemKV は、RDMA 経由で NVMe SSD から AI パイプラインにデータを直接転送し、HTTP オーバーヘッド、ファイル システム変換、中間ストレージ サーバーを排除します。


最新の会社ニュース MinIO は、Nvidia GPU 推論用にペタバイト規模の MemKV キャッシュを追加します  1

MinIO は、競合するコンテキスト メモリ ソリューションを、共有不可能なローカル NVMe (G3) と汎用共有ストレージ (G4) の 2 つのタイプに分類します。 MemKV を専用の G3.5 層として位置づけ、汎用ストレージ製品とは区別します。

同社は、レガシーベンダーのG3.5製品には依然として冗長なプロトコルノード、メタデータサービス、ファイル変換層が残っていることを強調している。これらのレイヤーは、トレーニング データとモデルの重みの耐久性と一貫性を保証しますが、2 ~ 16 MB のデータ ブロックに最適化された一時的な再計算可能な KV キャッシュには不要です。

ハードウェア RAID ベンダーの GRAID とストレージ企業 WEKA も、STX 互換の KV キャッシュ ソリューションを提供しています。 Cloudian、Dell、DDN、Everpure、Hammerspace、Hitachi Vantara、HPE、Lightbits/ScaleFlux、NetApp、Nutanix、Peak:AIO、Pliops、VAST Data など、幅広いストレージ ベンダーが Nvidia STX をサポートしています。

北京乾興解放科技有限公司
サンディ・ヤン/グローバル戦略ディレクター
WhatsApp / WeChat: +86 13426366826
電子メール: yangyd@qianxingdata.com
ウェブサイト: www.qianxingdata.com/www.storagesserver.com
ビジネスの焦点:
ICTプロダクト流通/システムインテグレーション&サービス/インフラソリューション
20 年以上の IT 流通経験を持つ当社は、主要な世界的ブランドと提携して、信頼性の高い製品とプロフェッショナルなサービスを提供しています。
「テクノロジーを活用してインテリジェントな世界を構築する」信頼できる ICT 製品サービス プロバイダー!
パブの時間 : 2026-05-14 13:46:14 >> ニュースのリスト
連絡先の詳細
Beijing Qianxing Jietong Technology Co., Ltd.

コンタクトパーソン: Ms. Sandy Yang

電話番号: 13426366826

私達に直接お問い合わせを送信 (0 / 3000)