VAST Dataは,モデルトレーニング,推論,復元拡張生成 (RAG) を実行するクラウドおよびエンタープライズプラットフォームのためのAIインフラストラクチャを進歩させるために AMDとのパートナーシップを拡大しました.そして,代理的なAIの作業負荷統合スタックは,VAST AIオペレーティングシステムと6代目のAMD EPYCプロセッサ,AMD Instinct GPU,AMDネットワークハードウェア,ROCmソフトウェアを統合しています.
この協力は 産業の大きな変化に合致しています AIインフラストラクチャは 訓練のみのクラスターを超えて 持続的なコンテキスト,高コンペレンス推論,複数のターンエージェントのワークフロー現代のAI展開は,効率的なデータ移動,最適化されたKVキャッシュ管理,より高いGPU利用,および大規模なモデルやコンテキストデータセットへの低遅延アクセスを優先します.
VASTのDASE (Disaggregated Shared Everything) アーキテクチャは,これらの近代的なAI環境のための統一された共有データ層として機能します.イベントストリーミングAIクラウドで複数の顧客とアプリケーションタスクを同時に実行するマルチレンタンスとワークロードの隔離を提供しながら,単一のグローバルネームスペースの下でのコアデータサービスも提供します.
AMD EPYC 9006 パワース ネクストジェネレーション VAST ハードウェア
VASTは,6代目のAMD EPYC 9006シリーズ (ベニス) プロセッサを6代目のCBoxと3代目のEBoxシステムに採用しており,これらのプロセッサはVAST AIオペレーティングシステムのハードウェア基盤となる.EPYC 9006プラットフォームは,VASTのハードウェアラインナップにPCIe Gen6接続性を導入するI/O 帯域幅を倍にする
このアップグレードは,ファイルとオブジェクトストレージのスループットを増加させ, VAST DataBaseとDataEngineがサポートするデータベース,データウェアハウス,イベントストリーミングワークロードの遅延を低下させます.I/O 帯域幅の強化により,コンピューティングにおけるボトルネックが緩和されるネットワークおよびNVMeストレージ,モデルロード,復元パイプライン,チェックポイントアクセス,およびネイティブGPUメモリ制限を超えた外部KVキャッシュワークフローに恩恵を与える.
AMD と DriveNets で 3 プレイヤー リファレンス アーキテクチャ
VAST,AMD,DriveNetsは,AMDのラックスケールヘリオスAIインフラストラクチャ,VAST AI OS,およびDriveNets AI Fabricネットワークを組み合わせ,統合されたAIインフラストラクチャ参照アーキテクチャを構築しています.この枠組みは,AI訓練のための標準化された展開ガイドを提供します.推論,強化学習,KVキャッシュワークロード共有されたデータインフラストラクチャと高性能ネットワークを備えたAI工場を建設する企業のためのサイズと可用性のベストプラクティスの提供.
VASTは,インファレンスベンダーである TensorMesh と EmbeddedLLM との生態系関係を拡大し,Agentic AI の用例のための生産レベルのインファレンスアーキテクチャに焦点を当てています.具体的統合と打ち上げの詳細は まだ明らかにされていない.
高対流性推論のために最適化されたKVキャッシュオフロード
更新されたコラボレーションの中心は,AMD Instinct GPU,AMD Infinity Context,ROCmソフトウェアおよびVAST AI OSを活用した強化されたKVキャッシュオフロードです.KVキャッシュは,複数のターン相互作用と長い文脈AIワークロードを加速するために,推論生成された注意状態データを格納します.しかし,大きなキャッシュサイズは限られたGPUメモリを急速に消費します.
高性能共有ストレージにKVキャッシュをオフロードまたは階層化することで,GPUメモリがアクティブタスクのために解放され,後続の推論要求のために文脈データを保存する.AMD Instinct MI355X GPUでの初期テストでは 9 倍高速なタイム・トゥ・ファースト・トークンと 9 倍高速な高コンバランスのエージェント AI ワークロードのトークンスループットは,VAST 駆動の KV キャッシュオフロードにより,7倍高く,ハードウェアベースライン,ワークロード,ストレージ構成によって性能が異なります.
さらに,KVキャッシュデータには VASTの自動化されたライフサイクルポリシーが適用され,キャッシュされたコンテンツのスケジュールされた有効期限と削除が可能です.個人または規制された推論データ.
Pensando Pollara 400 による高速 GPU ストレージ インターコネクト
AMD Pensando Pollara 400 AI NIC を展開し,AMD Instinct GPU を VAST ストレージクラスタに接続する.NICは効率的なGPUからストレージへのデータ転送を可能にします.,KVキャッシュと一般 inference ワークロードのための NVMe ベースの VAST ストレージへの低レイテンシーアクセスを許可します.
このデザインは,物理的なGPUメモリ制限からコンテキスト管理スケーリングを切り離します.VASTは分散型モデル管理のための統一データと実行層としてプラットフォームを位置付けAI クラウドプロバイダでは,このアーキテクチャは GPU の利用率と運用効率を高め,業界がバッチトレーニングとGPUレンタルから持続的な推論と代理AIサービスへの移行を支援する.
北京・チアンシン・ジテング・テクノロジー株式会社
サンディ・ヤン/グローバル戦略ディレクター
WhatsApp / ウェイチャット: +86 13426366826
メール: yangyd@qianxingdata.com
ウェブサイト:www.qianxingdata.com/www.storagesserver.com
ビジネス フォーカス
ICT製品配布/システム統合とサービス/インフラストラクチャソリューション
20年以上のIT販売経験を持つ私たちは 信頼性の高い製品とプロフェッショナルなサービスを提供するために グローバルブランドと提携しています
テクノロジーを使ってインテリジェントな世界を作ろう あなたの信頼できるICT製品サービスプロバイダー!
サンディ・ヤン/グローバル戦略ディレクター
WhatsApp / ウェイチャット: +86 13426366826
メール: yangyd@qianxingdata.com
ウェブサイト:www.qianxingdata.com/www.storagesserver.com
ビジネス フォーカス
ICT製品配布/システム統合とサービス/インフラストラクチャソリューション
20年以上のIT販売経験を持つ私たちは 信頼性の高い製品とプロフェッショナルなサービスを提供するために グローバルブランドと提携しています
テクノロジーを使ってインテリジェントな世界を作ろう あなたの信頼できるICT製品サービスプロバイダー!



