logo
ホーム 事例

VAST DataとAMD、InstinctでのKVキャッシュオフロードにより、初回トークン生成時間が9倍高速化されたと主張

認証
中国 Beijing Qianxing Jietong Technology Co., Ltd. 認証
中国 Beijing Qianxing Jietong Technology Co., Ltd. 認証
顧客の検討
北京Qianxing Jietongの技術Co.、株式会社の販売スタッフは非常に専門および忍耐強い。それらは引用語句をすぐに提供してもいい。プロダクトの質そして包装はまた非常によい。私達の協同は非常に滑らかである。

—— 《のFestfing DVの》 LLC

私がIntel CPUおよび東芝SSDを緊急に捜していたときに、北京Qianxing Jietongの技術Co.、株式会社からのサンディは私に多くの助けを与え、私に私がすぐに必要としたプロダクトを得た。私は実際に彼女を認める。

—— キティ円

北京Qianxing Jietongの技術Co.、株式会社のサンディは私がサーバーを買う時間の構成間違いを私に思い出させることができる非常に注意深いセールスマンである。エンジニアはまた非常に専門で、すぐにテスト プロセスを完了できる。

—— Strelkin Mikhail Vladimirovich

北京千星捷通との仕事は大変満足しています。製品の品質は素晴らしく、納期も常に守られています。営業チームはプロフェッショナルで、忍耐強く、私たちの質問にすべて丁寧に対応してくれます。彼らのサポートに心から感謝しており、長期的なパートナーシップを期待しています。強くお勧めします!

—— アフマド・ナビド

品質: 提供者との素晴らしい経験. MikroTik RB3011は既に使用されていましたが,非常に良い状態で,すべてが完璧に動作しています. コミュニケーションは迅速でスムーズでした.そして私の懸念はすぐに解決されました信頼性の高いサプライヤーです 強くお勧めします

—— ゲラン・コレシオ

オンラインです

VAST DataとAMD、InstinctでのKVキャッシュオフロードにより、初回トークン生成時間が9倍高速化されたと主張

July 28, 2026
VAST Dataは,モデルトレーニング,推論,復元拡張生成 (RAG) を実行するクラウドおよびエンタープライズプラットフォームのためのAIインフラストラクチャを進歩させるために AMDとのパートナーシップを拡大しました.そして,代理的なAIの作業負荷統合スタックは,VAST AIオペレーティングシステムと6代目のAMD EPYCプロセッサ,AMD Instinct GPU,AMDネットワークハードウェア,ROCmソフトウェアを統合しています.

この協力は 産業の大きな変化に合致しています AIインフラストラクチャは 訓練のみのクラスターを超えて 持続的なコンテキスト,高コンペレンス推論,複数のターンエージェントのワークフロー現代のAI展開は,効率的なデータ移動,最適化されたKVキャッシュ管理,より高いGPU利用,および大規模なモデルやコンテキストデータセットへの低遅延アクセスを優先します.

VASTのDASE (Disaggregated Shared Everything) アーキテクチャは,これらの近代的なAI環境のための統一された共有データ層として機能します.イベントストリーミングAIクラウドで複数の顧客とアプリケーションタスクを同時に実行するマルチレンタンスとワークロードの隔離を提供しながら,単一のグローバルネームスペースの下でのコアデータサービスも提供します.

AMD EPYC 9006 パワース ネクストジェネレーション VAST ハードウェア

VASTは,6代目のAMD EPYC 9006シリーズ (ベニス) プロセッサを6代目のCBoxと3代目のEBoxシステムに採用しており,これらのプロセッサはVAST AIオペレーティングシステムのハードウェア基盤となる.EPYC 9006プラットフォームは,VASTのハードウェアラインナップにPCIe Gen6接続性を導入するI/O 帯域幅を倍にする

最新の会社の事例について VAST DataとAMD、InstinctでのKVキャッシュオフロードにより、初回トークン生成時間が9倍高速化されたと主張  0

このアップグレードは,ファイルとオブジェクトストレージのスループットを増加させ, VAST DataBaseとDataEngineがサポートするデータベース,データウェアハウス,イベントストリーミングワークロードの遅延を低下させます.I/O 帯域幅の強化により,コンピューティングにおけるボトルネックが緩和されるネットワークおよびNVMeストレージ,モデルロード,復元パイプライン,チェックポイントアクセス,およびネイティブGPUメモリ制限を超えた外部KVキャッシュワークフローに恩恵を与える.

AMD と DriveNets で 3 プレイヤー リファレンス アーキテクチャ

VAST,AMD,DriveNetsは,AMDのラックスケールヘリオスAIインフラストラクチャ,VAST AI OS,およびDriveNets AI Fabricネットワークを組み合わせ,統合されたAIインフラストラクチャ参照アーキテクチャを構築しています.この枠組みは,AI訓練のための標準化された展開ガイドを提供します.推論,強化学習,KVキャッシュワークロード共有されたデータインフラストラクチャと高性能ネットワークを備えたAI工場を建設する企業のためのサイズと可用性のベストプラクティスの提供.

VASTは,インファレンスベンダーである TensorMesh と EmbeddedLLM との生態系関係を拡大し,Agentic AI の用例のための生産レベルのインファレンスアーキテクチャに焦点を当てています.具体的統合と打ち上げの詳細は まだ明らかにされていない.

高対流性推論のために最適化されたKVキャッシュオフロード

更新されたコラボレーションの中心は,AMD Instinct GPU,AMD Infinity Context,ROCmソフトウェアおよびVAST AI OSを活用した強化されたKVキャッシュオフロードです.KVキャッシュは,複数のターン相互作用と長い文脈AIワークロードを加速するために,推論生成された注意状態データを格納します.しかし,大きなキャッシュサイズは限られたGPUメモリを急速に消費します.

最新の会社の事例について VAST DataとAMD、InstinctでのKVキャッシュオフロードにより、初回トークン生成時間が9倍高速化されたと主張  1

高性能共有ストレージにKVキャッシュをオフロードまたは階層化することで,GPUメモリがアクティブタスクのために解放され,後続の推論要求のために文脈データを保存する.AMD Instinct MI355X GPUでの初期テストでは 9 倍高速なタイム・トゥ・ファースト・トークンと 9 倍高速な高コンバランスのエージェント AI ワークロードのトークンスループットは,VAST 駆動の KV キャッシュオフロードにより,7倍高く,ハードウェアベースライン,ワークロード,ストレージ構成によって性能が異なります.

さらに,KVキャッシュデータには VASTの自動化されたライフサイクルポリシーが適用され,キャッシュされたコンテンツのスケジュールされた有効期限と削除が可能です.個人または規制された推論データ.

Pensando Pollara 400 による高速 GPU ストレージ インターコネクト

AMD Pensando Pollara 400 AI NIC を展開し,AMD Instinct GPU を VAST ストレージクラスタに接続する.NICは効率的なGPUからストレージへのデータ転送を可能にします.,KVキャッシュと一般 inference ワークロードのための NVMe ベースの VAST ストレージへの低レイテンシーアクセスを許可します.

このデザインは,物理的なGPUメモリ制限からコンテキスト管理スケーリングを切り離します.VASTは分散型モデル管理のための統一データと実行層としてプラットフォームを位置付けAI クラウドプロバイダでは,このアーキテクチャは GPU の利用率と運用効率を高め,業界がバッチトレーニングとGPUレンタルから持続的な推論と代理AIサービスへの移行を支援する.

北京・チアンシン・ジテング・テクノロジー株式会社
サンディ・ヤン/グローバル戦略ディレクター
WhatsApp / ウェイチャット: +86 13426366826
メール: yangyd@qianxingdata.com
ウェブサイト:www.qianxingdata.com/www.storagesserver.com
ビジネス フォーカス
ICT製品配布/システム統合とサービス/インフラストラクチャソリューション
20年以上のIT販売経験を持つ私たちは 信頼性の高い製品とプロフェッショナルなサービスを提供するために グローバルブランドと提携しています
テクノロジーを使ってインテリジェントな世界を作ろう あなたの信頼できるICT製品サービスプロバイダー!
連絡先の詳細
Beijing Qianxing Jietong Technology Co., Ltd.

コンタクトパーソン: Ms. Sandy Yang

電話番号: 13426366826

私達に直接お問い合わせを送信 (0 / 3000)