上海、2026年9月18日 /PRNewswire/ -- HUAWEI CONNECT 2026において、Huaweiの取締役会副会長兼輪番会長であるDavid Wangは、基調講演で「OceanStor M900 Context Memory Storage」を正式に発表しました。ハイパースケールデータセンターにおけるAI推論向けに設計された本製品は、SuperPoDにPB級の容量とTB/s級の性能を備えた完全共有メモリ空間を提供します。これは、AIインフラがコンピューティング中心のモデルから、コンピューティング、ネットワーク、ストレージの緊密な連携へと移行しつつあることを示しています。これにより、SuperPoDの演算能力を最大限に引き出すことができます。

 

2026年には、AIの技術的なブレークスルーから大規模導入への移行が加速しています。AIアプリケーションは、チャットボットから、複雑なタスクを自律的に遂行できるエージェントへと進化してきました。これらのエージェントは重要な分野で広く採用されており、エージェント型AI時代の幕開けを告げています。

 

大規模モデルのパラメータ数が10兆規模にまで拡大するにつれ、SuperPoDはAIインフラにとって最適な選択肢となりつつあります。主流の大規模モデルはすでに100万トークンを超えるコンテキストウィンドウに対応しており、マルチターン推論や複雑なタスクが一般化し、推論時に生成されるKVキャッシュデータは増え続けています。こうした動向により、オンチップメモリとDRAMは、容量とコスト効率の両面で限界に達しています。オンチップメモリ、DRAM、SSDを連携させ、大容量の完全共有メモリ空間を実現するマルチティア・ストレージシステムの構築が、業界の共通認識となっています。

 

Huaweiは、超長コンテキストおよびマルチターン推論におけるメモリ容量のボトルネックを解消するため、「OceanStor M900 Context Memory Storage」を発表しました。OceanStor M900は、UnifiedBusネットワークを活用し、ワンホップ接続によるPB規模のグローバルなマルチティアKVキャッシュを構築します。これにより、SuperPoDの演算能力を最大限に引き出し、ハイパースケールデータセンターにおけるAI推論を高速化します。OceanStor M900 Context Memory Storageは、以下の3つの主要な機能を備えています。

 

容量の限界を打破し、大規模AIを支える大容量メモリ

 

高速なUnifiedBus相互接続ネットワークを基盤とするKVキャッシュは、階層型ストレージによりグローバルなプール化と共有を実現します。SuperPoDのKVキャッシュは、オンチップメモリとDRAMからSSDまで拡張され、単一のクラスターで64 PBの容量を実現できるようになりました。各NPUで利用可能なKVキャッシュ容量がギガバイト級からテラバイト級へ拡大され、より多くのコンテキストを保存、共有、再利用できるようになりました。これにより、KVキャッシュのヒット率が大幅に向上します。

 

推論性能を高め、演算能力を最大限に引き出す

 

OceanStor M900は、CPU、ネットワークコントローラユニット、NANDコントローラユニットを統合した業界初のアーキテクチャです。ネイティブKVセマンティクスを提供することで、SuperPoDのNPUからSSDへのワンホップ接続を実現します。これにより、プロトコル変換やCPUによる転送が不要となり、アクセス遅延をミリ秒単位から60マイクロ秒に短縮し、90%削減します。1つのクラスターで40 TB/sの総アクセス帯域幅を実現し、同等クラスのソリューションの1.5倍に相当します。一般的なAIプログラミング環境では、このアーキテクチャにより推論クラスターのトークンスループットが2倍になり、最初のトークンが出力されるまでの時間が半減することで、演算能力を生産性の向上につなげます。

 

トークンコストを削減し、AIの大規模かつ低コストな導入を実現

 

OceanStor M900は、業界初のKV認識型適応ストレージ技術を採用しており、データの価値に基づいてKVキャッシュのライフサイクルを予測し、データを各ストレージ媒体にインテリジェントに分散配置します。この技術により、1日あたり最大24回の全容量書き込み(DWPD)に対応し、SSDの耐久性を16倍に高め、3年間にわたる安定性を確保します。ストレージ媒体の交換や運用・保守コストを削減することで、大規模なAI推論インフラの長期的なコストを低減し、AIの導入を加速させます。

 

AIがあらゆる業界の主要な本番システムへと広がるにつれ、AIインフラはコンピューティング中心のモデルから、コンピューティング、ネットワーク、ストレージのより緊密な連携へと進化しつつあります。ハイパースケール推論におけるKVキャッシュの容量とアクセス効率を継続的に向上させるうえで、コンテキストメモリストレージは不可欠となるでしょう。

 

(日本語リリース:クライアント提供)

PR Newswire Asia Ltd.

 

 

PR Newswire
1954年に設立された世界初の米国広報通信社です。配信ネットワークで全世界をカバーしています。Cision Ltd.の子会社として、Cisionクラウドベースコミュニケーション製品、世界最大のマルチチャネル、多文化コンテンツ普及ネットワークと包括的なワークフローツールおよびプラットフォームを組み合わせることで、様々な組織のストーリーを支えています。www.prnasia.com