事実
Huaweiは、AI推論用途向けの「コンテキストメモリストレージ」技術を公開した。大規模言語モデル(LLM)の推論過程で生成されるKVキャッシュを最大64ペタバイト(PB)規模で管理可能とするもので、大規模AIクラスタ(スーパーポッド)におけるメモリ階層のボトルネック解消を狙う。
AI推論では、LLMが処理したトークンの文脈情報をKVキャッシュとして保持する必要があり、モデル規模とコンテキスト長の拡大に伴い、このキャッシュの容量と転送がシステム全体のボトルネックとなっている。Huaweiが公開したコンテキストメモリストレージは、このKVキャッシュを64PB規模で格納・供給することで、スーパーポッド構成のAIクラスタにおいてメモリ容量が推論性能を制約する課題への対応を図るものだ。
HBMやDRAMを巡る容量競争が続く中、KVキャッシュを専門に扱うストレージ階層の提示は、AIインフラにおけるメモリ・ストレージの役割分担を再定義する動きとして注目される。公開資料はHuaweiの公式アセットとして提供されており、具体的な製品化時期や採用事例については現時点で明らかにされていない。
Huaweiが公開した、64PBのKVキャッシュを管理するAI推論向けコンテキストメモリストレージに関する主張は、一次資料との突き合わせの結果、裏付けが取れた。Verdict: 事実