Huawei presenta OceanStor M900 con hasta 64 PB para ampliar el KV cache en inferencia de IA
El sistema crea un pool compartido de KV cache entre memoria y SSD, con hasta 64 PB y 40 TB/s para inferencia de IA a gran escala en centros de datos.