La ejecución de código y el uso de herramientas por parte de agentes de inteligencia artificial requieren entornos aislados que reduzcan la exposición del sistema anfitrión. Cuando las solicitudes aumentan, el tiempo necesario para preparar esos espacios pasa a ser una variable operativa.
Intel evaluó este proceso con CubeSandbox, una plataforma de código abierto de Tencent Cloud, mediante una carga de creación y eliminación de entornos. La prueba elevó la concurrencia agregada desde 100 hasta 350 solicitudes de creación.

Pruebas de latencia en Xeon 6, Xeon 6+ y EPYC
La comparación incluyó al Xeon 6990E+ de 288 núcleos, al Xeon 6980P de 128 núcleos y al AMD EPYC 9965 de 192 núcleos. Intel utilizó como referencia una latencia media de 200 ms para crear cada entorno.
En ese escenario, el Xeon 6990E+ sostuvo el objetivo hasta cerca de 313 solicitudes concurrentes, mientras el Xeon 6980P llegó a aproximadamente 277 y el EPYC 9965 a 246. Los tres procesadores registraron mayores tiempos de creación conforme aumentó la concurrencia.

A partir de esos umbrales, Intel estimó una concurrencia 27% mayor para el Xeon 6990E+ y 12% mayor para el Xeon 6980P frente al EPYC 9965, siempre dentro del límite de 200 ms aplicado a la latencia media.

Cada entorno dispuso de 2000 milliCPU, equivalentes a dos CPU, y 2000 MiB de memoria. Todas las plataformas incorporaron 768 GB de RAM, aunque utilizaron equipos y velocidades de memoria diferentes, según la configuración declarada por Intel.
Las pruebas fueron realizadas por Intel en septiembre de 2026 y midieron el aprovisionamiento de entornos, no la ejecución completa de los agentes. Sus resultados pueden variar según la configuración y la carga utilizada.

